无涯教程-Java - 正则表达式-程序员宅基地

技术标签: java  无涯教程  

Java为使用正则表达式进行模式匹配提供了java.util.regex包,Java正则表达式非常类似于Perl编程语言,并且非常容易学习。

regex包主要由以下三个类组成

  • Pattern class                       - Pattern对象是正则表达式的表示形式,没有提供公共构造函数。

  • Matcher class                     - Matcher对象是解释模式并对输入字符串执行匹配操作的引擎。

  • PatternSyntaxException  -  PatternSyntaxException对象是一个未检查的异常,指示正则表达式模式中的语法错误。

捕获组

捕获组是一种将多个字符视为一个单元的方法。如正则表达式(Dog)创建一个包含字母“ d”,“ o”和“ g”的单个组。

捕获组通过从左到右计数其左括号进行编号。如在表达式(A)(B(C)中,存在四个这样的组-

  • ((A)(B(C)))
  • (A)
  • (B(C))
  • (C)

若要了解表达式中存在多少个组,请对Matcher 对象调用groupCount方法,groupCount方法返回一个int,显示匹配器模式中存在的捕获组的数量。

还有一个特殊的组,组0,它始终表示整个表达式,此组不包括在groupCount报告的总数中。

以下示例说明如何从给定的字母数字字符串中查找数字字符串

import java.util.regex.Matcher;
import java.util.regex.Pattern;

public class RegexMatches {
   

   public static void main( String args[] ) {
   
      //要扫描的字符串以查找模式。
      String line = "This order was placed for QT3000! OK?";
      String pattern = "(.*)(\\d+)(.*)";

      //创建Pattern对象
      Pattern r = Pattern.compile(pattern);

      //现在创建匹配器对象。
      Matcher m = r.matcher(line);
      if (m.find( )) {
   
         System.out.println("Found value: " + m.group(0) );
         System.out.println("Found value: " + m.group(1) );
         System.out.println("Found value: " + m.group(2) );
      }else {
   
         System.out.println("NO MATCH");
      }
   }
}

这将产生以下输出-

Found value: This order was placed for QT3000! OK?
Found value: This order was placed for QT300
Found value: 0

表达式语法

下面的表列出了java-中可用的所有正则表达式元字符语法

Subexpression Matches
^ 匹配行的开头。
$ 匹配行的结尾。
. 匹配除换行符以外的任何单个字符。
[...] 匹配括号中的任何单个字符。
[^...] 匹配任何不在方括号中的单个字符。
\A 整个字符串的开头。
\z 整个字符串的结尾。
 \Z 整个字符串的结尾,但允许的最后一行终止符除外。
re* 匹配0个或多个
re+ 匹配1个或多个
re? 匹配0或1个。
re{ n} 精确匹配n个。
re{ n,} 至少匹配n个。
re{ n, m} 至少匹配n个,最多匹配m个。
a| b 匹配a或b。
(re) 分组匹配
 (?: re) 分组匹配,而无需记住匹配的文本。
(?> re) 匹配独立模式而不回溯。
\w 匹配单词字符。
\W 匹配非单词字符。
\s 匹配空白。 等效于[\t\n\r\f]。
\S 匹配非空格。
\d 匹配数字。 相当于[0-9]。
\D 匹配非数字。
\A 匹配字符串的开头。
 \Z 匹配字符串的结尾。 如果存在换行符,则匹配换行符。
\z 匹配字符串的结尾。
\G 匹配最后结束点。
\n 匹配换行“n”。
\b 匹配单词边界。
\B 匹配非单词边界。
\n,\t, etc. 匹配换行符,回车符,制表符等。
\Q 转义(引号)所有字符,直到\E。
\E 结束语以\Q开头。

Matcher方法

索引方法提供有用的索引值,这些索引值精确地显示了在输入字符串-中找到匹配的位置

Sr.No. Method & Remark
1

public int start()

返回上一个匹配项的开始索引。

2

public int start(Int Group)

返回给定组在上一次匹配操作期间捕获的子序列的开始索引。

3

public int end()

返回匹配的最后一个字符之后的偏移量。

4

public int end(Int Group)

返回在上一个匹配操作期间由给定组捕获的子序列的最后一个字符之后的偏移量。

查找方法

查找方法检查输入字符串并返回一个布尔值,指示是否找到-模式

Sr.No. Method & Remark
1

public boolean lookingAt()

尝试将输入序列与模式进行匹配,从开头开始。

2

public boolean find()

尝试查找与模式匹配的输入序列的下一个子序列。

3

public boolean find(Int Start)

重置此匹配器,然后尝试查找与模式匹配的输入序列的下一个子序列,从指定的索引处开始。

4

public boolean matches()

尝试将整个区域与模式进行匹配。

替换方法

替换方法是用于替换输入字符串中的文本的有用方法

Sr.No. Method & Remark
1

public Matcher appendReplace(StringBuffer sb,String replacement)

实现追加和替换操作。

2

public StringBuffer appendTail(StringBuffer sb)

实现终端附加和替换步骤。

3

public String replaceAll(String replacement)

用给定的替换字符串替换与模式匹配的输入序列的每个子序列。

4

public String replaceFirst(String replacement)

用给定的替换字符串替换与模式匹配的输入序列的第一个子序列。

5

public static String quoteReplace(string s)

返回指定字符串的文字替换字符串。此方法生成一个字符串,该字符串将作为Matcher类的appendReplace方法中的文字替换。

Start和End方法示例

import java.util.regex.Matcher;
import java.util.regex.Pattern;

public class RegexMatches {
   

   private static final String REGEX = "\\bcat\\b";
   private static final String INPUT = "cat cat cat cattie cat";

   public static void main( String args[] ) {
   
      Pattern p = Pattern.compile(REGEX);
      Matcher m = p.matcher(INPUT);   //获取匹配器对象
      int count = 0;

      while(m.find()) {
   
         count++;
         System.out.println("Match number "+count);
         System.out.println("start(): "+m.start());
         System.out.println("end(): "+m.end());
      }
   }
}

这将产生以下输出-

Match number 1
start(): 0
end(): 3
Match number 2
start(): 4
end(): 7
Match number 3
start(): 8
end(): 11
Match number 4
start(): 19
end(): 22

Matches and lookingAt 方法示例

matches和lookingAt方法都试图将输入序列与模式进行匹配。然而,不同的是,matches要求匹配整个输入序列,而lookingAt不需要。

这两种方法始终从输入字符串的开头开始。下面是解释函数-的示例

import java.util.regex.Matcher;
import java.util.regex.Pattern;

public class RegexMatches {
   

   private static final String REGEX = "foo";
   private static final String INPUT = "fooooooooooooooooo";
   private static Pattern pattern;
   private static Matcher matcher;

   public static void main( String args[] ) {
   
      pattern = Pattern.compile(REGEX);
      matcher = pattern.matcher(INPUT);

      System.out.println("Current REGEX is: "+REGEX);
      System.out.println("Current INPUT is: "+INPUT);

      System.out.println("lookingAt(): "+matcher.lookingAt());
      System.out.println("matches(): "+matcher.matches());
   }
}

这将产生以下输出-

Current REGEX is: foo
Current INPUT is: fooooooooooooooooo
lookingAt(): true
matches(): false

replaceFirst和replaceAll方法示例

replaceFirst和replaceAll方法替换与给定正则表达式匹配的文本。顾名思义,replaceFirst替换第一个匹配项,replaceAll替换所有匹配项。

import java.util.regex.Matcher;
import java.util.regex.Pattern;

public class RegexMatches {
   

   private static String REGEX = "dog";
   private static String INPUT = "The dog says meow. " + "All dogs say meow.";
   private static String REPLACE = "cat";

   public static void main(String[] args) {
   
      Pattern p = Pattern.compile(REGEX);
      
      //获取匹配器对象
      Matcher m = p.matcher(INPUT); 
      INPUT = m.replaceAll(REPLACE);
      System.out.println(INPUT);
   }
}

这将产生以下输出-

The cat says meow. All cats say meow.

appendReplace和appendTail方法示例

Matcher类还为文本替换提供appendReplace和appendTail方法。

import java.util.regex.Matcher;
import java.util.regex.Pattern;

public class RegexMatches {
   

   private static String REGEX = "a*b";
   private static String INPUT = "aabfooaabfooabfoob";
   private static String REPLACE = "-";
   public static void main(String[] args) {
   

      Pattern p = Pattern.compile(REGEX);
      
      //获取匹配器对象
      Matcher m = p.matcher(INPUT);
      StringBuffer sb = new StringBuffer();
      while(m.find()) {
   
         m.appendReplacement(sb, REPLACE);
      }
      m.appendTail(sb);
      System.out.println(sb.toString());
   }
}

这将产生以下输出-

-foo-foo-foo-

PatternSyntaxException 

PatternSyntaxException是一个未经检查的异常,它指示正则表达式模式中的语法错误。PatternSyntaxException类提供以下方法来帮助您确定错误的-

Sr.No. Method & Remark
1

public String getRemark()

检索错误的说明。

2

public int getIndex()

检索错误索引。

3

public String getPattern()

检索错误的正则表达式模式。

4

public String getMessage()

返回一个多行字符串,其中包含语法错误及其索引的说明、错误的正则表达式模式以及模式内错误索引的可视指示。

Java - 正则表达式 - 无涯教程网无涯教程网提供Java为使用正则表达式进行模式匹配提供了java.util.regex包,Java正则表达式非常类似...https://www.learnfk.com/java/java-regular-expressions.html

版权声明:本文为博主原创文章,遵循 CC 4.0 BY-SA 版权协议,转载请附上原文出处链接和本声明。
本文链接:https://blog.csdn.net/w116858389/article/details/137112910

智能推荐

874计算机科学基础综合,2018年四川大学874计算机科学专业基础综合之计算机操作系统考研仿真模拟五套题...-程序员宅基地

文章浏览阅读1.1k次。一、选择题1. 串行接口是指( )。A. 接口与系统总线之间串行传送,接口与I/0设备之间串行传送B. 接口与系统总线之间串行传送,接口与1/0设备之间并行传送C. 接口与系统总线之间并行传送,接口与I/0设备之间串行传送D. 接口与系统总线之间并行传送,接口与I/0设备之间并行传送【答案】C2. 最容易造成很多小碎片的可变分区分配算法是( )。A. 首次适应算法B. 最佳适应算法..._874 计算机科学专业基础综合题型

XShell连接失败:Could not connect to '192.168.191.128' (port 22): Connection failed._could not connect to '192.168.17.128' (port 22): c-程序员宅基地

文章浏览阅读9.7k次,点赞5次,收藏15次。连接xshell失败,报错如下图,怎么解决呢。1、通过ps -e|grep ssh命令判断是否安装ssh服务2、如果只有客户端安装了,服务器没有安装,则需要安装ssh服务器,命令:apt-get install openssh-server3、安装成功之后,启动ssh服务,命令:/etc/init.d/ssh start4、通过ps -e|grep ssh命令再次判断是否正确启动..._could not connect to '192.168.17.128' (port 22): connection failed.

杰理之KeyPage【篇】_杰理 空白芯片 烧入key文件-程序员宅基地

文章浏览阅读209次。00000000_杰理 空白芯片 烧入key文件

一文读懂ChatGPT,满足你对chatGPT的好奇心_引发对chatgpt兴趣的表述-程序员宅基地

文章浏览阅读475次。2023年初,“ChatGPT”一词在社交媒体上引起了热议,人们纷纷探讨它的本质和对社会的影响。就连央视新闻也对此进行了报道。作为新传专业的前沿人士,我们当然不能忽视这一热点。本文将全面解析ChatGPT,打开“技术黑箱”,探讨它对新闻与传播领域的影响。_引发对chatgpt兴趣的表述

中文字符频率统计python_用Python数据分析方法进行汉字声调频率统计分析-程序员宅基地

文章浏览阅读259次。用Python数据分析方法进行汉字声调频率统计分析木合塔尔·沙地克;布合力齐姑丽·瓦斯力【期刊名称】《电脑知识与技术》【年(卷),期】2017(013)035【摘要】该文首先用Python程序,自动获取基本汉字字符集中的所有汉字,然后用汉字拼音转换工具pypinyin把所有汉字转换成拼音,最后根据所有汉字的拼音声调,统计并可视化拼音声调的占比.【总页数】2页(13-14)【关键词】数据分析;数据可..._汉字声调频率统计

linux输出信息调试信息重定向-程序员宅基地

文章浏览阅读64次。最近在做一个android系统移植的项目,所使用的开发板com1是调试串口,就是说会有uboot和kernel的调试信息打印在com1上(ttySAC0)。因为后期要使用ttySAC0作为上层应用通信串口,所以要把所有的调试信息都给去掉。参考网上的几篇文章,自己做了如下修改,终于把调试信息重定向到ttySAC1上了,在这做下记录。参考文章有:http://blog.csdn.net/longt..._嵌入式rootfs 输出重定向到/dev/console

随便推点

uniapp 引入iconfont图标库彩色symbol教程_uniapp symbol图标-程序员宅基地

文章浏览阅读1.2k次,点赞4次,收藏12次。1,先去iconfont登录,然后选择图标加入购物车 2,点击又上角车车添加进入项目我的项目中就会出现选择的图标 3,点击下载至本地,然后解压文件夹,然后切换到uniapp打开终端运行注:要保证自己电脑有安装node(没有安装node可以去官网下载Node.js 中文网)npm i -g iconfont-tools(mac用户失败的话在前面加个sudo,password就是自己的开机密码吧)4,终端切换到上面解压的文件夹里面,运行iconfont-tools 这些可以默认也可以自己命名(我是自己命名的_uniapp symbol图标

C、C++ 对于char*和char[]的理解_c++ char*-程序员宅基地

文章浏览阅读1.2w次,点赞25次,收藏192次。char*和char[]都是指针,指向第一个字符所在的地址,但char*是常量的指针,char[]是指针的常量_c++ char*

Sublime Text2 使用教程-程序员宅基地

文章浏览阅读930次。代码编辑器或者文本编辑器,对于程序员来说,就像剑与战士一样,谁都想拥有一把可以随心驾驭且锋利无比的宝剑,而每一位程序员,同样会去追求最适合自己的强大、灵活的编辑器,相信你和我一样,都不会例外。我用过的编辑器不少,真不少~ 但却没有哪款让我特别心仪的,直到我遇到了 Sublime Text 2 !如果说“神器”是我能给予一款软件最高的评价,那么我很乐意为它封上这么一个称号。它小巧绿色且速度非

对10个整数进行按照从小到大的顺序排序用选择法和冒泡排序_对十个数进行大小排序java-程序员宅基地

文章浏览阅读4.1k次。一、选择法这是每一个数出来跟后面所有的进行比较。2.冒泡排序法,是两个相邻的进行对比。_对十个数进行大小排序java

物联网开发笔记——使用网络调试助手连接阿里云物联网平台(基于MQTT协议)_网络调试助手连接阿里云连不上-程序员宅基地

文章浏览阅读2.9k次。物联网开发笔记——使用网络调试助手连接阿里云物联网平台(基于MQTT协议)其实作者本意是使用4G模块来实现与阿里云物联网平台的连接过程,但是由于自己用的4G模块自身的限制,使得阿里云连接总是无法建立,已经联系客服返厂检修了,于是我在此使用网络调试助手来演示如何与阿里云物联网平台建立连接。一.准备工作1.MQTT协议说明文档(3.1.1版本)2.网络调试助手(可使用域名与服务器建立连接)PS:与阿里云建立连解释,最好使用域名来完成连接过程,而不是使用IP号。这里我跟阿里云的售后工程师咨询过,表示对应_网络调试助手连接阿里云连不上

<<<零基础C++速成>>>_无c语言基础c++期末速成-程序员宅基地

文章浏览阅读544次,点赞5次,收藏6次。运算符与表达式任何高级程序设计语言中,表达式都是最基本的组成部分,可以说C++中的大部分语句都是由表达式构成的。_无c语言基础c++期末速成