平时做技术实践时,很多问题不是概念不会,而是细节没串起来。拿“正则表达式的整理与归纳(附例子)”来说,它看着像小点,放到项目里常会牵出环境、配置、兼容性和维护成本。下面按实际采用顺序,把思路、关键写法和容易踩坑的地方讲清楚,便于大家直接对照操作。
落到代码里,正则表达式是由普通字符(a-z)和特殊字符(元字符)组成的文本模式。比如,在正则表达式“[a-z]*”描述了所有仅包含小写字母的字符串,其中a,z为普通字符,连字符、左右中括号及星号则为元字符
正则表达式中的元字符的类别
1. 点号
点号能够匹配除“n”之外的任何单字符。
2. 中括号
落到代码里,能够在中括号([])内指定需匹配的若干字符,表示仅采用这些字符参与匹配。
3. 竖线
竖线(|)能够匹配其左侧或右侧的符号。
4. ^符号
^符号能够匹配一行的开始。
5. 美元符号
美元符号($)能够匹配一行的结束。
6. 反斜线
反斜线()表示其后的字符是普通字符而非元字符。
常用的匹配次数元符号
| 元字符 | 含义 |
|---|---|
| X* | 匹配X出现零次或多次,如Y、YXXXY |
| X+ | 匹配X出现一次或多次,如YXY、YXX |
| X? | 匹配X出现零次或一次,如Y、YXY |
| X{n} | 匹配X恰好出现n次 |
| X{n,} | 匹配X出现至少n次 |
| X{n,m} | n<=m,匹配X出现至少n次,最多m次 |
预定义字符(只匹配一个字符)
| 元字符 | 含义 |
|---|---|
| d | 数字,相当于[0-9] |
| D | 非数字,相当于[^0-9] |
| s | 空白字符,相当于[tnx0Bfr] |
| S | 非空白字符,相当于[^s] |
| w | 单词字符,相当于[a-zA-Z_0-9] |
| W | 非单词字符,相当于[^w] |
| b | 单词边界 |
| B | 非单词边界 |
| A | 输入的开头 |
| G | 上一个匹配的结尾 |
自定义字符(只匹配一个字符)
| 元字符 | 含义 |
|---|---|
| [abc] | 只能是a,b或c |
| [^abc] | 除了a,b,c之外的任何字符 |
| [a-zA-Z] | a到z A到Z,包括(范围) |
| [a-d[m-p]] | a到d,或m到p |
| [a-z&&[bcd]] | a-z和bcd的交集,为b,c,d |
| [a-z&&[^bcd]] | a-z和非bcd的交集,等同于[ae-z] |
| [a-z&&[^m-p]] | a-z和除了m到p的交集,等同于[a-lq-z] |
举比如下所示
import java.util.ArrayList;
import java.util.List;
//通过正则表达式来提取访问数据中的人物姓名并进行去重
public class MyMain {
public static void main(String[] args) {
String log = "张三10:23:0:802023-10-09 09:21:22"
+ "李四115:203:10:1802023-05-09 19:21:22"
+ "王五115:203:10:1802023-05-09 19:21:22"
+ "张三11:22:0:802024-11-09 07:21:25";
// 解析出姓名并写入到List
String[] nameIPs = log.split("\d{4}-\d{2}-\d{2} \d{2}:\d{2}:\d{2}");
// 该List中的姓名可能会出现重复
List<String> names = new ArrayList<String>();
for(String nameIP : nameIPs) {
int index = -1;
//找到第一个数字的地址,结束内层循环
for (int i = 0; i < nameIP.length(); i++) {
if(nameIP.charAt(i) >= '0' && nameIP.charAt(i) <= '9') {
index = i;
break;
}
} // 内层for
//截取名字部分,即从零到第一个数字的部分
String name = nameIP.substring(0, index);
//向集合之中添加该名字
names.add(name);
}
// 对List中的姓名去重
// 该List中的姓名是唯一的
//定义一个新的集合,用来存放不重复的名字
List<String> nameUniques = new ArrayList<String>();
for(String name : names) {
if(!nameUniques.contains(name)) {
nameUniques.add(name);
}
}
for(String name : nameUniques) {
System.out.println(name);
}
}
}
运行结果

其它方面的细节及注意事项
- 从实现思路看,为转义字符,用来改变后面那个字符原本的含义,在程序中\d才表示一个d的含义。
- 正则表达式是从左到右一个一个去匹配的,一个表达式只对应一个字符。
- 实际处理时,matches()方法能够用来判断一个字符串是否满足对应的正则表达式,同时得到结果true或者false。
- 在这个场景下,若要求两个范围的交集,需写符号&&,若只写一个&,则只表示一个&符号。
总结
到此这篇关于正则表达式整理与归纳的文章就介绍到这了,更多相关正则表达式例子内容请搜索脚本之家以前的文章或继续浏览下面的相关文章希望大家以后多多兼容脚本之家!
您可能感兴趣的文章:
- JS匹配日期和时间的正则表达式示例
- JS基础教程——正则表达式示例(建议)