【C正则表达式30分钟入门教程】-全球旧事资料库

C正则表达式30分钟入门教程

本文由de
is_pe
g11贡献r
doc文档可能在WAP端浏览体验不佳。建议您优先选择TXT，或下载源文件到本机查看。r
学习正则表达式的最好方法是从例子开始，理解例子之后再自己对例子进行修改，实验。下面给出了不少简单的例子，并对它们作了详细的说明。假设你在一篇英文小说里查找hi，你可以使用正则表达式hi。这是最简单的正则表达式了，它可以精确匹配这样的字符串：由两个字符组成，前一个字符是h后一个是i。通常，处理正则表达式的工具会提供一个忽略大小写的选项，如果选中了这个选项，它可以匹配hiHIHihI这四种情况中的任意一种。不幸的是，很多单词里包含hi这两个连续的字符，比如himhistoryhigh等等。用hi来查找的话，这里边的hi也会被找出来。如果要精确地查找hi这个单词的话，我们应该使用bhib。b是正则表达式规定的一个特殊代码（好吧，某些人叫它元字符，元字符，元字符metacharacter），代表着单词的开头或结尾，也就是单词的分界处。虽然通常英文的单词是由空格或标点符号或换行来分隔的，但是b并不匹配这些单词分隔符中的任何一个，它只匹配一个位置（如果需要更精确的说法，b匹配这样的位置：只匹配一个位置。只匹配一个位置它的前一个字符和后一个字符不全是一个是一个不是或不存在w）假如你要找的是hi后面不远处跟着一个Lucy，你应该用bhibbLucyb。这里，是另一个元字符，匹配除了换行符以外的任意字符。同样是元字符，不过它代表的不是字符，也不是位置，而是数量它指定前边的内容可以连续重复出现任意次以使整个表达式得到匹配。因此，连在一起就意味着任意数量的不包含换行的字符。现在bhibbLucyb的意思就很明显了：先是一个单词hi然后是任意个任意字符但不能是换行，最后是Lucy这个单词。如果同时使用其它的一些元字符，我们就能构造出功能更强大的正则表达式。比如下面这个例子：0dddddddddd匹配这样的字符串：以0开头，然后是两个数字，然后是一个连字号“”，最后是8个数字也就是中国的电话号码。当然，这个例子只能匹配区号为3位的情形。这里的d是一个新的元字符，匹配任意的数字0，或1，或2，或……。不是元字符，只匹配它本身连字号。为了避免那么多烦人的重复，我们也可以这样写这个表达式：0d2d8。这里d后面的28的意思是前面d必须连续重复匹配2次8次。r
测试正则表达式r
如果你不觉得正则表达式很难读写的话，要么你是一个天才，要么，你不是地球r