资源描述:
《emeditor正则表达式教程》由会员上传分享,免费在线阅读,更多相关内容在行业资料-天天文库。
1、Emeditor正则表达式教程EmEditor正则表达式应用专题1在工作中,经常用到EmEditor来编辑纯文本文档。最近接触了正则表达式,感受到其功能非常强大。我现在想要实现这样一个功能,还没有比较好的解决办法:在一篇中英文混排的文档中,删除中文字符(包括标点)之间的空格,但英文单词之间及英文单词与字母之前的空格不能删除;仅删除全角或半角空格,不删除制表符。求高人试一下。以下是一些比较有用的正则表达式:^[ t]*这个正则表达式代表所有的空行,指含有零个或零个以上空格或制表符、以换行符结尾、不
2、含其它字符的行。(^
3、(?<=中国)).*?(?=中国
4、$)用正则表达式匹配特定字符串外的所有字符。指除“中国”外的所有其它字符,类似于反选功能。^[ t]+查找以上字符,并替换为空,可删除行首空白(包括全半角空格和制表符)。[ t]+$查找以上字符,并替换为空,可删除行末空白(包括全半角空格和制表符)。^[ t]+
5、[ t]+$查找以上正则表达式,并替换为空,可删除行首和行末所有空白(包括全半角空格和制表符)。匹配中文字符的正则表达式:[u4e00-u9fa5]评注:匹配中文还真是个头疼
6、的事,有了这个表达式就好办了匹配双字节字符(包括汉字在内):[^x00-xff]评注:可以用来计算字符串的长度(一个双字节字符长度计2,ASCII字符计1)匹配空白行的正则表达式:s*r评注:可以用来删除空白行匹配HTML标记的正则表达式:<(S*?)[^>]*>.*?
7、<.*?/>评注:网上流传的版本太糟糕,上面这个也仅仅能匹配部分,对于复杂的嵌套标记依旧无能为力匹配首尾空白字符的正则表达式:^s*
8、s*$评注:可以用来删除行首行尾的空白字符(包括空格、制表符、换页符等等),非常有
9、用的表达式匹配Email地址的正则表达式:w+([-+.]w+)*@w+([-.]w+)*.w+([-.]w+)*评注:表单验证时很实用匹配网址URL的正则表达式:[a-zA-z]+://[^s]*评注:网上流传的版本功能很有限,上面这个基本可以满足需求匹配帐号是否合法(字母开头,允许5-16字节,允许字母数字下划线):^[a-zA-Z][a-zA-Z0-9_]{4,15}$评注:表单验证时很实用匹配国内电话号码:d{3}-d{8}
10、d{4}-d{7}评注:匹配形式如0511-
11、4405222或021-87888822匹配腾讯QQ号:[1-9][0-9]{4,}评注:腾讯QQ号从10000开始匹配中国邮政编码:[1-9]d{5}(?!d)评注:中国邮政编码为6位数字匹配身份证:d{15}
12、d{18}评注:中国的身份证为15位或18位匹配ip地址:d+.d+.d+.d+评注:提取ip地址时有用匹配特定数字:^[1-9]d*$ //匹配正整数^-[1-9]d*$ //匹配负整数^-?[1-9]d*$ //匹配整数^[1-9]d*
13、0$ //匹配非
14、负整数(正整数+0)^-[1-9]d*
15、0$ //匹配非正整数(负整数+0)^[1-9]d*.d*
16、0.d*[1-9]d*$ //匹配正浮点数^-([1-9]d*.d*
17、0.d*[1-9]d*)$ //匹配负浮点数^-?([1-9]d*.d*
18、0.d*[1-9]d*
19、0?.0+
20、0)$ //匹配浮点数^[1-9]d*.d*
21、0.d*[1-9]d*
22、0?.0+
23、0$ //匹配非负浮点数(正浮点数+0)^(-([1-9]d*.d*
24、0.
25、d*[1-9]d*))
26、0?.0+
27、0$ //匹配非正浮点数(负浮点数+0)评注:处理大量数据时有用,具体应用时注意修正匹配特定字符串:^[A-Za-z]+$ //匹配由26个英文字母组成的字符串^[A-Z]+$ //匹配由26个英文字母的大写组成的字符串^[a-z]+$ //匹配由26个英文字母的小写组成的字符串^[A-Za-z0-9]+$ //匹配由数字和26个英文字母组成的字符串^w+$ //匹配由数字、26个英文字母或者下划线组成的字符串评注:最基本也是最常用的一些表达式^.
28、*John.*$匹配包括“John”的整行。其语法请参考EmEditor中的帮助EmEditorHelp-Howto-Search-RegularExpressionSyntaxEmEditor正则表达式专题2技巧中,基于平时我对EditPlus的摸索实践而成,在编译器集成例子中参照了部分官方的文献。有几篇是从网上搜集来的,这里我注明了来源或原始作者。如果你是相应作者,不希望文章放在这里,请通知我,我会及时删掉。-----Liangjh自己写的一些里面,