我们知道,正则表达式中,可以用 . 表示任意单个字符,但在underscore和jquery的源代码中,我们可以看到,这些著名类库的代码中,经常并不是用 . 来表示任意字符,而是使用 [\w\W] 或者[\s\S] 。乍一看,好像表达的含义是一样的,可是为什么放着简单的方法不用,而去多绕个圈子?今天就简单说说这个问题。
首先我们必须要正确理解 . 的含义。其实说它表示任意单个字符,可能会让人产生误解,必须要强调一下,这个“任意单个字符”不包括控制换行的字符,也就是不包含 \n \r \u2028 或\u2029 这几个字符。而 \W 和 \s 中是能够包含这些字符的。那个这两种写法的差异也就很清晰了,就是能否匹配到几个换行控制符的差异。
那么在什么时候我们需要考虑这几个换行控制符呢?当要处理的字符串可能包含换行时。这样的情景太多了,处理html字符串、处理template、nodejs读取文本等等。
提及多行文本的场景,我们很容易想到正则表达式的 m 模式(多行模式)。那么多行模式对我们今天讨论的问题有影响吗?我不是很确定。为什么不确定呢?有些人信誓旦旦地声称单行模式下 . 的含义与多行模式下不同,单选模式下等同于 [\w\W] 或者 [\s\S] ,而多行模式下会排除换行控制符。但据我试验,以及参考MDN的说法,这是不对的。的确有很多语言的正则表达式会有上述特性,但在javascript中我没有看到,不知道会不会有浏览器方面的差异。那么多行模式对于javascript而言影响的是什么呢?我认为仅仅是改变了 ^ 和 $ 标识的含义:单行模式下,分别表示整个字符串的开始的结尾;多行模式下表示每一行的开始和结尾。而不管多行模式还是单行模式,我认为 . 都是不包含换行控制字符的,等价于 [^\n\r\u2028\u2029] 。
再多延伸一点点,对于现代浏览器,可以直接用 [^] 来匹配任意字符的。
例子程序不想写了,有兴趣的可以自己试验一下,分别用 /.*/g 、 /^.*$/g 、 /.*/gm 、/^.*$/gm 来匹配一下 "abc\nedf" ,其中道理不言自明。
正则,句号
免责声明:本站文章均来自网站采集或用户投稿,网站不提供任何软件下载或自行开发的软件! 如有用户或公司发现本站内容信息存在侵权行为,请邮件告知! 858582#qq.com
更新日志
- 陈洁丽《监听王NO.1 》示范级发烧天碟[WAV+分轨][1.1G]
- 单色凌.2014-小岁月太着急【海蝶】【WAV+CUE】
- 陈淑桦.1988-抱紧我HOLD.ME.NOW【EMI百代】【WAV+CUE】
- 黄妃.2020-色違【米乐士娱乐】【FLAC分轨】
- LouisHayes-ArtformRevisited(2024)[24Bit-96kHz]FLAC
- 永恒英文金曲精选5《TheBestOfEverlastingFavouritesVol.5》[WAV+CUE]
- 黑鸭子2005-紫丁香[首版][WAV+CUE]
- 林忆莲《爱上一个不回家的人》XRCD版[低速原抓WAV+CUE][999M]
- 经典《历届奥斯卡金曲回顾》[正版原抓WAV+CUE] [1G]
- 群星《试音草原·女声篇》经典蒙古民歌[WAV+CUE][1G]
- 炉石传说月末上分卡组推荐 国服月末最快上分卡组推荐
- 炉石传说月底最强卡组有哪些 2024国服月底最强卡组推荐
- 炉石传说月初最强卡组有哪些 2024月初最强上分卡组推荐
- 狼人杀亮相原生鸿蒙之夜 假面科技强势登陆华为生态
- 12小时光线挑战!AI画质专家才是大平层首选