ES6正则的扩展实例详解


Posted in Javascript onApril 25, 2017

本文实例讲述了ES6正则的扩展。分享给大家供大家参考,具体如下:

1. RegExp构造函数

ES5中,RegExp构造函数的参数:

参数是字符串,这时第二个参数表示正则表达式的修饰符(flag)

参数是一个正则表示式,这时会返回一个原有正则表达式的拷贝。但是,ES5不允许此时使用第二个参数,添加修饰符,否则会报错。

ES6改变了这种行为。如果RegExp构造函数第一个参数是一个正则对象,那么可以使用第二个参数指定修饰符。而且,返回的正则表达式会忽略原有的正则表达式的修饰符,只使用新指定的修饰符。

2. 字符串的正则表达式

字符串对象共有4个方法,可以使用正则表达式:match()、replace()、search()和split()。

ES6将这4个方法,在语言内部全部调用RegExp的实例方法,从而做到所有与正则相关的方法,全都定义在RegExp对象上。

String.prototype.match 调用 RegExp.prototype[Symbol.match]
String.prototype.replace 调用 RegExp.prototype[Symbol.replace]
String.prototype.search 调用 RegExp.prototype[Symbol.search]
String.prototype.split 调用 RegExp.prototype[Symbol.split]

3. u修饰符

ES6对正则表达式添加了u修饰符,含义为“Unicode模式”,用来正确处理大于\uFFFF的Unicode字符。

也就是说,会正确处理四个字节的UTF-16编码。对于码点大于0xFFFF的Unicode字符,点字符不能识别,必须加上u修饰符。

ES6新增了使用大括号表示Unicode字符,这种表示法在正则表达式中必须加上u修饰符,才能识别。

/\u{61}/.test('a') // false
/\u{61}/u.test('a') // true
/\u{20BB7}/u.test('?') // true

①.点字符

点(.)字符在正则表达式中,含义是除了换行符以外的任意单个字符。对于码点大于0xFFFF的Unicode字符,点字符不能识别,必须加上u修饰符。

var s = '';
/^.$/.test(s) // false
/^.$/u.test(s) // true

上面代码表示,如果不添加u修饰符,正则表达式就会认为字符串为两个字符,从而匹配失败。

②. 量词

使用u修饰符后,所有量词都会正确识别码点大于0xFFFF的Unicode字符。

/a{2}/.test('aa') // true
/a{2}/u.test('aa') // true
/ {2}/.test(' ') // false
/ {2}/u.test(' ') // true

另外,只有在使用u修饰符的情况下,Unicode表达式当中的大括号才会被正确解读,否则会被解读为量词。

/^\u{3}$/.test('uuu') // true

上面代码中,由于正则表达式没有u修饰符,所以大括号被解读为量词。加上u修饰符,就会被解读为Unicode表达式。

③. 预定义模式

u修饰符也影响到预定义模式,能否正确识别码点大于0xFFFF的Unicode字符。

\S是预定义模式,匹配所有不是空格的字符。只有加了u修饰符,它才能正确匹配码点大于0xFFFF的Unicode字符。

利用这一点,可以写出一个正确返回字符串长度的函数。

function codePointLength(text) {
 var result = text.match(/[\s\S]/gu);
 return result ? result.length : 0;
}
var s = '??';
s.length // 4
codePointLength(s) // 2

④. i修饰符

有些Unicode字符的编码不同,但是字型很相近,比如,\u004B与\u212A都是大写的K。

/[a-z]/i.test('\u212A') // false
/[a-z]/iu.test('\u212A') // true

上面代码中,不加u修饰符,就无法识别非规范的K字符。

4. y修饰符

除了u修饰符,ES6还为正则表达式添加了y修饰符,叫做“粘连”(sticky)修饰符。

y修饰符的作用与g修饰符类似,也是全局匹配,后一次匹配都从上一次匹配成功的下一个位置开始。

不同之处在于,g修饰符只要剩余位置中存在匹配就可,而y修饰符确保匹配必须从剩余的第一个位置开始,这也就是“粘连”的涵义。

var s = 'aaa_aa_a';
var r1 = /a+/g;
var r2 = /a+/y;
r1.exec(s) // ["aaa"]
r2.exec(s) // ["aaa"]
r1.exec(s) // ["aa"]
r2.exec(s) // null

上面代码有两个正则表达式,一个使用g修饰符,另一个使用y修饰符。这两个正则表达式各执行了两次,第一次执行的时候,两者行为相同,剩余字符串都是_aa_a。由于g修饰没有位置要求,所以第二次执行会返回结果,而y修饰符要求匹配必须从头部开始,所以返回null。

如果改一下正则表达式,保证每次都能头部匹配,y修饰符就会返回结果了。

var s = 'aaa_aa_a';
var r = /a+_/y;
r.exec(s) // ["aaa_"]
r.exec(s) // ["aa_"]

上面代码每次匹配,都是从剩余字符串的头部开始。

使用lastIndex属性,可以更好地说明y修饰符。

const REGEX = /a/g;
// 指定从2号位置(y)开始匹配
REGEX.lastIndex = 2;
// 匹配成功
const match = REGEX.exec('xaya');
// 在3号位置匹配成功
match.index // 3
// 下一次匹配从4号位开始
REGEX.lastIndex // 4
// 4号位开始匹配失败
REGEX.exec('xaxa') // null

上面代码中,lastIndex属性指定每次搜索的开始位置,g修饰符从这个位置开始向后搜索,直到发现匹配为止。

const REGEX = /a/y;
// 指定从2号位置开始匹配
REGEX.lastIndex = 2;
// 不是粘连,匹配失败
REGEX.exec('xaya') // null
// 指定从3号位置开始匹配
REGEX.lastIndex = 3;
// 3号位置是粘连,匹配成功
const match = REGEX.exec('xaxa');
match.index // 3
REGEX.lastIndex // 4

y修饰符同样遵守lastIndex属性,但是要求必须在lastIndex指定的位置发现匹配。

进一步说,y修饰符号隐含了头部匹配的标志^。

/b/y.exec('aba')
// null

单单一个y修饰符对match方法,只能返回第一个匹配,必须与g修饰符联用,才能返回所有匹配。

5. sticky属性

表示是否设置了y修饰符

var r = /hello\d/y;
r.sticky // true

6. flags属性

ES6为正则表达式新增了flags属性,会返回正则表达式的修饰符。(和前面是一个逆向的过程)

7. RegExp.escape()

字符串必须转义,才能作为正则模式。已经有提议将这个需求标准化,作为RegExp对象的静态方法RegExp.escape()

function escapeRegExp(str) {
 return str.replace(/[\-\[\]\/\{\}\(\)\*\+\?\.\\\^\$\|]/g, '\\$&');
}
let str = '/path/to/resource.html?search=query';
escapeRegExp(str)
// "\/path\/to\/resource\.html\?search=query"
Javascript 相关文章推荐
jquery的$getjson调用并获取远程的JSON字符串问题
Dec 10 Javascript
js实例属性和原型属性示例详解
Nov 23 Javascript
js创建对象的方式总结
Jan 10 Javascript
javascript等号运算符使用详解
Apr 16 Javascript
基于MVC5和Bootstrap的jQuery TreeView树形控件(二)之数据支持json字符串、list集合
Aug 11 Javascript
jQuery简单倒计时效果完整示例
Sep 20 Javascript
jquery.uploadView 实现图片预览上传功能
Aug 10 jQuery
Angular使用Md5加密的解决方法
Sep 16 Javascript
vue 2.x 中axios 封装的get 和post方法
Feb 28 Javascript
在create-react-app中使用css modules的示例代码
Jul 31 Javascript
JavaScript+Canvas实现彩色图片转换成黑白图片的方法分析
Jul 31 Javascript
JavaScript中的执行环境和作用域链
Sep 04 Javascript
Javascript中八种遍历方法的执行速度深度对比
Apr 25 #Javascript
详谈js使用in和hasOwnProperty获取对象属性的区别
Apr 25 #Javascript
3分钟掌握常用的JS操作JSON方法总结
Apr 25 #Javascript
vue.js父组件使用外部对象的方法示例
Apr 25 #Javascript
ES6学习笔记之正则表达式和字符串正则方法分析
Apr 25 #Javascript
Javascript中类式继承和原型式继承的实现方法和区别之处
Apr 25 #Javascript
整理一些最近经常遇到的前端面试题
Apr 25 #Javascript
You might like
php UBB 解析实现代码
2011/11/27 PHP
php根据用户语言跳转相应网页
2015/11/04 PHP
Laravel 5.4.36中session没有保存成功问题的解决
2018/02/19 PHP
html数组字符串拼接的最快方法
2009/09/16 Javascript
文档对象模型DOM通俗讲解
2013/11/01 Javascript
流量统计器如何鉴别C#:WebBrowser中伪造referer
2015/01/07 Javascript
jQuery实现下拉框选择图片功能实例
2015/08/08 Javascript
jQuery+css3实现转动的正方形效果(附demo源码下载)
2016/01/27 Javascript
jQuery动态生成表格及右键菜单功能示例
2017/01/13 Javascript
微信JSSDK调用微信扫一扫功能的方法
2017/07/25 Javascript
基于AngularJS实现表单验证功能
2017/07/28 Javascript
nodejs分离html文件里面的js和css的方法
2019/04/09 NodeJs
layui复选框限制选择个数的方法
2019/09/18 Javascript
JavaScript数组类型Array相关的属性与方法详解
2020/09/08 Javascript
[05:56]第十六期——新进3大C之小兔基
2014/06/24 DOTA
详解Python的Django框架中的Cookie相关处理
2015/07/22 Python
Python多层嵌套list的递归处理方法(推荐)
2016/06/08 Python
python多线程socket编程之多客户端接入
2017/09/12 Python
Python3中的json模块使用详解
2018/05/05 Python
Python单元测试unittest的具体使用示例
2018/12/17 Python
Python数据可视化库seaborn的使用总结
2019/01/15 Python
python TF-IDF算法实现文本关键词提取
2019/05/29 Python
windows下python虚拟环境virtualenv安装和使用详解
2019/07/16 Python
Python中正反斜杠(‘/’和‘\’)的意义与用法
2019/08/12 Python
在notepad++中实现直接运行python代码
2019/12/18 Python
python 通过手机号识别出对应的微信性别(实例代码)
2019/12/22 Python
HTML5实现移动端点击翻牌功能
2020/10/23 HTML / CSS
玩具反斗城西班牙网上商城:ToysRUs西班牙
2017/01/19 全球购物
EM Cosmetics官网:由彩妆大神Michelle Phan创办的独立品牌
2020/04/27 全球购物
大专自我鉴定范文
2013/10/01 职场文书
管理站站长岗位职责
2013/11/27 职场文书
二年级语文教学反思
2014/02/02 职场文书
五年后的职业生涯规划
2014/03/04 职场文书
献爱心捐款倡议书
2014/05/14 职场文书
预备党员党支部意见
2015/06/02 职场文书
2016八一建军节慰问信
2015/11/30 职场文书