首页 >> js开发 >> js代码 es6正则的扩展,js正则的扩展

js代码 es6正则的扩展,js正则的扩展

发布时间: 2021年1月14日 | 浏览: | 分类:js开发

ES6 正则的扩展

RegExp构造函数

在ES5中，RegExp构造函数的参数有两种情况。

第一种情况是，参数是字符串，这时第二个参数表示正则表达式的修饰符（flag）。

var regex = new RegExp('xyz', 'i');
// 等价于
var regex = /xyz/i;

第二种情况是，参数是一个正则表示式，这时会返回一个原有正则表达式的拷贝。

var regex = new RegExp(/xyz/i);
// 等价于
var regex = /xyz/i;

但是，ES5不允许此时使用第二个参数，添加修饰符，否则会报错。

var regex = new RegExp(/xyz/, 'i');
// Uncaught TypeError: Cannot supply flags when constructing one RegExp from another

ES6改变了这种行为。如果RegExp构造函数第一个参数是一个正则对象，那么可以使用第二个参数指定修饰符。而且，返回的正则表达式会忽略原有的正则表达式的修饰符，只使用新指定的修饰符。

new RegExp(/abc/ig, 'i').flags
// "i"

上面代码中，原有正则对象的修饰符是ig，它会被第二个参数i覆盖。

字符串的正则方法

字符串对象共有4个方法，可以使用正则表达式：match()、replace()、search()和split()。

ES6将这4个方法，在语言内部全部调用RegExp的实例方法，从而做到所有与正则相关的方法，全都定义在RegExp对象上。

String.prototype.match 调用 RegExp.prototype[Symbol.match]

String.prototype.replace 调用 RegExp.prototype[Symbol.replace]

String.prototype.search 调用 RegExp.prototype[Symbol.search]

String.prototype.split 调用 RegExp.prototype[Symbol.split]

u修饰符

ES6对正则表达式添加了u修饰符，含义为“Unicode模式”，用来正确处理大于\uFFFF的Unicode字符。也就是说，会正确处理四个字节的UTF-16编码。

/^\uD83D/u.test('\uD83D\uDC2A')
// false
/^\uD83D/.test('\uD83D\uDC2A')
// true

上面代码中，\uD83D\uDC2A是一个四个字节的UTF-16编码，代表一个字符。但是，ES5不支持四个字节的UTF-16编码，会将其识别为两个字符，导致第二行代码结果为true。加了u修饰符以后，ES6就会识别其为一个字符，所以第一行代码结果为false。

一旦加上u修饰符号，就会修改下面这些正则表达式的行为。

（1）点字符

点（.）字符在正则表达式中，含义是除了换行符以外的任意单个字符。对于码点大于0xFFFF的Unicode字符，点字符不能识别，必须加上u修饰符。

var s = '𠮷';
/^.$/.test(s) // false
/^.$/u.test(s) // true

上面代码表示，如果不添加u修饰符，正则表达式就会认为字符串为两个字符，从而匹配失败。

（2）Unicode字符表示法

ES6新增了使用大括号表示Unicode字符，这种表示法在正则表达式中必须加上u修饰符，才能识别。

/\u{61}/.test('a') // false
/\u{61}/u.test('a') // true
/\u{20BB7}/u.test('𠮷') // true

上面代码表示，如果不加u修饰符，正则表达式无法识别\u{61}这种表示法，只会认为这匹配61个连续的u。

（3）量词

使用u修饰符后，所有量词都会正确识别码点大于0xFFFF的Unicode字符。

/a{2}/.test('aa') // true
/a{2}/u.test('aa') // true
/𠮷{2}/.test('𠮷𠮷') // false
/𠮷{2}/u.test('𠮷𠮷') // true

另外，只有在使用u修饰符的情况下，Unicode表达式当中的大括号才会被正确解读，否则会被解读为量词。

/^\u{3}$/.test('uuu') // true

上面代码中，由于正则表达式没有u修饰符，所以大括号被解读为量词。加上u修饰符，就会被解读为Unicode表达式。

（4）预定义模式

u修饰符也影响到预定义模式，能否正确识别码点大于0xFFFF的Unicode字符。

/^\S$/.test('𠮷') // false
/^\S$/u.test('𠮷') // true

上面代码的\S是预定义模式，匹配所有不是空格的字符。只有加了u修饰符，它才能正确匹配码点大于0xFFFF的Unicode字符。

利用这一点，可以写出一个正确返回字符串长度的函数。

function codePointLength(text) {

var result = text.match(/[\s\S]/gu);

return result ? result.length : 0;
}
var s = '𠮷𠮷';
s.length // 4
codePointLength(s) // 2

（5）i修饰符

有些Unicode字符的编码不同，但是字型很相近，比如，\u004B与\u212A都是大写的K。

/[a-z]/i.test('\u212A') // false
/[a-z]/iu.test('\u212A') // true

上面代码中，不加u修饰符，就无法识别非规范的K字符。

y 修饰符

除了u修饰符，ES6还为正则表达式添加了y修饰符，叫做“粘连”（sticky）修饰符。

y修饰符的作用与g修饰符类似，也是全局匹配，后一次匹配都从上一次匹配成功的下一个位置开始。不同之处在于，g修饰符只要剩余位置中存在匹配就可，而y修饰符确保匹配必须从剩余的第一个位置开始，这也就是“粘连”的涵义。

var s = 'aaa_aa_a';
var r1 = /a+/g;
var r2 = /a+/y;
r1.exec(s) // ["aaa"]
r2.exec(s) // ["aaa"]
r1.exec(s) // ["aa"]
r2.exec(s) // null

上面代码有两个正则表达式，一个使用g修饰符，另一个使用y修饰符。这两个正则表达式各执行了两次，第一次执行的时候，两者行为相同，剩余字符串都是_aa_a。由于g修饰没有位置要求，所以第二次执行会返回结果，而y修饰符要求匹配必须从头部开始，所以返回null。

如果改一下正则表达式，保证每次都能头部匹配，y修饰符就会返回结果了。

var s = 'aaa_aa_a';
var r = /a+_/y;
r.exec(s) // ["aaa_"]
r.exec(s) // ["aa_"]

上面代码每次匹配，都是从剩余字符串的头部开始。

使用lastIndex属性，可以更好地说明y修饰符。

const REGEX = /a/g;
// 指定从2号位置（y）开始匹配
REGEX.lastIndex = 2;
// 匹配成功
const match = REGEX.exec('xaya');
// 在3号位置匹配成功
match.index // 3
// 下一次匹配从4号位开始
REGEX.lastIndex // 4
// 4号位开始匹配失败
REGEX.exec('xaxa') // null

上面代码中，lastIndex属性指定每次搜索的开始位置，g修饰符从这个位置开始向后搜索，直到发现匹配为止。

y修饰符同样遵守lastIndex属性，但是要求必须在lastIndex指定的位置发现匹配。

const REGEX = /a/y;
// 指定从2号位置开始匹配
REGEX.lastIndex = 2;
// 不是粘连，匹配失败
REGEX.exec('xaya') // null
// 指定从3号位置开始匹配
REGEX.lastIndex = 3;
// 3号位置是粘连，匹配成功
const match = REGEX.exec('xaxa');
match.index // 3
REGEX.lastIndex // 4

进一步说，y修饰符号隐含了头部匹配的标志^。

/b/y.exec('aba')
// null

上面代码由于不能保证头部匹配，所以返回null。y修饰符的设计本意，就是让头部匹配的标志^在全局匹配中都有效。

在split方法中使用y修饰符，原字符串必须以分隔符开头。这也意味着，只要匹配成功，数组的第一个成员肯定是空字符串。

// 没有找到匹配
'x##'.split(/#/y)
// [ 'x##' ]
// 找到两个匹配
'##x'.split(/#/y)
// [ '', '', 'x' ]

后续的分隔符只有紧跟前面的分隔符，才会被识别。

'#x#'.split(/#/y)
// [ '', 'x#' ]
'##'.split(/#/y)
// [ '', '', '' ]

下面是字符串对象的replace方法的例子。

const REGEX = /a/gy;
'aaxa'.replace(REGEX, '-') // '--xa'

上面代码中，最后一个a因为不是出现下一次匹配的头部，所以不会被替换。

单单一个y修饰符对match方法，只能返回第一个匹配，必须与g修饰符联用，才能返回所有匹配。

'a1a2a3'.match(/a\d/y) // ["a1"]
'a1a2a3'.match(/a\d/gy) // ["a1", "a2", "a3"]

y修饰符的一个应用，是从字符串提取token（词元），y修饰符确保了匹配之间不会有漏掉的字符。

const TOKEN_Y = /\s*(\+|[0-9]+)\s*/y;
const TOKEN_G
= /\s*(\+|[0-9]+)\s*/g;
tokenize(TOKEN_Y, '3 + 4')
// [ '3', '+', '4' ]
tokenize(TOKEN_G, '3 + 4')
// [ '3', '+', '4' ]
function tokenize(TOKEN_REGEX, str) {

let result = [];

let match;

while (match = TOKEN_REGEX.exec(str)) {

result.push(match[1]);

}

return result;
}

上面代码中，如果字符串里面没有非法字符，y修饰符与g修饰符的提取结果是一样的。但是，一旦出现非法字符，两者的行为就不一样了。

tokenize(TOKEN_Y, '3x + 4')
// [ '3' ]
tokenize(TOKEN_G, '3x + 4')
// [ '3', '+', '4' ]

上面代码中，g修饰符会忽略非法字符，而y修饰符不会，这样就很容易发现错误。

sticky属性

与y修饰符相匹配，ES6的正则对象多了sticky属性，表示是否设置了y修饰符。

var r = /hello\d/y;
r.sticky // true

flags属性

ES6为正则表达式新增了flags属性，会返回正则表达式的修饰符。

// ES5的source属性
// 返回正则表达式的正文
/abc/ig.source
// "abc"
// ES6的flags属性
// 返回正则表达式的修饰符
/abc/ig.flags
// 'gi'

RegExp.escape()

字符串必须转义，才能作为正则模式。

function escapeRegExp(str) {

return str.replace(/[\-\[\]\/\{\}\(\)\*\+\?\.\\\^\$\|]/g, '\\$&');
}
let str = '/path/to/resource.html?search=query';
escapeRegExp(str)
// "\/path\/to\/resource\.html\?search=query"

上面代码中，str是一个正常字符串，必须使用反斜杠对其中的特殊字符转义，才能用来作为一个正则匹配的模式。

已经有提议将这个需求标准化，作为RegExp对象的静态方法RegExp.escape()，放入ES7。2021年7月31日，TC39认为，这个方法有安全风险，又不愿这个方法变得过于复杂，没有同意将其列入ES7，但这不失为一个真实的需求。

RegExp.escape('The Quick Brown Fox');
// "The Quick Brown Fox"
RegExp.escape('Buy it. use it. break it. fix it.');
// "Buy it\. use it\. break it\. fix it\."
RegExp.escape('(*.*)');
// "\(\*\.\*\)"

字符串转义以后，可以使用RegExp构造函数生成正则模式。

var str = 'hello. how are you?';
var regex = new RegExp(RegExp.escape(str), 'g');
assert.equal(String(regex), '/hello\. how are you\?/g');

目前，该方法可以用上文的escapeRegExp函数或者垫片模块regexp.escape实现。

var escape = require('regexp.escape');

  原文地址：http://www.chinasgp.cn/article/5342.html

  上一条：« js代码 es6前言,js前言
  下一条：js ECMAScript 闭包（closure）js代码 »



  标签:
  
    js正则  js代码  es6  js  
  




  相关文章:
  js es6Set和Map数据结构js代码
js代码 es6数组的扩展,js数组的扩展
js代码 es6读懂规格,js读懂规格
js代码 es6对象的扩展,js对象的扩展
js es6let和const命令js代码
js代码 es6Symbol,jsSymbol
js代码 es6变量的解构赋值,js变量的解构赋值
js代码 es6Module,jsModule
js代码 es6参考链接,js参考链接
js es6异步操作和Async函数js代码


  
    
    
       
         联系我们 (2)
 js开发 (2523)
 chrome插件开发 (34)
 前端开发 (32)
 软件开发外包 (32)
 朋友圈文案句子 (31)
 送老师的礼物 (29)
 前端工具 (20)
 企业名称大全 (16)
 nodejs开发外包 (15)
 网站适老化改造 (14)
 移动app外包 (10)
 网页制作外包 (8)
 网站无障碍服务 (8)
 大额优惠券 (7)
 linux命令 (3)
 rpa数据采集 (3)
 css代码外包 (1)
 清大光德 (1)
 前端开发外包 (11)
      
    
    
    
      热门标签
      
        js (2533)
vue (598)
js代码 (432)
小程序 (229)
微信 (206)
微信小程序 (182)
on (126)
javascript (84)
数组 (81)
ui (59)
      
      
    
  
    
    
      刚刚发布热门点击发布时间
      
        [01/27]您的Chrome插件还停留在远古时代？我们来帮它“重焕新生”！
[01/27]打破信息孤岛：用Chrome插件连接你的所有SaaS服务
[01/27]一个Chrome插件，如何成为你创业的MVP（最小可行产品）？
[01/27]安全无小事！开发企业级Chrome插件必须考虑的5大要素
[01/27]如何用浏览器插件重塑您网站的用户体验？
[01/27]坐在数据金矿上？一个爬虫插件如何帮你轻松挖宝
[01/27]专为您的业务而生：如何用Chrome插件打造“杀手级”内部工具？
[01/27]揭秘专业Chrome插件开发：从Manifest V3到商店发布的全流程
[01/27]Chrome插件的战略价值:将您的SaaS服务“钉”在用户浏览器上
[01/27]告别重复劳动！一个定制Chrome插件，如何让员工效率提升300%？
[01/27]政策导向！您的网站通过“适老化”与“无障碍”改造了吗？
[01/27]创业者的技术合伙人：如何用最小成本验证你的产品idea？
[01/27]上线只是开始！我们为何承诺7 * 24小时前端售后支持？
[01/27]Vue vs React？专业前端团队如何为你做技术选型决策
[01/27]界面到接口：我们如何用“前端+Node.js”全栈方案提升开发效率？
      
      
         携手名企：我们如何助力中百集团完...
揭秘专业Chrome插件开发：从Manif...
上线只是开始！我们为何承诺7 * 2...
招不到、养不起好前端？这是如今精...
您的Chrome插件还停留在远古时代...
创业者的技术合伙人：如何用最小成...
      
      
        2026 January (30)
2025 February (5)
2024 September (1)
2024 July (9)
2024 May (5)
2023 July (5)
2022 December (1)
2022 July (16)
2022 June (2)
2022 January (4)
      
    
    
    友情链接
      
        web网页外包
北京前端
外包项目服务
软件外包
做网页外包
小程序外包
网页设计外包
羽绒服批发
开锁网站
搬家公司
适老化外包
大额优惠券
清大光德护眼





        
          前端技术
          [MORE] 
           vue3 setup 监听url变化
JS获取时间戳的几种方式,js时间转...
前端加密的几种方式总结前端加密...
vue如何优化seo?单页面vue如何se...
前端seo怎么优化？	前端如何进行s...
HTTP Error 503. The service is...
 js捕获键盘事件|js键盘监听事件...
websocket在vue项目的封装和使用...
JSON.stringify()的几种妙用
js数组操作哪些可以改变原数组
        

        
          前端开发外包
          [MORE] 
           专业前端开发-从PSD到响应式网页...
前端静态页面兼职个人接单,前端静...
css动画或者文字上下来回循环上下...
静态html网页制作外包长期合作
css外包  css自适应外包 css优化...
 psd转html模版网页切图外包
网页切图外包|网页切图外包规范都...
前端切图外包-什么是切图？
 前端开发外包工作模式
前端外包服务流程
        

         
          软件开发外包
          [MORE] 
           创业者的技术合伙人：如何用最小成...
上线只是开始！我们为何承诺7 * 2...
Vue vs React？专业前端团队如何为...
界面到接口：我们如何用“前端+Nod...
项目卡壳？紧急救火！我们如何2周内...
放心托付：揭秘专业前端外包的5步...
携手名企：我们如何助力中百集团完...
不止于“切图”：现代高端前端外包必...
算不清的技术账？前端外包如何帮企...
60天焕新！看我们如何帮传统企业实...
        

 





    你有充足的理由选择我们
    
    深圳、上海、杭州、北京前端外包开发:工作10年以上的小伙伴团队，前端开发工作是我们最大的事业。所有您担心的问题，都可以写到合同里。我们会100%努力完成，直到您满意！


    
        
        高端专业开发团队
        10年北京前端外包开发经验，可提供最专业定制ui设计与前端开发
    
     
        
        兼容各种设备
        每次合作都是我们的经典案例，静态网页模板、seo优化PC、Pad和各种手机端用户体验
    
    
        
        我们的承诺
        北京前端外包兼职私活:前端工程师用100%努力去完成您交给我们的需求
    
   
    
        
        靠谱售后服务
        约定服务期内的,7*24小时随时邮件\电话支持
    







首页
前端开发外包
移动app外包
切图外包
小程序外包
ui设计外包
ps网页切图
软件开发外包
热门标签
常见问题
  
  
  
  sitemap 
  Copyright 北京前端外包|北京前端开发外包|北京前端兼职私活 chinasgp.cn 站点支持：35ui.cn
js代码 es6正则的扩展,js正则的扩展-js开发-北京前端外包,北京前端外包、前端兼职

js代码 es6正则的扩展,js正则的扩展-js开发

前端开发

北京前端外包 电话:186-2237-7561 服务客户有中国移动、方正国际、中百集团等

首页 >> js开发 >> js代码 es6正则的扩展,js正则的扩展

js代码 es6正则的扩展,js正则的扩展

ES6 正则的扩展

RegExp构造函数

字符串的正则方法

u修饰符

y 修饰符

sticky属性

flags属性

RegExp.escape()

相关文章:

热门标签

刚刚发布热门点击发布时间

友情链接

前端技术

前端开发外包

软件开发外包

你有充足的理由选择我们

北京前端外包电话:186-2237-7561
服务客户有中国移动、方正国际、中百集团等