博客
关于我
Linux基础之正则表达式
阅读量:642 次
发布时间:2019-03-14

本文共 946 字,大约阅读时间需要 3 分钟。

正则表达式,又称规则表达式,全称为Regular Expression(regex、regexp、RE),是计算机科学中用于描述字符串匹配规则的一种工具。它通过预定义的字符组合,帮助识别符合特定模式的文本。

正则表达式的基本概念

正则表达式可以用来匹配字符串中的字符模式,支持普通字符(如a-z)和特殊元字符。例如,.可以匹配任意单个字符,*表示前一个字符零次或多次出现。通过组合这些元字符,可以定义复杂的匹配规则。

使用场景

正则表达式有两大用途:

  • 匹配检验:判断给定字符串是否符合特定模式。
  • 文本提取:从大文本中提取符合规则的特定部分。
  • 常用工具

    grep命令是处理正则表达式的首选工具,支持多种选项来控制匹配行为。例如:

    • -c:显示匹配行的总数。
    • -o:仅显示匹配内容。
    • -v:显示不匹配的行。
    • -E:支持扩展正则表达式。
    • -l:列出包含匹配字符串的文件。

    字符匹配

    正则表达式提供丰富的字符类:

    • .:任意单个字符
    • []:指定范围内的单个字符
    • [^]:非指定范围的单个字符
    • *:前一个字符零次或多次出现
    • [:alnum:]:所有字母和数字
    • [:alpha:]:所有字母
    • [:blank:]:所有空白字符
    • [:cntrl:]:所有控制字符
    • [:digit:]:所有数字
    • [:graph:]:所有可打印字符(不包括空格)
    • [:lower:]:所有小写字母
    • [:print:]:所有可打印字符(包括空格)
    • [:punct:]:所有标点字符
    • [:space:]:所有空白字符
    • [:upper:]:所有大写字母
    • [:xdigit:]:所有十六进制数

    位置锚定

    • ^:行首锚定
    • $:行尾锚定
    • ^...$:整行匹配
    • ^[[:space:]]*$:空行匹配
    • \b:词边锚定

    分组及引用

    • \{xy\}:指定字符的出现次数范围
    • \1:引用前一个捕获组
    • \1..2:指定字符出现1到2次

    使用实例

  • 查看注释开头的行
    grep '#.*' /etc/fstab
  • 显示非注释行
    grep -v '^#.*' /etc/fstab
  • 匹配特定模式
    grep -E '^\d+:\d+\s+\w+\s+\w+\s*\*$' /etc/fstab
  • 通过合理搭配正则表达式和grep选项,可以高效处理各种文本匹配任务。

    转载地址:http://hnjlz.baihongyu.com/

    你可能感兴趣的文章
    Nodejs教程09:实现一个带接口请求的简单服务器
    查看>>
    nodejs服务端实现post请求
    查看>>
    nodejs框架,原理,组件,核心,跟npm和vue的关系
    查看>>
    Nodejs概览: 思维导图、核心技术、应用场景
    查看>>
    nodejs模块——fs模块
    查看>>
    Nodejs模块、自定义模块、CommonJs的概念和使用
    查看>>
    nodejs生成多层目录和生成文件的通用方法
    查看>>
    nodejs端口被占用原因及解决方案
    查看>>
    Nodejs简介以及Windows上安装Nodejs
    查看>>
    nodejs系列之express
    查看>>
    nodejs系列之Koa2
    查看>>
    Nodejs连接mysql
    查看>>
    nodejs连接mysql
    查看>>
    NodeJs连接Oracle数据库
    查看>>
    nodejs配置express服务器,运行自动打开浏览器
    查看>>
    NodeMCU教程 http请求获取Json中文乱码解决方案
    查看>>
    Nodemon 深入解析与使用
    查看>>
    NodeSession:高效且灵活的Node.js会话管理工具
    查看>>
    node~ http缓存
    查看>>
    node不是内部命令时配置node环境变量
    查看>>