博客
关于我
Linux基础之正则表达式
阅读量:642 次
发布时间:2019-03-14

本文共 946 字,大约阅读时间需要 3 分钟。

正则表达式,又称规则表达式,全称为Regular Expression(regex、regexp、RE),是计算机科学中用于描述字符串匹配规则的一种工具。它通过预定义的字符组合,帮助识别符合特定模式的文本。

正则表达式的基本概念

正则表达式可以用来匹配字符串中的字符模式,支持普通字符(如a-z)和特殊元字符。例如,.可以匹配任意单个字符,*表示前一个字符零次或多次出现。通过组合这些元字符,可以定义复杂的匹配规则。

使用场景

正则表达式有两大用途:

  • 匹配检验:判断给定字符串是否符合特定模式。
  • 文本提取:从大文本中提取符合规则的特定部分。
  • 常用工具

    grep命令是处理正则表达式的首选工具,支持多种选项来控制匹配行为。例如:

    • -c:显示匹配行的总数。
    • -o:仅显示匹配内容。
    • -v:显示不匹配的行。
    • -E:支持扩展正则表达式。
    • -l:列出包含匹配字符串的文件。

    字符匹配

    正则表达式提供丰富的字符类:

    • .:任意单个字符
    • []:指定范围内的单个字符
    • [^]:非指定范围的单个字符
    • *:前一个字符零次或多次出现
    • [:alnum:]:所有字母和数字
    • [:alpha:]:所有字母
    • [:blank:]:所有空白字符
    • [:cntrl:]:所有控制字符
    • [:digit:]:所有数字
    • [:graph:]:所有可打印字符(不包括空格)
    • [:lower:]:所有小写字母
    • [:print:]:所有可打印字符(包括空格)
    • [:punct:]:所有标点字符
    • [:space:]:所有空白字符
    • [:upper:]:所有大写字母
    • [:xdigit:]:所有十六进制数

    位置锚定

    • ^:行首锚定
    • $:行尾锚定
    • ^...$:整行匹配
    • ^[[:space:]]*$:空行匹配
    • \b:词边锚定

    分组及引用

    • \{xy\}:指定字符的出现次数范围
    • \1:引用前一个捕获组
    • \1..2:指定字符出现1到2次

    使用实例

  • 查看注释开头的行
    grep '#.*' /etc/fstab
  • 显示非注释行
    grep -v '^#.*' /etc/fstab
  • 匹配特定模式
    grep -E '^\d+:\d+\s+\w+\s+\w+\s*\*$' /etc/fstab
  • 通过合理搭配正则表达式和grep选项,可以高效处理各种文本匹配任务。

    转载地址:http://hnjlz.baihongyu.com/

    你可能感兴趣的文章
    NSGA-Ⅲ源代码
    查看>>
    nsis 安装脚本示例(转)
    查看>>
    NSJSON的用法(oc系统自带的解析方法)
    查看>>
    nslookup 的基本知识与命令详解
    查看>>
    NSNumber与NSInteger的区别 -bei
    查看>>
    NSOperation基本操作
    查看>>
    NSRange 范围
    查看>>
    NSSet集合 无序的 不能重复的
    查看>>
    NSURLSession下载和断点续传
    查看>>
    NSUserdefault读书笔记
    查看>>
    NS图绘制工具推荐
    查看>>
    NT AUTHORITY\NETWORK SERVICE 权限问题
    查看>>
    NT symbols are incorrect, please fix symbols
    查看>>
    ntelliJ IDEA 报错:找不到包或者找不到符号
    查看>>
    NTFS文件权限管理实战
    查看>>
    ntko web firefox跨浏览器插件_深度比较:2019年6个最好的跨浏览器测试工具
    查看>>
    ntko文件存取错误_苹果推送 macOS 10.15.4:iCloud 云盘文件夹共享终于来了
    查看>>
    ntp server 用法小结
    查看>>
    ntpdate 通过外网同步时间
    查看>>
    ntpdate同步配置文件调整详解
    查看>>