博客
关于我
Linux基础之正则表达式
阅读量:642 次
发布时间:2019-03-14

本文共 946 字,大约阅读时间需要 3 分钟。

正则表达式,又称规则表达式,全称为Regular Expression(regex、regexp、RE),是计算机科学中用于描述字符串匹配规则的一种工具。它通过预定义的字符组合,帮助识别符合特定模式的文本。

正则表达式的基本概念

正则表达式可以用来匹配字符串中的字符模式,支持普通字符(如a-z)和特殊元字符。例如,.可以匹配任意单个字符,*表示前一个字符零次或多次出现。通过组合这些元字符,可以定义复杂的匹配规则。

使用场景

正则表达式有两大用途:

  • 匹配检验:判断给定字符串是否符合特定模式。
  • 文本提取:从大文本中提取符合规则的特定部分。
  • 常用工具

    grep命令是处理正则表达式的首选工具,支持多种选项来控制匹配行为。例如:

    • -c:显示匹配行的总数。
    • -o:仅显示匹配内容。
    • -v:显示不匹配的行。
    • -E:支持扩展正则表达式。
    • -l:列出包含匹配字符串的文件。

    字符匹配

    正则表达式提供丰富的字符类:

    • .:任意单个字符
    • []:指定范围内的单个字符
    • [^]:非指定范围的单个字符
    • *:前一个字符零次或多次出现
    • [:alnum:]:所有字母和数字
    • [:alpha:]:所有字母
    • [:blank:]:所有空白字符
    • [:cntrl:]:所有控制字符
    • [:digit:]:所有数字
    • [:graph:]:所有可打印字符(不包括空格)
    • [:lower:]:所有小写字母
    • [:print:]:所有可打印字符(包括空格)
    • [:punct:]:所有标点字符
    • [:space:]:所有空白字符
    • [:upper:]:所有大写字母
    • [:xdigit:]:所有十六进制数

    位置锚定

    • ^:行首锚定
    • $:行尾锚定
    • ^...$:整行匹配
    • ^[[:space:]]*$:空行匹配
    • \b:词边锚定

    分组及引用

    • \{xy\}:指定字符的出现次数范围
    • \1:引用前一个捕获组
    • \1..2:指定字符出现1到2次

    使用实例

  • 查看注释开头的行:
    grep '#.*' /etc/fstab
  • 显示非注释行:
    grep -v '^#.*' /etc/fstab
  • 匹配特定模式:
    grep -E '^\d+:\d+\s+\w+\s+\w+\s*\*$' /etc/fstab
  • 通过合理搭配正则表达式和grep选项,可以高效处理各种文本匹配任务。

    转载地址:http://hnjlz.baihongyu.com/

    你可能感兴趣的文章
    python基础篇(12):继承
    查看>>
    python基础篇(11):封装
    查看>>
    python基础篇(10):自定义包
    查看>>
    python基础篇(10):类、对象与构造方法
    查看>>
    python系列【仅供参考】:python测试javaSDK总结
    查看>>
    python系列【仅供参考】:python斗地主
    查看>>
    Python基础教程(第2版 修订版) pdf
    查看>>
    python基础实践(四)
    查看>>
    Python基础学习笔记(九)常用数据类型转换函数
    查看>>
    Python基础学习参考(五):字符串和编码
    查看>>
    Python基础学习
    查看>>
    python基础变量之---集合
    查看>>
    python基础变量之---字典
    查看>>
    python基础变量之---列表
    查看>>
    python基础变量之---元组
    查看>>
    python基础内容_Python基础入门必须了解的
    查看>>
    Python基础之面向对象2(封装)
    查看>>
    Python基础之给函数增加元信息
    查看>>
    python基础之字符编码
    查看>>
    python基础之多线程与多进程(二)
    查看>>