正则表达式与文本三剑客之grep

格式：grep [选项]… 查找条件 目标文件

-E ：开启扩展（Extend）的正则表达式
-c ：计算找到 '搜寻字符串' 的次数
-i ：忽略大小写的不同，所以大小写视为相同
-o ：只显示被模式匹配到的字符串
-v ：反向选择，亦即显示出没有 '搜寻字符串' 内容的那一行！（反向查找，输出与查找条件不相符的行）
--color=auto ：可以将找到的关键词部分加上颜色的显示喔！
-n ：顺便输出行号

二、基础正则表达式常见元字符

2.1、特殊字符

\	转义符，将特殊字符进行转义，忽略其特殊意义
^	匹配行首，^则是匹配字符串的开始^tux匹配以tux开头的行
$	匹配行尾，$则是匹配字符串的结尾tux$匹配以tux结尾的行
.	匹配除换行符\r\n之外的任意单个字符
[list]	匹配list列表中的一个字符
[^list]	匹配任意不在list列表中的一个字符
*	匹配前面子表达式0次或者多次
\{n\}	匹配前面的子表达式n次
\{n,\}	匹配前面的子表达式不少于n次
\{n,m\}	匹配前面的子表达式n到m次

注: egrep、awk使用{n}、{n, }、{n, m}匹配时“{}"前不用加"\”
egrep -E -n 'wo{2}d' test.txt //-E 用于显示文件中符合条件的字符

2.2、定位符

^ 匹配输入字符串开始的位置
$ 匹配输入字符串结尾的位置

2.3、非打印字符

\n 匹配一个换行符
\r 匹配一个回车符
\t 匹配一个制表符

三、元字符操作实例

准备一个文件

3.1、查找特定字符

grep -n 'the' 1.txt

grep -in 'the' 1.txt

grep -vn 'the' 1.txt

3.2、利用中括号“[]”来查找集合字符

1、执行以下命令即可同时查找到“shirt”与“short”这两个字符串，其中“[]”中无论有几个字符，都仅代表一个字符，也就是说“[io]”表示匹配“i”或者“o”。

2、查找包含重复单个字符“oo”

3、查找“oo”前面不是“w”的字符串

4、不希望“oo”前面存在小写字母

“a-z”表示小写字母，大写字母则通过“A-Z”表示。

5、查找包含数字的行

3.3、查找行首“^”与行尾字符“$”

1、查询以“the”字符串为行首的行

2、查询以小写字母开头的行/查询大写字母开头的行/查询不以字母开头的行

3、查询空白行

3.4、查找任意一个字符“.”与重复字符“*”

正则表达式中小数点（.）也是一个元字符，代表任意一个字符。

“*”代表的是重复零个或多个前面的单字符

1、查找“w??d”的字符串，即共有四个字符，以 w 开头 d 结尾。

2、查询 oo、ooo、ooooo 等资料，则需要使用星号（*）元字符。

3、查询以 w 开头 d 结尾，中间包含至少一个 o 的字符串

4、查询以 w 开头 d 结尾，中间的字符可有可无的字符串。

5、查询任意数字所在行

3.5、查找连续字符范围“{}”

1、查询两个 o 的字符

2、查询以 w 开头以 d 结尾，中间包含 2～5 个 o 的字符串

3、查询以 w 开头以 d 结尾，中间包含 2 个或 2 个以上 o 的字符串

四、扩展正则表达式

为了简化整个指令，需要使用范围更广的扩展正则表达式

grep 命令仅支持基础正则表达式，如果使用扩展正则表达式，需要使用 egrep 或 awk 命令

egrep 命令与 grep 命令的用法基本相似。egrep 命令是一个搜索文件获得模式，使用该命令可以搜索文件中的任意字符串和符号，也可以搜索一个或多个文件的字符串，一个提示符可以是单个字符、一个字符串、一个字或一个句子。

4.1、+

作用：重复一个或者一个以上的前一个字符

示例：执行“egrep -n 'wo+d' test.txt”命令，即可查询"wood" "woood" "woooooood"等字符串

4.2、？

作用：零个或者一个的前一个字符

示例：执行“egrep -n 'bes?t' test.txt”命令，即可查询“bet”“best”这两个字符串

4.3、|

作用：使用或者（or）的方式找出多个字符

示例：执行“egrep -n 'of|is|on' test.txt”命令即可查询"of"或者"if"或者"on"字符串

4.4、()

作用：查找“组”字符串

示例：“egrep -n 't(a|e)st' test.txt”，查询"tast"或者"test"字符串

4.5、()+

作用：辨别多个重复的组

示例：查询开头的"A"结尾是"C"，中间有一个以上的"xyz"字符串

原文地址：https://blog.csdn.net/pangdongqiqi/article/details/140635863

免责声明：本站文章内容转载自网络资源，如本站内容侵犯了原著者的合法权益，可联系本站删除。更多内容请关注自学内容网（zxcms.com）！

上一篇：Leetcode 66. 加一
下一篇：C#与C++交互开发系列（三）：深入探讨P/Invoke基础知识

C# yolo10使用onnx推理
本篇总结C#端使用yolo10的onnx文件做模型推理，主要使用Microsoft.ML.OnnxRuntime.Gpu这个库。需要注意的是Microsoft.ML.OnnxRuntime 和 Mic
阅读更多2024-11-18
【软件测试】界面、功能、性能、可靠性、安全性（SQL注入、越权）、易用性测试，静态和动态测试
功能测试是为了确保程序以期望的⽅式运⾏⽽按功能要求对软件进⾏的测试，通过对⼀个系统的所有的特性和功能都进⾏测试确保符合需求和规范。软件测试是软件⽣命周期中的⼀个重要环节，具有较⾼的复杂性，对于软件测试
阅读更多2024-11-18
nfs服务器
NFS，网络文件系统）是FreeBSD支持的文件系统中的一种，它允许网络中的计算机（不同的计算机、不同的操作系统）之间通过TCP/IP网络共享资源，主要在unix系列操作系统上使用。在NFS的应用中，
阅读更多2024-11-18
金山云大数据面试题及参考答案
栈（Stack）栈是一种数据结构，它遵循后进先出（LIFO - Last In First Out）的原则。可以把栈想象成一个一端封闭的圆筒，元素只能从开口的一端进出。在计算机内存中，栈主要用于存储函
阅读更多2024-11-18
c++自制游戏（优化）
cout << "******************0、退出************************" << endl;cout <<
阅读更多2024-11-18
C++ -class
类的简介
阅读更多2024-11-18
Cobalt Strike 4.8 用户指南-第九节 Pivoting（跳板）
Pivoting，在本手册中，指的是"将一个受害机器转为其他攻击和工具的跳板"。的Beacon提供了多种pivoting选项。前提是Beacon处于交互模式。交互模式意味着一个Be
阅读更多2024-11-18
达梦 DG
以上步骤和命令提供了达梦DGswitchover的详细操作流程，确保在执行切换操作前，所有的检查和准备工作都已就绪，以保证切换过程的顺利进行。• 检查备库监听配置文件，如tnsnames.ora，并提
阅读更多2024-11-18
Mybatis查询ORACLE数据库相近字段名称的值在映射出来的对象中被覆盖
oracle数据库中有一个表，一个字段的名叫做HEA_MUR，一个字段的名叫HEAMUR，两个字段都是字符串类型。
阅读更多2024-11-18
用Redis实现分布式锁
它的核心思想是通过多个独立的 Redis 实例来增加容错性，确保即使某些实例发生故障或数据不同步，仍然能够提供高可用的分布式锁服务。通常情况下，锁是“非重入”的，也就是说，锁只能被持有它的客户端释放，
阅读更多2024-11-18