发布于2026-07-23 阅读(0)
扫一扫,手机访问
先看一个基本规则:一个不包含特殊字符的正则表达式,匹配的就是它本身。也就是说,你写什么,它就找什么。
举个例子,如果想查看密码中包含root字符串的行,可以这样写:
cat /etc/passwd | grep root

| 特殊字符 | 作用 |
| ^ | 匹配一行的开头 |
| $ | 匹配一行的结束 |
. | 匹配任意一个字符 |
| * | *不单独使用,他和上一个字符连用,表示匹配上一个字符0次或者多次 |
| [] | []表示匹配某个范围内的一个字符 |
| \ | 表示转义字符,一般和特殊字符连用表示特殊字符本身 |
下面看几个实际例子,感受一下这些特殊字符怎么用。
例1:匹配以a字符开头的行:
cat /etc/passwd | grep ^a

例2:匹配以e字符结尾的行:
cat /etc/passwd | grep e$

例3:匹配任意一个字符(. 匹配任意一个字符,如 r.t 匹配 r后面跟任意字符再跟t):
cat /etc/passwd | grep r.t
cat /etc/passwd | grep r..t

例4:查询包含以字符r开头,t结尾的字符串(中间任意字符任意次数):
cat /etc/passwd | grep r.*t

字符集 [] 的用法也很常用:
具体用法,看下图就清楚了:

例6:假如想查找n_test.sh文件中包含$符的行,因为$是特殊字符,所以需要转义:
cat /scripts/n_test.sh | grep '\$'

手机号有固定规则:第一位是1,第二位是3、4、5、7、8、9,其余数字任意,总共11位。所以可以写出这样的正则:
"1569656955" | grep ^1[3,4,5,7,8,9][0-9][0-9][0-9][0-9][0-9][0-9][0-9][0-9]$

从图中可以看到,第一个数字符合手机号,第二个明显不符合。但这样写[0-9]重复了9次,太繁琐。可以用大括号{}表示重复次数,不过需要加上-E选项启用扩展正则:
grep -E ^1[3,4,5,7,8,9][0-9]{9}$

大于或小于11位都是不符合的。
实际生产环境中,重要数据的归档备份是家常便饭。这里实现一个目录归档脚本:输入一个目录名称,将目录下所有文件按天归档,归档日期附加在文件名上,放在根目录下的/archive目录。
归档命令用tar,加上-c表示归档,-z表示压缩,得到.tar.gz文件。注意可能需要加上-P选项,允许使用绝对路径归档。
#!/bin/bash
# 首先判断输入的参数个数是否为1
if [ $# -ne 1 ]
then
echo "参数个数错误!应该输入一个参数作为归档目录名"
exit
fi
# 从参数中获取目录名称,查看目录名称是否存在
if [ -d $1 ]
then
echo
else
echo
echo "目录不存在!"
echo
exit
fi
# 获取绝对路径
DIR_NAME=$(basename $1)
DIR_PATH=$(cd $(dirname $1);pwd)
# 获取当前日期,归档文件名拼接成日期
DATE=$(date +%y%m%d)
# 订阅生成归档文件名称
FILE=archive_${DIR_NAME}_$DATE.tar.gz
# 订阅生成归档文件的路径
DEST=/archive/$FILE
# 开始归档目录文件
echo "开始归档...."
echo
# -c 归档 z 压缩 f可视化
tar -czPf $DEST $DIR_PATH/$DIR_NAME
# 判断上面文件归档文件操作是否成功
if [ $? -eq 0 ]
then
echo
echo "归档成功"
echo "归档的文件为:$DEST"
echo
else
echo "归档出现问题"
echo
fi
exit

如果需要定时执行归档,比如每分钟归档一次,可以设置crontab:
*/1 * * * * /archive/archive_test.sh /scripts

可以看到确实添加了一个归档文件。
cut顾名思义就是“剪切”,负责从文件中按列剪切数据。它可以按字节、字符或字段来切,输出指定部分。
基本用法:
cut [选项参数] filename
选项参数:
比如有一个文本文件包含以下诗歌:

提取第一列,按空格分隔:
cut -d " " -f 1 cut_test.txt

提取第一和第四列:
cut -d " " -f 1,4 cut_test.txt

想知道ens33网卡的所有IP?先ifconfig ens33,然后管道传给grep,用正则提取ip,最后用cut切割:

因为ip在第10列,所以-f后面跟10:
ifconfig ens33 | grep netmask | cut -d " " -f 10
awk是一个强大的文本分析工具,它把文件逐行读入,默认以空格为分隔符将每行切片,然后对切片进行分析处理。
基本用法:
awk [选项参数] '/pattern1/{action1}/pattern2/{action2}...' filename
pattern:匹配模式,awk在数据中查找的内容;action:找到匹配内容时执行的命令。
选项参数:
有些系统可能不支持awk,可以用which awk检查:
which awk

出现上面的路径说明系统支持awk。
cat /etc/passwd | awk -F ":" '/^root/ {print $7}'

cat /etc/passwd | awk -F ":" '/^root/ {print $1 "," $7}'

cat /etc/passwd | awk -F ":" '/^root/ {print $1"," $7} END{print "over"}'

cat /etc/passwd | awk -F ":" '{print $3+1}'

awk内置了一些常用变量:
下面看几个示例操作。
cat /etc/passwd | awk -F ":" '{print " 文件名:" FILENAME "\t行号:" NR "\t列数: " NF}' /etc/passwd

ifconfig | awk '/^$/ {print "空行: " NR}'

下一篇:字符串过滤正则表达式的方法
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
正版软件
正版软件
正版软件
正版软件
正版软件
1
2
3
7
8