关于Linux Grep命令使用的详细介绍

skanion

浏览: 175583 次
性别:
来自: 深圳

最近访客更多访客>>

smh0310

DDaiDi

linkoog

wfl243068

博主相关

博客

微博

相册

留言

关于我

文章分类

社区版块

存档分类

博客分类：

reprint
linux

grep linux

1. grep简介

grep （global search regular expression(RE) and print out the line ,全面搜索正则表达式并把行打印出来）是一种强大的文本搜索工具，它能使用正则表达式搜索文本，并把匹配的行打印出来。Unix的grep家族包括grep、egrep和fgrep。egrep和fgrep的命令只跟grep有很小不同。egrep是grep的扩展，支持更多的re元字符， fgrep就是fixed grep或fast grep，它们把所有的字母都看作单词，也就是说，正则表达式中的元字符表示回其自身的字面意义，不再特殊。linux使用GNU版本的grep。它功能更强，可以通过-G、-E、-F命令行选项来使用egrep和fgrep的功能。

grep的工作方式是这样的，它在一个或多个文件中搜索字符串模板。如果模板包括空格，则必须被引用，模板后的所有字符串被看作文件名。搜索的结果被送到屏幕，不影响原文件内容。

grep可用于shell脚本，因为grep通过返回一个状态值来说明搜索的状态，如果模板搜索成功，则返回0，如果搜索不成功，则返回1，如果搜索的文件不存在，则返回2。我们利用这些返回值就可进行一些自动化的文本处理工作。

2. grep正则表达式元字符集（基本集）

^

锚定行的开始如：'^ grep'匹配所有以grep开头的行。

$

锚定行的结束如：'grep$ '匹配所有以grep结尾的行。

匹配一个非换行符的字符如：'gr.p'匹配gr后接一个任意字符，然后是p。

*

匹配零个或多个先前字符如：'*grep'匹配所有一个或多个空格后紧跟grep的行。 .*一起用代表任意字符。

[]

匹配一个指定范围内的字符，如'[Gg]rep'匹配Grep和grep。

[^]

匹配一个不在指定范围内的字符，如：'[^A-FH-Z]rep'匹配不包含 A-R和T-Z的一个字母开头，紧跟rep的行。

/(../)

标记匹配字符，如'/(love/)'，love被标记为1。

/<

锚定单词的开始，如:'/

/>

锚定单词的结束，如'grep/>'匹配包含以grep结尾的单词的行。

x/{m/}

重复字符x，m次，如：'0/{5/}'匹配包含5个o的行。

x/{m,/}

重复字符x,至少m次，如：'o/{5,/}'匹配至少有5个o的行。

x/{m,n/}

重复字符x，至少m次，不多于n次，如：'o/{5,10/}'匹配5--10个o的行。

/w

匹配文字和数字字符，也就是[A-Za-z0-9]，如：'G/w*p'匹配以G后跟零个或多个文字或数字字符，然后是p。

/W

/w的反置形式，匹配一个或多个非单词字符，如点号句号等。

/b

单词锁定符，如: '/bgrepb/'只匹配grep。

3. 用于egrep和 grep -E的元字符扩展集

+

匹配一个或多个先前的字符。如：'[a-z]+able'，匹配一个或多个小写字母后跟able的串，如loveable,enable,disable等。

?

匹配零个或多个先前的字符。如：'gr?p'匹配gr后跟一个或没有字符，然后是p的行。

a|b|c

匹配a或b或c。如：grep|sed匹配grep或sed

()

分组符号，如：love(able|rs)ov+匹配loveable或lovers，匹配一个或多个ov。

x{m},x{m,},x{m,n}

作用同x/{m/},x/{m,/},x/{m,n/}

4. POSIX字符类

为了在不同国家的字符编码中保持一至，POSIX(The Portable Operating System Interface)增加了特殊的字符类，如[:alnum:]是A-Za-z0-9的另一个写法。要把它们放到[]号内才能成为正则表达式，如[A- Za-z0-9]或[[:alnum:]]。在linux下的grep除fgrep外，都支持POSIX的字符类。

[:alnum:]

文字数字字符

[:alpha:]

文字字符

[:digit:]

数字字符

[:graph:]

非空字符（非空格、控制字符）

[:lower:]

小写字符

[:cntrl:]

控制字符

[:print:]

非空字符（包括空格）

[:punct:]

标点符号

[:space:]

所有空白字符（新行，空格，制表符）

[:upper:]

大写字符

[:xdigit:]

十六进制数字（0-9，a-f，A-F）

5. Grep命令选项

-?

同时显示匹配行上下的？行，如：grep -2 pattern filename同时显示匹配行的上下2行。

-b，--byte-offset

打印匹配行前面打印该行所在的块号码。

-c,--count

只打印匹配的行数，不显示匹配的内容。

-f File，--file=File

从文件中提取模板。空文件中包含0个模板，所以什么都不匹配。

-h，--no-filename

当搜索多个文件时，不显示匹配文件名前缀。

-i，--ignore-case

忽略大小写差别。

-q，--quiet

取消显示，只返回退出状态。0则表示找到了匹配的行。

-l，--files-with-matches

打印匹配模板的文件清单。

-L，--files-without-match

打印不匹配模板的文件清单。

-n，--line-number

在匹配的行前面打印行号。

-s，--silent

不显示关于不存在或者无法读取文件的错误信息。

-v，--revert-match

反检索，只显示不匹配的行。

-w，--word-regexp

如果被/<和/>引用，就把表达式做为一个单词搜索。

-V，--version

显示软件版本信息。

6. 实例

要用好grep这个工具，其实就是要写好正则表达式，所以这里不对grep的所有功能进行实例讲解，只列几个例子，讲解一个正则表达式的写法。

$ ls -l | grep '^a'

通过管道过滤ls -l输出的内容，只显示以a开头的行。

$ grep 'test' d*

显示所有以d开头的文件中包含test的行。

$ grep 'test' aa bb cc

显示在aa，bb，cc文件中匹配test的行。

$ grep '[a-z]/{5/}' aa

显示所有包含每个字符串至少有5个连续小写字符的字符串的行。

$ grep 'w/(es/)t.*/1' aa

如果west被匹配，则es就被存储到内存中，并标记为1，然后搜索任意个字符（.*），这些字符后面紧跟着另外一个es（/1），找到就显示该行。如果用egrep或grep -E，就不用"/"号进行转义，直接写成'w(es)t.*/1'就可以了。(T002)

4.2.1. 什么是grep？
grep 以行为单位搜索那些包含给出模板列表的输入文件。当在一行中找到匹配，默认把该行拷贝到标准输出（默认），或者其他你以选项要求的任何种类的输出。 searches the input files for lines containing a match to a given pattern list. When it finds a match in a line, it copies the line to standard output (by default), or whatever other sort of output you have requested with options.

尽管 grep 希望在基于文本进行匹配，除了现有的内存它对于输入行的长度没有限制，而且它可以匹配某行的任意字符。如果输入文件的最后一个字节不是一个换行，grep 就悄悄增加一个。既然换行也是一个模板列表的分隔符，那么就没有办法在一个文本中匹配一个换行字符。

一些例子：

cathy ~> grep root /etc/passwd
root:x:0:0:root:/root:/bin/bash
operator:x:11:0:operator:/root:/sbin/nologin

cathy ~> grep -n root /etc/passwd
1:root:x:0:0:root:/root:/bin/bash
12:operator:x:11:0:operator:/root:/sbin/nologin

cathy ~> grep -v bash /etc/passwd | grep -v nologin
sync:x:5:0:sync:/sbin:/bin/sync
shutdown:x:6:0:shutdown:/sbin:/sbin/shutdown
halt:x:7:0:halt:/sbin:/sbin/halt
news:x:9:13:news:/var/spool/news:
mailnull:x:47:47::/var/spool/mqueue:/dev/null
xfs:x:43:43:X Font Server:/etc/X11/fs:/bin/false
rpc:x:32:32:Portmapper RPC user:/:/bin/false
nscd:x:28:28:NSCD Daemon:/:/bin/false
named:x:25:25:Named:/var/named:/bin/false
squid:x:23:23::/var/spool/squid:/dev/null
ldap:x:55:55:LDAP User:/var/lib/ldap:/bin/false
apache:x:48:48:Apache:/var/www:/bin/false

cathy ~> grep -c false /etc/passwd
7

cathy ~> grep -i ps ~/.bash* | grep -v history
/home/cathy/.bashrc:PS1="/[/033[1;44m/]$USER is in /w/[/033[0m/] "

第一个例子，用户 cathy 把 /etc/passwd 里面包含 root 字符串的行显示出来。

然后她显示了包含着个搜索字符串的行的号码。

用第三个命令她检查了哪个用户没有使用 bash ，但是使用 nologin shell的账号不会显示。

然后她统计了把 /bin/false 作为shell的账户的数量。

最后的命令显示了在她的home目录中所有包含以 ~/.bash 开头的行的文件，excluding matches containing history, so as to exclude matches from ~/.bash_history which might contain the same string, in upper or lower cases.

现在让我们来看看用正则表达式，grep还能做些什么。

4.2.2. Grep与正则表达式
如果你不是在使用Linux
我们在这些例子中使用支持扩展正则表达式的GNU grep 。GNU grep 在Linux系统里是默认的。如果你在专有的系统上工作，那么请使用 -V 选项来检查你在使用哪个版本的grep。GNU grep 也可以从 http://gnu.org/directory/ 下载。

4.2.2.1. 锚定行和字
从先前的例子中，我们只想显示那些使用字符串 “root ” 开头的行：

cathy ~> grep ^root /etc/passwd
root:x:0:0:root:/root:/bin/bash
如果我们想看哪个账号什么shell都没有分配，我们搜索行结束符 “: ”：

cathy ~> grep :$ /etc/passwd
news:x:9:13:news:/var/spool/news:
要检查 PATH 是否在 ~/.bashrc 中导出，首先选择 “export ” 然后搜索以字符串 PATH 开始的行，这样就不会搜索到MANPATH或者其他可能的路径了：

cathy ~> grep export ~/.bashrc | grep '/<PATH'
export PATH="/bin:/usr/lib/mh:/lib:/usr/bin:/usr/local/bin:/usr/ucb:/usr/dbin:$PATH"
同样地，/> 匹配字的结束。

如果你想找到是一个分隔的字的字符串（用空格来包围的），最好使用 -w ，就像在这个例子中我们现实root分区的信息那样：

cathy ~> grep -w / /etc/fstab
LABEL=/ / ext3 defaults 1 1
如果不使用这个选项，系统表中的所有行都会被显示。

4.2.2.2. 字符族Character classes
方括号表达式是一个用 “[ ” and “] ” 包含起来的字符列表。它匹配任何在列表中的单个字符；如果列表的第一个字符是 “^ ”，那么它匹配任何不在列表中的字符。比如，正则表达式，“[0123456789] ” 匹配任何单个数字。

在一个方括号表达式中，范围表达式range expression 由2个横线分隔的字符组成。它匹配任何排列在2个字符之间的单个字符，包括，使用场合比较序列和字符集。比如，默认的C场合，“[a-d] ” 等于 “[abcd] ”。许多场合以字典的顺序来对字符进行分类，在这些场合中 “[a-d] ” 通常不等于 “[abcd] ”；可能等于 “[aBbCcDd] ”。比如，为了得到对于方括号表达式的惯用解释，你可以通过设置 LC_ALL 环境变量的值为 “C ” 来使用C场合。

最后，特定的命名的字符族是在括号内事先定义的。参见 grep man 或者 info 页面得到更多关于预定义表达式的信息。

cathy ~> grep [yf] /etc/group
sys:x:3:root,bin,adm
tty:x:5:
mail:x:12:mail,postfix
ftp:x:50:
nobody:x:99:
floppy:x:19:
xfs:x:43:
nfsnobody:x:65534:
postfix:x:89:

cathy ~> ls *[1-9].xml
app1.xml chap1.xml chap2.xml chap3.xml chap4.xml
在这个例子中，所有包含一个 “y ” 或者 “f ” 字符的行首先显示，之后是一个 ls 命令使用范围的例子。

4.2.2.3. 统配符
使用 “. ” 进行一个单字符匹配。如果你想得到一个以 “c ” 开头且以 “h ” 结尾的所有5位字符的英语辞典词条(来解决 crosswords 游戏，就是那个纵横填字游戏)：

cathy ~> grep '/<c...h/>' /usr/share/dict/words
catch
clash
cloth
coach
couch
cough
crash
crush
如果你想显示包含点字符的行，使用 -F 选项给 grep .

要匹配多个字符，使用星号。这个例子从系统的词典中选择了所有以 “c ” 开头且以 “h ” 结尾的单词：

cathy ~> grep '/<c.*h/>' /usr/share/dict/words
caliph
cash
catch
cheesecloth
cheetah
--output omitted--
如果你想在一个文件或者输出中找到包含星号字符的行，使用 grep -F ：

cathy ~> grep * /etc/profile

cathy ~> grep -F '*' /etc/profile
for i in /etc/profile.d/*.sh ; do

分享到：

linux shell编程if语句内判断参数详解 | svn add "already under version control"

2011-09-19 11:12
浏览 2144
评论(0)
分类:编程语言
查看更多

发表评论

您还没有登录,请您登录后再发表评论

最近访客更多访客>>

博主相关

文章分类

社区版块

存档分类

最新评论