grep和正则表达式

grep

      作用:文本搜索工具,根据用户指定的“模式(过滤条件)”对目标文件逐行进行匹配检查;打印匹配到的行;

      模式:由正则表达式的元字符及文本所编写出的过滤条件

   语法:【选项】【文件】

   参数:

    –color=auto 高亮显示匹配到的字符串

         -v 反向匹配(即不显示选项内的内容)

         -i 忽略大小写

         -n 显示的结果前增加行号

         -c 仅显示匹配到结果的行数

         -o 仅显示匹配到的字符串

         -q 静默模式,不输出任何信息

                  (或者 &>
/dev/null)

         -A# 显示关键字行及向后#

         -B# 显示关键字行及向前#

         -C# 显示关键字向前#行,当前行,及向后#

         -e 关键字1 -e 关键字2  实现多个选项间的逻辑or关系

         -w 匹配整个单词

         -E 使用扩展正则表达式 egrep

         -F 不使用正则表达式 fgrep

基本正则表达式元字符

作用:由一类特殊字符及文本字符所编写的模式,其中有些字符不表示其字面意义,而是用于表示控制或通配的功能。

字符匹配:

        
          
 .   
匹配任意单个字符

                   [ ]   匹配指定范围内的任意单个字符

      
         
  [^]   
匹配指定范围外的任意单个字符

                   [:alnum:] [0-9a-zA-Z] 字母和数字

                   [:alpha:] [a-zA-Z]    所有大小写字母

  [:upper:] [A-Z]       大写字母

                   [:lower:] [a-z]       小写字母

                   [:blank:] 空白字符(空格和制表符)

                   [:space:] 水平和垂直的空白字符(比[:blank:]包含的范围广)

                   [:cntrl:] 不可打印的控制字符(退格、删除、警铃

                   [:digit:] 十进制数字 [0-9]

                  [:xdigit:]十六进制数字

                  [:graph:] 可打印的非空白字符

                  [:print:] 可打印字符

                  [:punct:] 标点符号

匹配次数:

                  *  匹配前面的字符任意次,包括0

                 .* 任意长度的任意字符

                 \? 匹配其前面的字符01

                 \+ 匹配其前面的字符至少1

                 \{n\} 匹配前面的字符n

                 \{m,n\} 匹配前面的字符至少m次,最多n

                 \{,n\}  匹配前面的字符最多n

                 \{n,\}  匹配前面的字符至少n

位置锚定:定位出现的位置

                 ^  行首锚定,用于模式的最左侧

        $  行尾锚定,用于模式的最右侧

                ^PATTERN$ 用于模式匹配整行

                ^$  空行 

                ^[[:space:]]*$  空白行

                ^#  #开头

                \<\b 词首锚定,用于单词模式的左侧

        \>\b 词尾锚定,用于单词模式的右侧

        \<PATTERN\> 匹配整个单词

      分组:\(\) 将一个或多个字符捆绑在一起,当作一个整体进行处理,如:\(xy\)*ab表示xy这个整体可以被匹配任意次

      注意:分组括号中的模式匹配到的内容会被正则表达式引擎记录于内部的变量中,这些变量的命名方式为: \1, \2, \3, …

              \1  表示从左侧起第一个左括号以及与之匹配右括号之间的模式所匹配到的字符

              \2  表示从左侧起第二个左括号以及与之匹配右括号之间的模式所匹配到的字符

   后向引用:引用前面的分组括号中的模式所匹配到的字符,而非模式本身。

 

实例:

1、  显示/etc/passwd文件中不以/bin/bash结尾的行

  grep -v “/bin/bash$”
/etc/passwd
-v忽略匹配到的字符串)

grep和正则表达式

2、显示/proc/meminfo文件中以大写或小写S开头的行

此题有好几种解法:

  grep  “^[Ss]”  /proc/meminfo “^[Ss]”表示匹配以大写S或小写s开头的行)

  grep  -I  “^s”  /proc/meminfo -I 表示忽略大小写)

  grep  -e ^s -e ^S  /proc/meminfo -e表示实现多个选项间的逻辑or关系)

  grep  “^s\|^S”  /proc/meminfo \|表示“或”)

grep和正则表达式

3、显示用户rpc默认的shell程序

       grep -w
“^rpc”   /etc/passwd  | cut -d : -f7
-w匹配整个单词)

grep和正则表达式

4、找出“netstat -tan”命令的结果中以‘LISTEN’后跟任意多个空白字符结尾的行

   netstat -tan|grep
“\<LISTEN\>[[:space:]]*$”
*表示匹配前面的字符任意次)

grep和正则表达式

egrep

扩展正则表达式的元字符:

        字符匹配:

                  . 任意单个字符

                [ ] 指定范围的字符

               [^] 不在指定范围的字符

次数匹配:

                *:匹配前面字符任意次

                ?01

                +1次或多次

            {m}:匹配m

            {,n}:匹配至多n

 {m,n}:至少m,至多n

      位置锚定:

            ^ :行首

            $ :行尾

           \<, \b :语首

           \>,
\b
:语尾

 分组:

         ():用括号括起来表示要引用的内容,不需要转义

           后向引用:\1,\2, \3…

  或者:

          a|b ab

        C|cat Ccat

       (C|c)atCatcat

实例:

1、  利用扩展正则表达式分别表示0-910-99100-199200-249250-255

echo {0..300}|egrep -o “\<[0-9]\>”(行首锚定\<;行尾锚定\>

echo {0..300}|egrep -o “\<[1-9][0-9]\>”

echo {0..300}|egrep -o “\<1[0-9][0-9]\>”

echo {0..300}|egrep -o “\<2[0-4][0-9]\>”

echo {0..300}|egrep -o “\<25[0-5]\>”

grep和正则表达式

 

grep和正则表达式

因为中间显示的数字较长,所以开头和结尾为代表示意。

2、将此字符串:welcome to magedu linux 中的每个字符去重并排序,重复次数多的排到前面

echo “welcome to magedu linux”|grep -o . |sort|uniq -c
|sort –nr
. 表示匹配任意单个字符)

grep和正则表达式

3、使用egrep取出/etc/rc.d/init.d/functions中其基名

echo /etc/rc.d/init.d/functions |egrep -o “[^/]+/?$”

grep和正则表达式

fgrep:不支持正则表达式元字符

       当无需用到元字符去编写模式时,使用fgrep更好

 

   今天要说的就这么多了,see you !

原创文章,作者:吼吼哈嘿,如若转载,请注明出处:http://www.178linux.com/83681

(0)
吼吼哈嘿吼吼哈嘿
上一篇 2017-08-04 21:43
下一篇 2017-08-04 22:25

相关推荐

  • MongoDB复制集及数据分片详解

    前言 MongoDB是一个由C++语言编写的基于分布式文件存储的数据库,是当前NoSQL数据库中比较热门的一种,旨在为Web应用提供可扩展的高性能数据存储解决方案。本文介绍MongoDB复制集及数据分片。 MongoDB 简介 MongoDB是一个介于关系数据库和非关系数据库之间的产品,是非关系数据库当中功能最丰富,最像关系数据库的。支持的数据结构非常松散,…

    Linux干货 2015-07-15
  • 重返课堂

    1.学习目的: i. IT业发展日新月异,当前所掌握的知识已无法满足工作需要。 ii. IT行业更新飞快,这就要求从业人员不断的去学习,不断的完善自己,才不至于被淘汰。 iii. 在这个大数据、云计算为王的时代,掌握Linux是入行“敲门砖”。 iv. 年龄已大,把握住人生不多的专门学习的机会,再博一次。 2.浅识Linux i. linux为何? Linu…

    2018-03-26
  • iptables简单概念..

    iptables: 包过滤型的防火墙 Firewall:防火墙,隔离工具;工作于主机或网络边缘,对于进出本主机或本网络的报文根据事先定义的检查规则作匹配检测,对于能够被规则匹配到的报文作出相应处理的组件;    主机防火墙     网络防火墙   &…

    Linux干货 2017-06-19
  • Linux中设置磁盘配额和RAID

    第一篇:设置磁盘配额 综述     •在内核中执行     •以文件系统为单位启用     •对不同组或者用户的策略不同       根据块或者节点进行限制         •执行软限制(soft limit)   &n…

    Linux干货 2016-09-05
  • 创建私有CA及dropbear的编译安装

    使用openssl创建私有CA 配置文件/etc/pki/tls/openssl.cnf certs           = $dir/certs         &nb…

    Linux干货 2016-09-26
  • redis/twemproxy 客户端连接异常

    对于一个DBA,客户端连接异常问题可以说是家常便饭的事情,处理多了都想吐。 root cause无疑发生在三个地方,先找自身的原因,依次排查下去: 1)服务器端db的负载,如果负载太高,创建socket太慢引起超时。另外服务器端socket的个数太多,也可以导致创建连接需要很长的时间或者创建连接不成功。 2)网络是够有抖动,包括lvs/twemproxy重启…

    Linux干货 2015-04-03