vi 替换命令与正则表达式-我爱钓鱼-ChinaUnix博客

宝　　贝　　计　　划babyplan.blog.chinaunix.net

首页　| 　博文目录　| 　关于我

我爱钓鱼

博客访问： 1459927
博文数量： 350
博客积分： 12557
博客等级：上将
技术积分： 3621
用户组：普通用户
注册时间： 2007-03-22 07:33

文章分类

全部博文（350）

爱车心得（4）
心情日记（54）
宝贝计划（185）

资料文档（18）
快乐渔摄（30）

摄影（27）

钓鱼（1）
技术心得（59）

网络及其它（5）

EDA软件（3）

windows（13）

solaris（1）

linux（37）
偶有所感（17）
未分配的博文（1）

文章存档

2014年（2）

2013年（1）

2012年（15）

2011年（46）

2010年（61）

2009年（80）

2008年（80）

2007年（65）

我的朋友

相关博文

vi 替换命令与正则表达式

分类： LINUX

2009-05-04 15:42:52

vi的替换命令：

:ranges/pat1/pat2/g

其中

: 这是vi的命令模式。 range 是命令执行范围的指定，可以使用百分号（%）表示所有行，使用点（.）表示当前行，使用美元符号（$）表示最后一行。你还可以使用行号，例如10,20表示第10到20行，.,$表示当前行到最后一行，.+2,$-5表示当前行后两行直到全文的倒数第五行，等等。

s 表示其后是一个替换命令，类似Perl的替换函数。pat1 这是要查找并替换的一个正则表达式。

pat2 这是希望把匹配串变成的模式的正则表达式。

g 模式修饰符，表示替换将针对行中每个匹配的串进行重复匹配，不是只匹配行中出现的第一个匹配串。

          i 模式修饰符，表示模式匹配时忽略大小写。
＠＠＠＠＠＠＠＠＠＠＠＠＠＠＠＠＠＠＠＠＠＠＠＠＠＠＠＠＠＠
参考来源：UNIX Shell范例精解（第3版）
正则表达式元字符
^             行首定位符                      /^love/         匹配所有love开头的行
$             行尾定位符                     /love$/           匹配所有以love结尾的行
.               匹配一个字符                /l..e/                 匹配包含一个l,后跟两个字符，跟一个e的行
*              匹配0或者多个前一字符 /*love/         匹配包含0或多个空格后跟love的行
[]             匹配一组字符窗中任一个/[Ll]ove/     匹配包含love或者Love的行
[x-y]        匹配某范围字符中一个    /[A-Z]ove/   匹配后跟ove的一个A到Z之间的字符
[^]           匹配不再指定组内的字符/[^A-Z]/       匹配不再范围A到Z之间的任意字符
\               用于转义字符                    /love\./        匹配包括love,后面跟一个句点符号。

pattern\｛n\｝      用来匹配前面pattern出现次数。n为次数
pattern\｛n,\｝m    含义同上，但次数最少为n
pattern\｛n,m\｝    含义同上，但pattern出现次数在n与m之间

--------------------------------------------------------------------------
正则表达式语法

一个正则表达式就是由普通字符（例如字符 a 到 z）以及特殊字符（称为元字符）组成的文字模式。该模式描述在查找文字主体时待匹配的一个或多个字符串。正则表达式作为一个模板，将某个字符模式与所搜索的字符串进行匹配。

这里有一些可能会遇到的正则表达式示例：

Visual Basic VBScript 匹配
Scripting Edition

/^\[ \t]*$/ "^\[ \t]*$" 匹配一个空白行。

/\d{2}-\d{5}/ "\d{2}-\d{5}" 验证一个ID号码是否由一个2位字，一
个连字符以及一个5位数字组成。

/<(.*)>.*<\/\1>/ "<(.*)>.*<\/\1>" 匹配一个 HTML 标记。

下表是元字符及其在正则表达式上下文中的行为的一个完整列表：

字符描述

\ 将下一个字符标记为一个特殊字符、或一个原义字符、或一个后
向引用、或一个八进制转义符。例如，’n’ 匹配字符 "n"。’\n’
匹配一个换行符。序列 ’\\’ 匹配 "\" 而 "\(" 则匹配 "("。

^ 匹配输入字符串的开始位置。如果设置了 RegExp 对象的
Multiline 属性，^ 也匹配 ’\n’ 或 ’\r’ 之后的位置。

$ 匹配输入字符串的结束位置。如果设置了 RegExp 对象的
Multiline 属性，$ 也匹配 ’\n’ 或 ’\r’ 之前的位置。

* 匹配前面的子表达式零次或多次。例如，zo* 能匹配 "z" 以及
"zoo"。 * 等价于{0,}。

+ 匹配前面的子表达式一次或多次。例如，’zo+’ 能匹配 "zo" 以
及 "zoo"，但不能匹配 "z"。+ 等价于 {1,}。

? 匹配前面的子表达式零次或一次。例如，"do(es)?" 可以匹配
"do" 或 "does" 中的"do" 。? 等价于 {0,1}。

{n} n 是一个非负整数。匹配确定的 n 次。例如，’o{2}’ 不能匹配
"Bob" 中的 ’o’，但是能匹配 "food" 中的两个 o。

{n,} n 是一个非负整数。至少匹配n 次。例如，’o{2,}’ 不能匹配
"Bob" 中的 ’o’，但能匹配 "foooood" 中的所有 o。’o{1,}’
等价于 ’o+’。’o{0,}’ 则等价于 ’o*’。

{n,m} m 和 n 均为非负整数，其中n <= m。最少匹配 n 次且最多匹
配 m 次。刘， "o{1,3}" 将匹配 "fooooood" 中的前三个o。
’o{0,1}’等价于’o?’。请注意在逗号和两个数之间不能有空格

? 当该字符紧跟在任何一个其他限制符 (*, +, ?, {n}, {n,},
{n,m}) 后面时，匹配模式是非贪婪的。非贪婪模式尽可能少的
匹配所搜索的字符串，而默认的贪婪模式则尽可能多的匹配所搜
索的字符串。例如，对于字符串 "oooo"，’o+?’ 将匹配单个
"o"，而 ’o+’ 将匹配所有 ’o’。

. 匹配除 "\n" 之外的任何单个字符。要匹配包括 ’\n’ 在内的任
何字符，请使用象 ’[.\n]’ 的模式。

(pattern) 匹配pattern 并获取这一匹配。所获取的匹配可以从产生的
Matches 集合得到，在VBScript 中使用 SubMatches 集合，在
Visual Basic Scripting Edition 中则使用 $0…$9 属性。要
匹配圆括号字符，请使用 ’$’ 或 ’$’。

(?:pattern) 匹配 pattern 但不获取匹配结果，也就是说这是一个非获取匹
配，不进行存储供以后使用。这在使用 "或" 字符 (|) 来组合
一个模式的各个部分是很有用。例如， ’industr(?:y|ies) 就
是一个比 ’industry|industries’ 更简略的表达式。

(?=pattern) 正向预查，在任何匹配 pattern 的字符串开始处匹配查找字符
串。这是一个非获取匹配，也就是说，该匹配不需要获取供以后
使用。例如，’Windows (?=95|98|NT|2000)’ 能匹配"Windows
2000"中的"Windows"，但不能匹配"Windows3 .1"中"Windows"。
预查不消耗字符，也就是说，在一个匹配发生后，在最后一次匹
配之后立即开始下一次匹配的搜索，而不是从包含预查的字符之
后开始。

(?!pattern) 负向预查，在任何不匹配Negative lookahead matches the
search string at any point where a string not matching
pattern 的字符串开始处匹配查找字符串。这是一个非获取匹
配，也就是说，该匹配不需要获取供以后使用。例如’Windows
(?!95|98|NT|2000)’ 能匹配 "Windows 3.1" 中的 "Windows"，
但不能匹配 "Windows 2000" 中的 "Windows"。预查不消耗字
符，也就是说，在一个匹配发生后，在最后一次匹配之后立即开
始下一次匹配的搜索，而不是从包含预查的字符之后开始

x|y 匹配 x 或 y。例如，’z|food’ 能匹配 "z" 或 "food"。’(z|f)
ood’ 则匹配 "zood" 或 "food"。

[xyz] 字符集合。匹配所包含的任意一个字符。例如， ’[abc]’ 可以
匹配 "plain" 中的 ’a’。

[^xyz] 负值字符集合。匹配未包含的任意字符。例如， ’[^abc]’ 可以
匹配 "plain" 中的’p’。

[a-z] 字符范围。匹配指定范围内的任意字符。例如，’[a-z]’ 可以匹
配 ’a’ 到 ’z’ 范围内的任意小写字母字符。

[^a-z] 负值字符范围。匹配任何不在指定范围内的任意字符。例如，
’[^a-z]’ 可以匹配任何不在 ’a’ 到 ’z’ 范围内的任意字符。

\b 匹配一个单词边界，也就是指单词和空格间的位置。例如，
’er\b’ 可以匹配"never" 中的 ’er’，但不能匹配 "verb" 中
的 ’er’。

\B 匹配非单词边界。’er\B’ 能匹配 "verb" 中的 ’er’，但不能匹
配 "never" 中的 ’er’。

\cx 匹配由x指明的控制字符。例如， \cM 匹配一个 Control-M 或
回车符。 x 的值必须为 A-Z 或 a-z 之一。否则，将 c 视为一
个原义的 ’c’ 字符。

\d 匹配一个数字字符。等价于 [0-9]。

\D 匹配一个非数字字符。等价于 [^0-9]。

\f 匹配一个换页符。等价于 \x0c 和 \cL。

\n 匹配一个换行符。等价于 \x0a 和 \cJ。

\r 匹配一个回车符。等价于 \x0d 和 \cM。

\s 匹配任何空白字符，包括空格、制表符、换页符等等。等价于
[ \f\n\r\t\v]。

\S 匹配任何非空白字符。等价于 [^ \f\n\r\t\v]。

\t 匹配一个制表符。等价于 \x09 和 \cI。

\v 匹配一个垂直制表符。等价于 \x0b 和 \cK。

\w 匹配包括下划线的任何单词字符。等价于’[A-Za-z0-9_]’。

\W 匹配任何非单词字符。等价于 ’[^A-Za-z0-9_]’。

\xn 匹配 n，其中 n 为十六进制转义值。十六进制转义值必须为确
定的两个数字长。例如， ’\x41’ 匹配 "A"。’\x041’ 则等价
于 ’\x04’ & "1"。正则表达式中可以使用 ASCII 编码。.

\num 匹配 num，其中num是一个正整数。对所获取的匹配的引用。
例如，’(.)\1’ 匹配两个连续的相同字符。

\n 标识一个八进制转义值或一个后向引用。如果 \n 之前至少 n
个获取的子表达式，则 n 为后向引用。否则，如果 n 为八进制
数字 (0-7)，则 n 为一个八进制转义值。

\nm 标识一个八进制转义值或一个后向引用。如果 \nm 之前至少有
is preceded by at least nm 个获取得子表达式，则 nm 为后
向引用。如果 \nm 之前至少有 n 个获取，则 n 为一个后跟文
字 m 的后向引用。如果前面的条件都不满足，若 n 和 m 均为
八进制数字 (0-7)，则 \nm 将匹配八进制转义值 nm。

\nml 如果 n 为八进制数字 (0-3)，且 m 和 l 均为八进制数字 (0-
7)，则匹配八进制转义值 nml。

\un 匹配 n，其中 n 是一个用四个十六进制数字表示的Unicode字
符。例如， \u00A9 匹配版权符号 (?)。

阅读(1298) | 评论(0) | 转发(1) |

上一篇：飞飞昨天饿惨了..

下一篇：终于忍无可忍了。。。

给主人留下些什么吧！~~

感谢所有关心和支持过ChinaUnix的朋友们

16024965号-6