Vim正则表达式
来自KlniuWiki
Vim 正则表达式与 perl 表达式有一些不同,下面将介绍 vim 正则表达式的具体内容。如需查看通用的正则表达式请查看正则表达式。
目录 |
1 使用正则表达式的命令
使用正则表达式的命令最常见的就是 / (搜索)命令。其格式如下:
/正则表达式
另一个很有用的命令就是 :s(替换)命令,将第一个//之间的正则表达式替换成第二个//之间的字符串。
:s/正则表达式/替换字符串/选项
2 元字符
元字符是具有特殊意义的字符。使用元字符可以表达任意字符、行首、行尾、某几个字符等意义。
2.1 常规匹配符
- .
- 匹配任意一个字符
- [abc]
- 匹配方括号中的任意一个字符。可以使用-表示字符范围,如[a-z0-9]匹配小写字母和阿拉伯数字。
- [^abc]
- 在方括号内开头使用^符号,表示匹配除方括号中字符之外的任意字符。
- \d
- 匹配阿拉伯数字,等同于[0-9]。
- \D
- 匹配阿拉伯数字之外的任意字符,等同于[^0-9]。
- \x
- 匹配十六进制数字,等同于[0-9A-Fa-f]。
- \X
- 匹配十六进制数字,等同于[^0-9A-Fa-f]。
- \w
- 匹配单词字母,等同于[0-9A-Za-z_]。
- \W
- 匹配单词字母之外的任意字符,等同于[^0-9A-Za-z_]。
- \t
- 匹配<TAB>字符。
- \s
- 匹配空白字符,等同于[ \t]。
- \S
- 匹配非空白字符,等同于[^ \t]。
- \*
- 匹配 * 字符。
- \.
- 匹配 . 字符。
- \/
- 匹配 / 字符。
- \\
- 匹配 \ 字符。
- \[
- 匹配 [ 字符。
另外,如果要查找字符 *、.、/等,则需要在前面用 \ 符号,表示这不是元字符,而只是普通字符而已。
2.2 限定符
- *
- 匹配0-任意个
- \+
- 匹配1-任意个
- \?
- 匹配0-1个
- \{n,m}
- 匹配n-m个
- \{n}
- 匹配n个
- \{n,}
- 匹配n-任意个
- \{,m}
- 匹配0-m个
2.3 位置符
- $
- 匹配行尾
- ^
- 匹配行首
- \<
- 匹配单词词首
- \>
- 匹配单词词尾
2.4 替换变量
在正规表达式中使用 \( 和 \) 符号括起正规表达式,即可在后面使用\1、\2等变量来访问 \( 和 \) 中的内容。例如:
- /\(a\+\)[^a]\+\1
- 查找开头和结尾处a的个数相同的字符串,如 aabbbaa,aaacccaaa,但是不匹配 abbbaa
- s/\(http
- \/\/[-a-z\._~\+%\/]\+\)/\1/: 将URL替换为http://url的格式
- s/\(\w\+\)\s\+\(\w\+\)/\2\t\1
- 将 data1 data2 修改为 data2 data1
2.5 函数式
在替换命令 s/// 中可以使用函数表达式来书写替换内容,格式为
:s/替换字符串/\=函数式
在函数式中可以使用 submatch(1)、submatch(2) 等来引用 \1、\2 等的内容,而submatch(0)可以引用匹配的整个内容。例如:
- %s/\/\=line(".")
- 将各行的 id 字符串替换为行号
- %s/^\/\=(line(".")-10) .".". submatch(1)
- 将每行开头的单词替换为 (行号-10).单词 的格式,如第11行的 word 替换成 1. word
3 贪婪与非贪婪
假设有文本行如下:
<head><title>t1</title></head>
贪婪匹配
正则表达式: <.*>
只能匹配一个结果<head><title>t1</title></head>
非贪婪匹配
正则表达式: <.\{-}> (注:普通的非贪婪式为<.*?>)
可以匹配4个结果 <head>、<title>、</title>和</head>
4 使用举例
- /char\s\+[A-Za-z_]\w*;
- 查找所有以char开头,之后是一个以上的空白,最后是一个标识符和分号
- /\d\d
- \d\d:\d\d: 查找如 17:37:01 格式的时间字符串
- g/^\s*$/d
- 删除只有空白的行
5 参见
- vim中的正则表达式. qintel. 2008-03-31 16:37.