Python string and text processing techniques (2): case-sensitive search, shortest match, multi-line matching, Unicode normalization.
发布时间
阅读量:
阅读量
1. 字符串忽略大小写的搜索替换
- re.findall(patter, string, flags=re.IGNORECASE)
在进行字符串模式匹配时,若希望不区分字母的大小写形式,可采取以下实现方式:
import re
text = 'UPPER PYTHON, lower python, Mix Python'
target1 = re.findall('python', text, flags=re.IGNORECASE)
print(target1)
# >>> ['PYTHON', 'python', 'Python']
7. target2 = re.sub('python', 'snake', text, flags=re.IGNORECASE)
print(target2)
# >>> UPPER snake, lower snake, Mix snake
2. 最短匹配模式
当我们在尝试利用正则表达式识别特定文本结构时,系统却返回了该结构的最长匹配结果。而我们的目标是将其调整为获取最短匹配结果。此类问题通常出现在需要提取成对分隔符之间内容的场景中(例如被引号包围
全部评论 (0)
还没有任何评论哟~
