正则表达式注意事项
2015-08-17 15:46
351 查看
1.所谓组。您检查一次,你可以选择多个比赛结果,每个结果是指一组
eg.
2.查找一个文件里全部的http(url)地址
3.正则表达式空格含有\t\r\n\f\v如几个字符
eg.
import re pattern = re.compile(r'<div(.*? >)(.*?)</div>') match = pattern.match('<div class="test">Hello <div>wa haha<div>test xxx</div></div>world</div>') if match: print match.group(2) print match.group(1) print match.group(0) >>> ================================ RESTART ================================ >>> Hello <div>wa haha<div>test xxx class="test"> <div class="test">Hello <div>wa haha<div>test xxx</div> >>>当中group(0)比較特殊,全部组的合集
2.查找一个文件里全部的http(url)地址
import re import urllib2 f = open('url.txt','r') string = "" while 1: line = f.readline() if not line:break string += line f.close() urls = re.findall('http[s]?://(?:[a-zA-Z]|[0-9]|[$-_@.&+]|[!*\(\),]|(?:%[0-9a-fA-F][0-9a-fA-F]))+', string)
3.正则表达式空格含有\t\r\n\f\v如几个字符
相关文章推荐
- nginx编译与安装
- background-position问题
- windows 2008上启用防火墙后Oracle tnsping不通的解决办法
- ffmpeg安装
- C#日志扩展包之Microsoft Enterprise Library - Logging Application Block总述
- retain(strong)和copy之间的关系
- Android错误之--Error retrieving parent for item: No resource found that matches the given name 'Theme.A
- 通过LinkText查找元素
- STM32F207+uCOS II 任务调度的问题
- [C++]Single Number III单个数字3
- mybatis的xml配置
- 华为上机题之去除字符串中最大最小的数
- style, currentStyle, getComputedStyle的区别
- Sqlite语法
- 基于Unitils和Spring解决一些单元测试的常见问题
- Android Static分析
- 51NOD 1459 迷宫游戏
- html5之本地存储
- Android开源--MenuDrawer
- JVM内存模型及内存分配过程