Python requests获取网页常用方法解析
2020-04-11 07:05
826 查看
这篇文章主要介绍了Python requests获取网页常用方法解析,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要的朋友可以参考下
主要记录使用 requests 模块获取网页源码的方法
class Crawler(object): """ 采集类 """ def __init__(self, base_url): self._base_url = base_url self._cookie = None self._getCookie() def _getCookie(self): """ 获取站点cookie :return: """ try: res = requests.get(self._base_url) res.raise_for_status() # TODO response.cookies获取到的是一个cookiejar对象,需要使用requests.utils.dict_from_cookiejar来 # TODO 将cookiejar对象转换为一个字典,这个字典后续使用的时候,在请求时直接传入就可以了, # 如 requests.get(url, cookies=cookies) self._cookie = requests.utils.dict_from_cookiejar(res.cookies) print self._cookie except Exception as e: print e def get_html_text(self, url, **kwargs): """ 爬取网页的通用代码框架 :param url: :param method: :param kwargs: :return: """ try: kwargs.setdefault('cookies', self._cookie) res = requests.get(url, **kwargs) # TODO 若响应状态码不是200, 抛出 HTTPError 异常 res.raise_for_status() res.encoding = res.apparent_encoding # print requests.utils.dict_from_cookiejar(res.cookies) return res.text except Exception as e: print traceback.print_exc() return
以上就是本文的全部内容,希望对大家的学习有所帮助
您可能感兴趣的文章:
相关文章推荐
- Python random模块(获取随机数)常用方法和使用例子
- PHP抓取网页、解析HTML常用的方法总结
- Python中获取网页状态码的两个方法
- 在python使用selenium获取动态网页信息并用BeautifulSoup进行解析--动态网页爬虫
- python获取指定网页上所有超链接的方法
- Python random模块(获取随机数)常用方法和使用例子
- python基础学习第五课,大批量获取网页数据基础,requests模块尝试
- 【web自动化测试】requests-html 这个解析库,能让你更轻松的获取网页内容
- python的requests.get()方法获取百度搜索结果页面失败的问题
- python3.3三种简单获取网页信息的方法
- Python random模块(获取随机数)常用方法和使用例子
- python字符串常用的方法解析
- python打开网页获取网页内容方法总结
- Python实现获取邮箱内容并解析的方法示例
- (实验楼笔记)pip3的安装,安装requests,获取简单网页,Counter 示例, elements() 的方法,most_common() 方法,defaultdict ,namedtuple
- Python-一键获取电影资源链接实例解析(requests、正则表达式、GUI)
- [python]简单获取网页文件指定内容方法
- PHP抓取网页、解析HTML常用的方法总结
- python(27)requests 爬取网页乱码,解决方法
- python打开网页获取网页内容方法总结