使用python验证代理IP是否可用
2018-02-07 23:44
771 查看
转载自:https://www.jianshu.com/p/588241a313e7
在使用爬虫爬取网络数据时,如果长时间对一个网站进行抓取时可能会遇到IP被封的情况,这种情况可以使用代理更换ip来突破服务器封IP的限制。
随手在百度上搜索
通过编写一个爬虫来抓取网站上面的IP地址,端口,及类型,把这些信息存到本地。这里不做介绍。
验证代理IP是否可用。原理是使用代理IP访问指定网站,如果返回状态为200,表示这个代理是可以使用的。
受@齐俊杰的提醒,添加一种使用telnet来验证的方法:
在使用爬虫爬取网络数据时,如果长时间对一个网站进行抓取时可能会遇到IP被封的情况,这种情况可以使用代理更换ip来突破服务器封IP的限制。
随手在百度上搜索
免费代理IP,可以得到一系列的网站,这里我们通过对西刺网站的抓取来举例。
通过编写一个爬虫来抓取网站上面的IP地址,端口,及类型,把这些信息存到本地。这里不做介绍。
验证代理IP是否可用。原理是使用代理IP访问指定网站,如果返回状态为200,表示这个代理是可以使用的。
# _*_ coding:utf-8 _*_ import urllib2 import re class TestProxy(object): def __init__(self): self.ip = '106.46.136.64' self.port = '808' self.url = 'http://www.baidu.com' self.timeout = 3 self.regex = re.compile(r'baidu.com') self.run() def run(self): self.linkWithProxy() def linkWithProxy(self): server = 'http://'+ self.ip + ':'+ self.port opener = urllib2.build_opener(urllib2.ProxyHandler({'http':server})) urllib2.install_opener(opener) try: response = urllib2.urlopen(self.url, timeout=self.timeout) except: print '%s connect failed' % server return else: try: str = response.read() except: print '%s connect failed' % server return if self.regex.search(str): print '%s connect succes 4000 s .......' % server print self.ip + ':' + self.port if __name__ == '__main__': Tp = TestProxy()也可以使用
requests包来进行验证,要少写好多代码
import requests try: requests.get('http://wenshu.court.gov.cn/', proxies={"http":"http://121.31.154.12:8123"}) except: print 'connect failed' else: print 'success'把验证通过的IP保存在redis里面,在IP被禁止的时候可以从redis中取出来使用。
受@齐俊杰的提醒,添加一种使用telnet来验证的方法:
import telnetlib try: telnetlib.Telnet('127.0.0.1', port='80', timeout=20) except: print 'connect failed' else: print 'success'
相关文章推荐
- 使用python验证代理ip是否可用的实现方法
- python 爬取西刺免费代理ip 并使用telnetlib.Telnet验证是否有效
- python验证IP代理是否可用
- [Python爬虫] 使用urllib2库检测代理ip是否可用,并使用代理提交GET、POST请求
- c# 使用HttpWebRequest,HttpWebResponse 快速验证代理IP是否有用
- #如何用ping的方法验证代理IP是否可用
- C# 使用HttpWebRequest,HttpWebResponse 快速验证代理IP是否有用
- 使用python 中的IPy 验证IP格式是否合法
- 从西刺代理爬取代理ip,并验证是否可用
- c# 使用HttpWebRequest,HttpWebResponse 快速验证代理IP是否有用
- c#使用HttpWebRequest,HttpWebResponse快速验证代理IP是否有用
- Python采集代理ip并判断是否可用和定时更新的方法
- 抓取西刺代理IP+验证是否可用+存储mongodb
- python:代理ip获取,验证,使用
- Python采集代理ip并判断是否可用和定时更新
- c# 快速验证代理IP是否有用
- Python 使用堆栈验证C文件括号是否匹配
- Python实现检测代理IP是否可以翻墙
- Python 爬虫入门(二)—— IP代理使用
- c#编写检测代理IP是否可用