对python多线程与global变量详解
2018-11-09 11:07
976 查看
今天早上起来写爬虫,基本框架已经搭好,添加多线程爬取功能时,发现出错:
比如在下载文件的url列表中加入200个url,开启50个线程。我的爬虫…竟然将50个url爬取并全部命名为0.html,也就是说,最后的下载结果,是有1个0.html(重复的覆盖了),还有1-150。下面是我的代码:
x = str(theguardian_globle.g) #x为给下载的文件命的名 filePath = "E://wgetWeiBao//"+x+".html" try: wget.download(url,filePath) theguardian_globle.g+=1 print x+" is downloading..." except: print "error!"
#这个是全局变量g的定义 global g g = 0
后来终于发现问题:多线程+全局变量是个危险的组合,因为程序有多个线程在同时执行,多个线程同时操作全局变量,会引起混乱。在多线程中操作全局变量,应当给该操作加锁。
以下为修改后的代码:
函数: def downLoad(url,num): x = str(num) filePath = "E://wgetWeiBao//"+x+".html" try: wget.download(url,filePath) print x+" is downloading..." except: print "error!"
多线程消费者_给操作全局变量的语句加锁 class Cosumer(threading.Thread): def run(self): print('%s:started' % threading.current_thread()) while True: global gCondition gCondition.acquire() while q.empty()==True: gCondition.wait() url = q.get() num = theguardian_globle.g theguardian_globle.g+=1 gCondition.release() downLoad(url,num)
大功告成!
以上这篇对python多线程与global变量详解就是小编分享给大家的全部内容了,希望能给大家一个参考,也希望大家多多支持脚本之家。
您可能感兴趣的文章:
相关文章推荐
- python多线程与global变量
- Python global全局变量函数详解
- Python多线程详解
- Python用threading实现多线程详解
- Python 多线程锁详解
- python语法31[变量的作用域+global]
- python学习之环境变量配置详解
- 【python】为什么修改全局的dict变量不用global关键字
- python 全局变量的理解(global关键字)
- python多线程之事件Event的使用详解
- python多线程共享变量的使用和效率
- 为什么python在函数中修改"字典型全局变量"不需要global
- python的多线程与多进程介绍及多进程详解(调用multiprocessing组件)
- Python变量和数据类型详解
- Python多线程原理与用法详解
- 【python】多线程详解
- python多线程编程方式分析示例详解
- Python全局变量global
- Python - 类(class)的变量 和 对象(object)的变量 详解 及 代码
- 详解Python多线程