香港云主机最佳企业级服务商!

ADSL拨号VPS包含了中国大陆(联通,移动,电信,)

中国香港,国外拨号VPS。

当前位置:云主机 > python >

电信ADSL拨号VPS
联通ADSL拨号VPS
移动ADSL拨号VPS

对python多线程与global变量详解


时间:2022-02-08 17:50 作者:admin610456


今天早上起来写爬虫,基本框架已经搭好,添加多线程爬取功能时,发现出错:

比如在下载文件的url列表中加入200个url,开启50个线程。我的爬虫…竟然将50个url爬取并全部命名为0.html,也就是说,最后的下载结果,是有1个0.html(重复的覆盖了),还有1-150。下面是我的代码:

x = str(theguardian_globle.g) #x为给下载的文件命的名 filePath = "E://wgetWeiBao//"+x+".html" try:  wget.download(url,filePath)  theguardian_globle.g+=1  print x+" is downloading..."  except:  print "error!"
#这个是全局变量g的定义global g g = 0

后来终于发现问题:多线程+全局变量是个危险的组合,因为程序有多个线程在同时执行,多个线程同时操作全局变量,会引起混乱。在多线程中操作全局变量,应当给该操作加锁。

以下为修改后的代码:

函数: def downLoad(url,num): x = str(num) filePath = "E://wgetWeiBao//"+x+".html" try:  wget.download(url,filePath)  print x+" is downloading..."  except:  print "error!"
多线程消费者_给操作全局变量的语句加锁class Cosumer(threading.Thread): def run(self):  print('%s:started' % threading.current_thread())   while True:   global gCondition   gCondition.acquire()   while q.empty()==True:    gCondition.wait()   url = q.get()   num = theguardian_globle.g   theguardian_globle.g+=1   gCondition.release()   downLoad(url,num)

大功告成!

以上这篇对python/' target='_blank'>python多线程与global变量详解就是小编分享给大家的全部内容了,希望能给大家一个参考,也希望大家多多支持脚本之家。

(责任编辑:admin)






帮助中心
会员注册
找回密码
新闻中心
快捷通道
域名登录面板
虚机登录面板
云主机登录面板
关于我们
关于我们
联系我们
联系方式

售前咨询:17830004266(重庆移动)

企业QQ:383546523

《中华人民共和国工业和信息化部》 编号:ICP备00012341号

Copyright © 2002 -2018 香港云主机 版权所有
声明:香港云主机品牌标志、品牌吉祥物均已注册商标,版权所有,窃用必究

云官方微信

在线客服

  • 企业QQ: 点击这里给我发消息
  • 技术支持:383546523

  • 公司总台电话:17830004266(重庆移动)
  • 售前咨询热线:17830004266(重庆移动)