香港云主机最佳企业级服务商!

ADSL拨号VPS包含了中国大陆(联通,移动,电信,)

中国香港,国外拨号VPS。

当前位置:云主机 > python >

电信ADSL拨号VPS
联通ADSL拨号VPS
移动ADSL拨号VPS

Python实现抓取网页并且解析的实例


时间:2021-11-09 10:23 作者:admin


本文以实例形式讲述了python/' target='_blank'>python实现抓取网页并解析的功能。主要解析问答与百度的首页。分享给大家供大家参考之用。

主要功能代码如下:

#!/usr/bin/Python#coding=utf-8import sys import reimport urllib2from urllib import urlencodefrom urllib import quoteimport timemaxline = 2000wenda = re.compile("href=\"http://wenda.so.com/q/.+\?src=(.+?)\"")baidu = re.compile("<a href=\"http://www.baidu.com/link\?url=.+\".*?>更多知道相关问题.*?</a>")f1 = open("baidupage.txt","w")f2 = open("wendapage.txt","w")for line in sys.stdin:  if maxline == 0:    break  query = line.strip();  time.sleep(1);  recall_url = "http://www.so.com/s?&q=" + query;  response = urllib2.urlopen(recall_url);  html = response.read();                                                     f1.write(html)  m = wenda.search(html);  if m:    if m.group(1) == "110":      print query + "\twenda\t0";    else:      print query + "\twenda\t1";  else:    print query + "\twenda\t0";  recall_url = "http://www.baidu.com/s?wd=" + query +"&ie=utf-8";  response = urllib2.urlopen(recall_url);  html = response.read();  f2.write(html)  m = baidu.search(html);  if m:    print query + "\tbaidu\t1";  else:    print query + "\tbaidu\t0";  maxline = maxline - 1;f1.close()f2.close()

希望本文所述对大家Python程序设计的学习有所帮助。

(责任编辑:admin)






帮助中心
会员注册
找回密码
新闻中心
快捷通道
域名登录面板
虚机登录面板
云主机登录面板
关于我们
关于我们
联系我们
联系方式

售前咨询:17830004266(重庆移动)

企业QQ:383546523

《中华人民共和国工业和信息化部》 编号:ICP备00012341号

Copyright © 2002 -2018 香港云主机 版权所有
声明:香港云主机品牌标志、品牌吉祥物均已注册商标,版权所有,窃用必究

云官方微信

在线客服

  • 企业QQ: 点击这里给我发消息
  • 技术支持:383546523

  • 公司总台电话:17830004266(重庆移动)
  • 售前咨询热线:17830004266(重庆移动)