python获取指定网页上所有超链接的方法
时间:2021-11-09 10:30 作者:admin
本文实例讲述了python/' target='_blank'>python获取指定网页上所有超链接的方法。分享给大家供大家参考。具体如下:
这段Python代码通过urllib2抓取网页,然后通过简单的正则表达式分析网页上的全部url地址
import urllib2import re#connect to a URLwebsite = urllib2.urlopen(url)#read html codehtml = website.read()#use re.findall to get all the linkslinks = re.findall('"((http|ftp)s?://.*?)"', html)print links
希望本文所述对大家的python程序设计有所帮助。
(责任编辑:admin)