首页 > 编程 > Python > 正文

Python提取网页中超链接的方法

2019-11-25 16:33:36
字体:
来源:转载
供稿:网友

下面是最简单的实现方法,先将目标网页抓回来,然后通过正则匹配a标签中的href属性来获得超链接

代码如下:

import urllib2import re url = 'http://www.sunbloger.com/' req = urllib2.Request(url)con = urllib2.urlopen(req)doc = con.read()con.close() links = re.findall(r'href/=/"(http/:////[a-zA-Z0-9/.//]+)/"', doc)for a in links:  print a

总结

以上就是这篇文章的全部内容,希望本文的内容对大家的学习或者工作能有所帮助,如果有疑问大家可以留言交流。

发表评论 共有条评论
用户名: 密码:
验证码: 匿名发表