• linkedu视频
  • 平面设计
  • 电脑入门
  • 操作系统
  • 办公应用
  • 电脑硬件
  • 动画设计
  • 3D设计
  • 网页设计
  • CAD设计
  • 影音处理
  • 数据库
  • 程序设计
  • 认证考试
  • 信息管理
  • 信息安全
菜单
linkedu.com
  • 网页制作
  • 数据库
  • 程序设计
  • 操作系统
  • CMS教程
  • 游戏攻略
  • 脚本语言
  • 平面设计
  • 软件教程
  • 网络安全
  • 电脑知识
  • 服务器
  • 视频教程
  • vbs
  • DOS/BAT
  • hta/htc
  • python
  • perl
  • VBA
  • ColdFusion
  • ruby
  • PowerShell
  • Lua
  • Golang
  • linux shell
您的位置:首页 > 脚本语言 >python > Python提取网页中超链接的方法

Python提取网页中超链接的方法

作者:daisy 字体:[增加 减小] 来源:互联网

daisy 通过本文主要向大家介绍了python 写网页,python网页截图,python采集网页数据,python网页开发,python下载网页图片等相关知识,希望对您有所帮助,也希望大家支持linkedu.com www.linkedu.com

下面是最简单的实现方法,先将目标网页抓回来,然后通过正则匹配a标签中的href属性来获得超链接

代码如下:

import urllib2
import re
 
url = 'http://www.sunbloger.com/'
 
req = urllib2.Request(url)
con = urllib2.urlopen(req)
doc = con.read()
con.close()
 
links = re.findall(r'href\=\"(http\:\/\/[a-zA-Z0-9\.\/]+)\"', doc)
for a in links:
  print a
</div>

总结

以上就是这篇文章的全部内容,希望本文的内容对大家的学习或者工作能有所帮助,如果有疑问大家可以留言交流。

</div>

您可能想查找下面的文章:

  • Python提取网页中超链接的方法
  • Python提取网页中超链接的方法
  • 使用Python保存网页上的图片或者保存页面为截图
  • python分析网页上所有超链接的方法
  • python获取指定网页上所有超链接的方法
  • Python通过解析网页实现看报程序的方法
  • python实现网页链接提取的方法分享
  • python实现网页链接提取的方法分享

相关文章

  • Python设计模式编程中Adapter适配器模式的使用实例
  • 自己使用总结Python程序代码片段
  • 在Python的Django框架中simple-todo工具的简单使用
  • Python编写屏幕截图程序方法
  • python实现简单的TCP代理服务器
  • Python实现批量下载图片的方法
  • python实现dnspod自动更新dns解析的方法
  • Python中删除文件的程序代码
  • win7 下搭建sublime的python开发环境的配置方法
  • Python实现获取操作系统版本信息方法

文章分类

  • vbs
  • DOS/BAT
  • hta/htc
  • python
  • perl
  • VBA
  • ColdFusion
  • ruby
  • PowerShell
  • Lua
  • Golang
  • linux shell

最近更新的内容

    • python中List的sort方法指南
    • 深入讲解Python中的迭代器和生成器
    • Python中实现的RC4算法
    • Python中转换角度为弧度的radians()方法
    • python操作MySQL数据库的方法分享
    • python实现简单的计时器功能函数
    • python实现字典(dict)和字符串(string)的相互转换方法
    • python用来获得图片exif信息的库实例分析
    • Python实现基本线性数据结构
    • 在Python的web框架中中编写日志列表的教程

关于我们 - 联系我们 - 免责声明 - 网站地图

©2020-2025 All Rights Reserved. linkedu.com 版权所有