中关村在线

软件

Python抓取网页源码

Python的urllib库功能强大,支持多种网络请求操作。

1、 使用 import 语句导入 urllib 库,代码为:import urllib。

2、 使用 urllib.request.urlopen 方法打开指定网页。

3、 上述步骤已将网页内容读取并存储至变量file中。

4、 使用 read() 方法读取文件内容。

5、 读取内容后,通过文件写入操作将其保存至指定文件中。

6、 内容已保存至 date.html 文件,其具体内容所示。

7、 上述代码先读取内容,再通过文件操作保存源码;接下来我们将直接调用模块内置方法实现保存,具体代码如下:

8、 代码概览

9、 以上采用两种方法获取指定网页内容。

展开全文
人赞过该文 赞
内容纠错

相关电商优惠

评论

更多评论
还没有人评论~ 快来抢沙发吧~

读过此文的还读过

点击加载更多

内容相关产品

说点什么吧~ 0

发评论,赚金豆

收藏 0 分享
首页查报价问答论坛下载手机笔记本游戏硬件数码影音家用电器办公打印 更多

更多频道

频道导航
辅助工具