Python3读取网页HTML代码，并保存在本地文件中

本文转载自查看原文 2017-11-01 14:41 16576 python/ html

旧版Python中urllib模块内有一个urlopen方法可打开网页，但新版python中没有了，新版的urllib模块里面只有4个子模块（error,request,response,parse),urlopen方法位于request子模块下。

urllib提供的功能就是利用程序去执行各种HTTP请求。如果要模拟浏览器完成特定功能，需要把请求伪装成浏览器。伪装的方法是先监控浏览器发出的请求，再根据浏览器的请求头来伪装，User-Agent头就是用来标识浏览器的。

1 # -*- coding: utf-8 -*-
2 from urllib import request
3 url = "http://www.cnblogs.com/sangern/p/7766247.html" #网页地址
4 wp = request.urlopen(url) #打开连接
5 content = wp.read() #获取页面内容
6 fp = open("test.htm","w+b") #打开一个文本文件
7 fp.write(content) #写入数据
8 fp.close() #关闭文件

免责声明！

本站转载的文章为个人学习借鉴使用，本站对版权不负任何法律责任。如果侵犯了您的隐私权益，请联系本站邮箱yoyou2525@163.com删除。

猜您在找 将网页html文件离线下载保存到本地的方法 Python脚本连接数据库读取特定字段保存在文件中 JAVA 获取网页源代码保存到本地文件性能测试，如何得到大量token，并保存在本地文件中 python抓取网页中图片并保存到本地 python文件读取和保存利用canvas将网页元素生成图片并保存在本地 HTML5拖拽——将本地文件拖拽到网页中显示 python3中OpenCV imwrite保存中文路径文件 c++从文件中读取一行数据并保存在数组中