Python使用requests爬取一个网页并保存

本文转载自查看原文 2019-05-22 11:33 2124

#导入 requests模块
import requests
#设置请求头,让网站监测是浏览器
headers = {
'user-agent': 'Mozilla/5.0 (Windows NT 6.1; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/71.0.3573.0 Safari/537.36',
}
# 爬取网页的URL http://www.kdhj-edu.net/
r = requests.get('http://www.kdhj-edu.net/',headers=headers)
#获取当前编码 当前编码有utf-8 ISO-8859-1
print(r.encoding)
# 新建一个文件名 例如：TencentHtml 设置文件格式编码为 utf-8
# 注意文件格式的编码和 获取的编码 要一致，不然出现乱码问题
f = open("TencentHtml", "w",encoding="ISO-8859-1")
for i in r.text:
    #将数据写入文件
    f.write(i)
#关闭文件
f.close()

免责声明！

本站转载的文章为个人学习借鉴使用，本站对版权不负任何法律责任。如果侵犯了您的隐私权益，请联系本站邮箱yoyou2525@163.com删除。

猜您在找 【python】第一个爬虫：用requests库爬取网页内容 python爬取网页图片并保存到本地如何使用python爬取网页动态数据 python3使用requests爬取新浪热门微博 python 使用selenium和requests爬取页面数据 2、Python 使用Requests库通用爬取数据操作 Python爬取一个简单网页的HTML代码 Python requests 爬取淘宝商品数据，并连接数据库，保存数据 python 爬虫（一） requests+BeautifulSoup 爬取简单网页代码示例使用requests、re、BeautifulSoup、线程池爬取携程酒店信息并保存到Excel中