请选择 进入手机版 | 继续访问电脑版
 找回密码
 立即注册
首页 社区 Python python里面request怎么读取html代码?

python里面request怎么读取html代码?

猿梦 2022-9-14 00:21:44
使用Python 3的requests模块抓取网页源码并保存到文件示例:import requestshtml = requests.get("")with open('test.txt','w',encoding='utf-8') as f:f.write(html.text)这是一个基本的文件保存操作,但这里有几个值得注意的问题:1.安装requests包,命令行输入pip install requests即可自动安装。很多人推荐使用requests,自带的urllib.request也可以抓取网页源码2.open方法encoding参数设为utf-8,否则保存的文件会出现乱码。3.如果直接在cmd中输出抓取的内容,会提示各种编码错误,所以保存到文件查看。4.with open方法是更好的写法,可以自动操作完毕后释放资源。另一个例子:import requestsff = open('testt.txt','w',encoding='utf-8')with open('test.txt',encoding="utf-8") as f:for line in f:ff.write(line)ff.close()这是演示读取一个txt文件,每次读取一行,并保存到另一个txt文件中的示例。因为在命令行中打印每次读取一行的数据,中文会出现编码错误,所以每次读取一行并保存到另一个文件,这样来测试读取是否正常。(注意open的时候制定encoding编码方式)
门锁孟山灵坚持下去·贫僧段沛白听懂~用python的parser方法解析,xpath方法。,

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册