最新文章专题视频专题问答1问答10问答100问答1000问答2000关键字专题1关键字专题50关键字专题500关键字专题1500TAG最新视频文章推荐1 推荐3 推荐5 推荐7 推荐9 推荐11 推荐13 推荐15 推荐17 推荐19 推荐21 推荐23 推荐25 推荐27 推荐29 推荐31 推荐33 推荐35 推荐37视频文章20视频文章30视频文章40视频文章50视频文章60 视频文章70视频文章80视频文章90视频文章100视频文章120视频文章140 视频2关键字专题关键字专题tag2tag3文章专题文章专题2文章索引1文章索引2文章索引3文章索引4文章索引5123456789101112131415文章专题3
当前位置: 首页 - 科技 - 知识百科 - 正文

如何解决python写入html文件中乱码的现象(图文详解)

来源:懂视网 责编:小采 时间:2020-11-02 18:48:04
文档

如何解决python写入html文件中乱码的现象(图文详解)

如何解决python写入html文件中乱码的现象(图文详解):python写入html文件中文乱码问题使用open函数将爬虫爬取的html写入文件,有时候在控制台不会乱码,但是写入文件的html中的中文是乱码的案例分析看下面一段代码:# 爬虫未使用cookiefrom urllib import requestif __name__ == '
推荐度:
导读如何解决python写入html文件中乱码的现象(图文详解):python写入html文件中文乱码问题使用open函数将爬虫爬取的html写入文件,有时候在控制台不会乱码,但是写入文件的html中的中文是乱码的案例分析看下面一段代码:# 爬虫未使用cookiefrom urllib import requestif __name__ == '

python写入html文件中文乱码问题

使用open函数将爬虫爬取的html写入文件,有时候在控制台不会乱码,但是写入文件的html中的中文是乱码的

案例分析

看下面一段代码:

# 爬虫未使用cookiefrom urllib import requestif __name__ == '__main__':
 url = "http://www.renren.com/967487029/profile"

 rsp = request.urlopen(url)

 html = rsp.read().decode() with open("rsp.html","w")as f: # 将爬取的页面
 print(html)
 f.write(html)

看似没有问题,并且在控制台输出的html也不会出现中文乱码,但是创建的html文件中

ba7eb27c8a76a73427692c57650df14.png

解决方案

使用open方法的一个参数,名为encoding=” “,加入encoding=”utf-8”即可

# 爬虫未使用cookiefrom urllib import requestif __name__ == '__main__':
 url = "http://www.renren.com/967487029/profile"

 rsp = request.urlopen(url)

 html = rsp.read().decode() with open("rsp.html","w",encoding="utf-8")as f: # 将爬取的页面
 print(html)
 f.write(html)

运行结果

39353137a8f9ac7f0e3fac26e375b21.png

感谢大家的阅读,希望大家收益多多。

本文转自: https://blog.csdn.net/qq_40147863/article/details/81746445

推荐教程:《python教程》

文档

如何解决python写入html文件中乱码的现象(图文详解)

如何解决python写入html文件中乱码的现象(图文详解):python写入html文件中文乱码问题使用open函数将爬虫爬取的html写入文件,有时候在控制台不会乱码,但是写入文件的html中的中文是乱码的案例分析看下面一段代码:# 爬虫未使用cookiefrom urllib import requestif __name__ == '
推荐度:
标签: 乱码 解决 怎么
  • 热门焦点

最新推荐

猜你喜欢

热门推荐

专题
Top