如何解决python写入html文件中乱码的现象(图文详解)

互联网 20-7-2

python写入html文件中文乱码问题

使用open函数将爬虫爬取的html写入文件,有时候在控制台不会乱码,但是写入文件的html中的中文是乱码的

案例分析

看下面一段代码:

# 爬虫未使用cookiefrom urllib import requestif __name__ == '__main__':     url = "http://www.renren.com/967487029/profile"      rsp = request.urlopen(url)      html = rsp.read().decode()    with open("rsp.html","w")as f:        # 将爬取的页面         print(html)         f.write(html)

解决方案

使用open方法的一个参数,名为encoding=” “,加入encoding=”utf-8”即可

# 爬虫未使用cookiefrom urllib import requestif __name__ == '__main__':     url = "http://www.renren.com/967487029/profile"      rsp = request.urlopen(url)      html = rsp.read().decode()    with open("rsp.html","w",encoding="utf-8")as f:        # 将爬取的页面         print(html)         f.write(html)

运行结果

感谢大家的阅读,希望大家收益多多。

本文转自: https://blog.csdn.net/qq_40147863/article/details/81746445

推荐教程:《python教程》

以上就是如何解决python写入html文件中乱码的现象(图文详解)的详细内容,更多内容请关注技术你好其它相关文章!

来源链接:
免责声明:
1.资讯内容不构成投资建议,投资者应独立决策并自行承担风险
2.本文版权归属原作所有,仅代表作者本人观点,不代表本站的观点或立场
标签: 乱码
上一篇:php获取远程图片并下载保存到本地的方法分析 下一篇:python是哪个国家的?

相关资讯