如何解决python写入html文件中乱码的现象图文详解

python写入html文件中文乱码问题

使用open函数将爬虫爬取的html写入文件,有时候在控制台不会乱码,但是写入文件的html中的中文是乱码的

案例分析

看下面一段代码

# 爬虫未使用cookiefrom urllib import requestif __name__ == '__main__':
    url = http://www.renren.com/967487029/profile

    rsp = request.urlopen(url)

    html = rsp.read().decode()    with open(rsp.html,w)as f:        # 将爬取的页面
        print(html)
        f.write(html)

看似没有问题,并且在控制台输出的html也不会出现中文乱码,但是创建的html文件

ba7eb27c8a76a73427692c57650df14.png

解决方

使用open方法一个参数,名为encoding=” “,加入encoding=”utf-8”即可

# 爬虫未使用cookiefrom urllib import requestif __name__ == '__main__':
    url = http://www.renren.com/967487029/profile

    rsp = request.urlopen(url)

    html = rsp.read().decode()    with open(rsp.html,w,encoding=utf-8)as f:        # 将爬取的页面
        print(html)
        f.write(html)

运行结果

39353137a8f9ac7f0e3fac26e375b21.png


感谢大家的阅读,希望大家收益多多。

本文转自: https://blog.csdn.net/qq_40147863/article/details/81746445

推荐教程:《python教程

相关文章

在前一篇博客中我们介绍了加侧旋的乒乓球弧圈技术的模拟,本...
在近期conda的版本更新中,有可能会删除路径下的_sysconfigd...
本文主要展示了一些lambda表达式的使用示例,通过这些示例,...
本文通过对比Jax和Numpy计算Normalized Hamming Distance的过...
我们知道GPU加速在可并行化程度比较高的算法中,能够发挥出比...
Numpy这个库在Python编程中非常的常用,不仅在性能上补足了P...