美文网首页
py爬取的html中文乱码

py爬取的html中文乱码

作者: 魂_影__LHT | 来源:发表于2017-03-31 21:51 被阅读0次

    今天从美剧天堂爬取网页时,中文出现乱码,从网站代码看是Charest=gb2312,所以对爬取的html进行处理。

    html = unicode(html, "gb2312").encode("utf8")可得到正常的中文编码。

    相关文章

      网友评论

          本文标题:py爬取的html中文乱码

          本文链接:https://www.haomeiwen.com/subject/wdfbottx.html