今天爬一个站,发现爬到的中文都是乱码,原因是pyspider内置的pyquery没有正确的解析目标站的编码,导致的解码失败,只需要自己在项目中转码一下即可。代码如下:
response.content = (response.content).decode('utf-8') #目标站是 utf-8 编码
今天爬一个站,发现爬到的中文都是乱码,原因是pyspider内置的pyquery没有正确的解析目标站的编码,导致的解码失败,只需要自己在项目中转码一下即可。代码如下:
response.content = (response.content).decode('utf-8') #目标站是 utf-8 编码
本文标题:pyspider爬网页出现中文乱码的解决办法
本文链接:https://www.haomeiwen.com/subject/qtcviftx.html
网友评论