美文网首页虫虫
python如何伪装浏览器爬取网站

python如何伪装浏览器爬取网站

作者: 9ba4bd5525b9 | 来源:发表于2019-07-08 20:24 被阅读18次

有的网页在爬取时候会报错返回

urllib.error.HTTPError: HTTP Error 403: Forbidden

这是网址在检测连接对象,所以需要伪装浏览器,设置User Agent

在浏览器打开网页 ---> F12   ---> Network   ---> 刷新

然后选择一项 就是在 header 看到 User-Agent

User-Agent: Mozilla/5.0 (Windows NT 10.0; WOW64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/65.0.3325.181 Safari/537.36

相关文章

网友评论

    本文标题:python如何伪装浏览器爬取网站

    本文链接:https://www.haomeiwen.com/subject/mbxzhctx.html