美文网首页我爱编程
基于selenium和requests的京东商品爬虫

基于selenium和requests的京东商品爬虫

作者: AlanLau | 来源:发表于2017-10-06 22:32 被阅读46次
摄于 2017年10月4日 舟山嵊山岛
写了个京东爬虫,基于selenium和requests两个包相结合的,能抓取产品的标题、价格、评论数量、产品的url、产品前100条评论(需要抓取更多可以在代码里面改动)、产品的规格、产品介绍、产品售后信息。数据结合peewee存入sqlite数据库。先执行JD_model.py建立数据库,然后主程序入口JDcrawler.py。现检索词为“电缆线”。
代码github

相关文章

网友评论

    本文标题:基于selenium和requests的京东商品爬虫

    本文链接:https://www.haomeiwen.com/subject/xlzryxtx.html