爬虫

作者: 一笔春秋 | 来源:发表于2017-12-28 18:44 被阅读9次

1、Scrapy

安装Scrapy:

sudo pip install virtualenv

virtualenv scrapyenv

cd scrapyenv

source bin/activate

pip install Scrapy

文档:https://docs.scrapy.org/en/latest/intro/tutorial.html

2、使用urllib2和正则表达式实现

import urllib2

import re

response = urllib2.urlopen('http://www.baidu.com/')

html = response.read()

print(re.match('dev', html).span())

网友评论

本文标题：爬虫

本文链接：https://www.haomeiwen.com/subject/zbyvgxtx.html

备案信息：桂公网安备 45052102000051号 · 桂ICP备13007215号-3

本站所收录作品、热点评论等信息部分来源互联网，目的只是为了系统归纳学习和传递资讯

所有作品版权归原创作者所有，与本站立场无关，如不慎侵犯了你的权益，请联系我们告知，我们将做删除处理！