python爬虫xpath教程

python爬虫xpath教程

作者: 我爱学python | 来源:发表于2019-06-23 16:43 被阅读70次

python爬虫xpath教程
Python爬虫学习系列教程
Scrapyd部署爬虫
Python爬虫(十三)_案例：使用XPath的爬虫
爬虫实战1.3.2 页面解析之Xpath
2019-01-18srcrapy框架xpath和css选择器语
xpath 资料
python爬虫xpath的语法
资料
python网络爬虫-爬取网页的三种方式（2）

环境准备：

pycharm(撩妹神器，人手一个) lxml(python的三方库)

如果电脑里没有安装lxml的伙伴，可以安装一下，在控制台输入pip intall https://pypi.douban.com/simple lxml，

利用国外的源下载比较慢，我一般用国内的这个源下载，如果有更好的，欢迎各位留个脚印，么么哒

如果你输入pip show lxml出现像我这样的界面，咦咦咦，厉害了，说明你离走向爬虫大师，差的不是一心半点了

导入文件：

好的，既然这样，说搞就搞，小白们，扑上来吧，要那种纯小白的，哈哈

在pycharm里边新建一个py文件

然后引入requests（请求库），以及lxml里边的etree，如下图

我们先打开豆瓣图书的一个网址，网址是“https://read.douban.com/kind/100”，如下图所示

定位爬取：

现在要做的就是去爬取“三体全集”，“评分”以及“小说简介”这三个内容，可是怎么爬呢，那就要用到了xpath这个定位利器，用过的人都说好，他好我也好！ //坏笑，坏笑

1.首先利用request进行get请求：

2.然后我们利用请求回来的r.content进行解析

3.下面重点来了，我们解析后的数据进行打印

我们可以知道这个html对象的位置，下面我们就要利用xpath去进行定位

在豆瓣网阅读的网页，我们点击F12，然后点击控制台的箭头，点击一下页面上的三体全集，我们就可以找到该元素的位置了

在锁定位置点击右键，找到Copy,点击Copy Xpath，然后在pycharm进行定位打印

其中利用content调用xpath方法，里边写上刚才copy好的位置，后边加一个text()，然后进行取[0]，

然后运行一下，what fuck，出现了什么，三体全集被打印了，还TM的有这种操作，是在逗我吗！！

评分以及简介同样如此，如果我们想打印多个小说的这些属性，通过定位不难发现，他们是有规律的，我们可以进行循环赋值进行打印，这样就会出现如下所示

源码如下：

相关文章

python爬虫xpath教程
环境准备： pycharm(撩妹神器，人手一个) lxml(python的三方库) 如果电脑里没有安装lxml的...
Python爬虫学习系列教程
转自: 静觅»Python爬虫学习系列教程 Python爬虫学习系列教程 Python版本：2.7 一、爬虫入门 ...
Scrapyd部署爬虫
Scrapyd部署爬虫 Python 如何将字符串转为字典 Facebook 爬虫 Xpath string()提...
Python爬虫(十三)_案例：使用XPath的爬虫
本篇是使用XPath的案例，更多内容请参考:Python学习指南案例：使用XPath的爬虫现在我们用XPath...
爬虫实战1.3.2 页面解析之Xpath
本文转载：静觅 » [Python3网络爬虫开发实战] 4.1-使用XPath XPath，全称XML Path ...
2019-01-18srcrapy框架xpath和css选择器语
python 爬虫： srcrapy框架xpath和scc选择器语法 Xpath基本语法一、常用的路径表达式： ...
xpath 资料
xpath路径表达式笔记学爬虫利器XPath,看这一篇就够了有感4月份，看过的python基础和爬虫相关的知识...
python爬虫xpath的语法
python爬虫xpath的语法 https://www.cnblogs.com/lonenysky/p/4649...
资料
Python爬虫系列（一）初期学习爬虫的拾遗与总结（11.4更） Python爬虫学习系列教程 Python爬虫学习手册
python网络爬虫-爬取网页的三种方式（2）
还在用BeautifulSoup写爬虫？out了! 用lxml&xpath！从上一篇python网络爬虫-爬取网...

网友评论

本文标题：python爬虫xpath教程

本文链接：https://www.haomeiwen.com/subject/xdfwqctx.html

延伸阅读

深度阅读

您也可以注册成为美文阅读网的作者，发表您的原创作品、分享您的心情！

栏目导航

Python小哥哥

热点阅读

Python小哥哥

python

关于我们|服务条款|联系我们|python爬虫xpath教程|投稿指南|网站地图|RSS订阅|排版工具|手机版

提供经典美文摘抄,优美散文欣赏,现代诗歌精选,短篇小说,心情随笔,表白情书范文,故事会在线阅读欣赏

Copyright © 2014-2023 Haomeiwen.com All Rights Reserved. 好美文阅读网版权所有

备案信息：桂公网安备 45052102000051号 · 桂ICP备13007215号-3

本站所收录作品、热点评论等信息部分来源互联网，目的只是为了系统归纳学习和传递资讯

所有作品版权归原创作者所有，与本站立场无关，如不慎侵犯了你的权益，请联系我们告知，我们将做删除处理！