还不会用Python做爬虫？Selenium库超详细教程来了！

还不会用Python做爬虫？Selenium库超详细教程来了！

作者: Python一点通 | 来源:发表于2021-03-25 17:45 被阅读0次

还不会用Python做爬虫？Selenium库超详细教程来了！
Python爬虫Selenium库详细教程
python爬虫Selenium库详细教程
python爬虫Selenium库详细教程
python爬虫Selenium库详细教程
Python爬虫五大零基础入门教程
python标准库系列教程(四)——collections库
Django 创建第一个项目
python爬虫-selenium 的基本使用和常用API
6张脑图系统讲透python爬虫和数据分析、数据挖掘

在我们爬取网页过程中，经常发现我们想要获得的数据并不能简单的通过解析HTML代码获取，这些数据是通过AJAX异步加载方式或经过JS渲染后才呈现在页面上显示出来。

selenuim是一种自动化测试工具，它支持多种浏览器。而在爬虫中，我们可以使用它来模拟浏览器浏览页面，进而解决JavaScript渲染的问题。

1. 使用示例

2. 详细介绍

2.1 声明浏览器对象

即告诉程序，应该使用哪个浏览器进行操作

2.2 访问页面

2.3 查找元素

成功访问网页后，我们可能需要进行一些操作，比如找到搜索框然后输入关键字再敲击回车键。

因此，就需要在selenium中查找元素。

2.3.1 单个元素

selenium查找元素有两种方法。

第一种，是指定使用哪种方法去查找元素，比如指定依照CSS选择或者依照xpath去进行查找

下面是详细的元素查找方法

find_element_by_name

find_element_by_xpath

find_element_by_link_text

find_element_by_partial_link_text

find_element_by_tag_name

find_element_by_class_name

find_element_by_css_selector

第二种，是直接使用find_element()，传入的第一个参数为需要使用的元素查找方法

2.3.2 多个元素

查找多个元素和查找单个元素的方法基本一致(只需要将查找单个元素的func里加一个s)。

查找多个元素返回的是一个list。

2.4 元素交互操作

元素交互是先获取一个元素，然后对获取的元素调用交互方法。

比如说在搜索框内输入文字：

2.5 交互动作

交互动作是将动作附加到交互链中串行执行，需要使用到ActionChains。

2.6 执行JavaScript

比如拖拽下拉

2.7 获取元素信息

已经通过元素查找获取到元素后，可能还需要获取这个元素的属性、文本

2.7.1 获取属性

2.8 Frame

如果定位到父frame，是无法查找到子frame的信息的，因此需要切换到子frame再进行查找。同理，在子frame也无法查找到父frame的信息

2.9 等待

请求网页时，可能会存在AJAX异步加载的情况。而selenium只会加载主网页，并不会考虑到AJAX的情况。因此，使用时需要等待一些时间，让网页加载完全后再进行操作。

2.9.1 隐式等待

使用隐式等待时，如果webdriver没有找到指定的元素，将继续等待。超出规定时间后，如果还是没又找到指定元素则抛出找不到元素的异常。默认等待时间为0。

隐式等待是对整个页面进行等待。

需要特别说明的是：隐性等待对整个driver的周期都起作用，所以只要设置一次即可。

2.9.2 显式等待

显示等待包含了等待条件和等待时间。

首先判定等待条件是否成立，如果成立，则直接返回；如果条件不成立，则等待最长时间为等待时间，如果超过等待时间后仍然没有满足等待等待条件，则抛出异常。

显式等待是对指定的元素进行等待。

2.10 浏览器的前进/后退

back实现回到前一页面，forward实现前往下一页面

2.11 对Cookies进行操作

2.12 选项卡管理

选项卡管理就是浏览器的标签。有些时候我们需要在浏览器里增加一个新标签页或者删除一个标签页，就可以使用selenium来实现。

怎么样，大家学会了吗？更多爬虫资源可以参考：爬虫资源分享

https://shimo.im/docs/kTRXHYtJVDChyw8Y/

今天的分享就到这里了哦~

相关文章

还不会用Python做爬虫？Selenium库超详细教程来了！
在我们爬取网页过程中，经常发现我们想要获得的数据并不能简单的通过解析HTML代码获取，这些数据是通过AJAX异步加...
Python爬虫Selenium库详细教程
本文的文字及图片来源于网络,仅供学习、交流使用,不具有任何商业用途,如有问题请及时联系我们以作处理。以下文章来源...
python爬虫Selenium库详细教程
在我们爬取网页过程中，经常发现我们想要获得的数据并不能简单的通过解析HTML代码获取，这些数据是通过AJAX异步加...
python爬虫Selenium库详细教程
在我们爬取网页过程中，经常发现我们想要获得的数据并不能简单的通过解析HTML代码获取，这些数据是通过AJAX异步加...
python爬虫Selenium库详细教程
在我们爬取网页过程中，经常发现我们想要获得的数据并不能简单的通过解析HTML代码获取，这些数据是通过AJAX异步加...
Python爬虫五大零基础入门教程
教程一：Python爬虫学习系列教程这个博主的这个爬虫学习系列教程，很详细啊，从入门到实战、进阶等都有详细的文档...
python标准库系列教程(四)——collections库
python标准库系列教程(四)——collections库详细教程 python进阶教程机器学习深度学习进...
Django 创建第一个项目
python3之Django基础篇 python爬虫从入门到放弃（八）之 Selenium库的使用
python爬虫-selenium 的基本使用和常用API
python爬虫-selenium 的基本使用和常用API 注意:很多网站对selenium的webdriver做...
6张脑图系统讲透python爬虫和数据分析、数据挖掘
1、python爬虫：比较详细介绍了爬虫所需要具备的库、工具、爬虫基础知识 2、python爬虫流程 3、pyth...

网友评论

本文标题：还不会用Python做爬虫？Selenium库超详细教程来了！

本文链接：https://www.haomeiwen.com/subject/zwrrhltx.html

延伸阅读

深度阅读

您也可以注册成为美文阅读网的作者，发表您的原创作品、分享您的心情！

栏目导航

热点阅读

关于我们|服务条款|联系我们|还不会用Python做爬虫？Selenium库超详细教程来了！|投稿指南|网站地图|RSS订阅|排版工具|手机版

提供经典美文摘抄,优美散文欣赏,现代诗歌精选,短篇小说,心情随笔,表白情书范文,故事会在线阅读欣赏

Copyright © 2014-2023 Haomeiwen.com All Rights Reserved. 好美文阅读网版权所有

备案信息：桂公网安备 45052102000051号 · 桂ICP备13007215号-3

本站所收录作品、热点评论等信息部分来源互联网，目的只是为了系统归纳学习和传递资讯

所有作品版权归原创作者所有，与本站立场无关，如不慎侵犯了你的权益，请联系我们告知，我们将做删除处理！