Python爬虫Selenium库的详细用法

1524990177 • 08/04 16:08 • Linux技术 • 88 views

这篇文章主要介绍“Python爬虫Selenium库的详细用法”，在日常操作中，相信很多人在Python爬虫Selenium库的详细用法问题上存在疑惑，小编查阅了各式资料，整理出简单好用的操作方法，希望对大家解答”Python爬虫Selenium库的详细用法”的疑惑有所帮助！接下来，请跟着小编一起来学习吧！在我们爬取网页过程中，经常发现我们想要获得的数据并不能简单的通过解析HTML代码获取，这些数据是通过AJAX异步加载方式或经过JS渲染后才呈现在页面上显示出来。selenuim是一种自动化测试工具，它支持多种浏览器。而在爬虫中，我们可以使用它来模拟浏览器浏览页面，进而解决JavaScript渲染的问题。2.1 声明浏览器对象即告诉程序，应该使用哪个浏览器进行操作2.3 查找元素成功访问网页后，我们可能需要进行一些操作，比如找到搜索框然后输入关键字再敲击回车键。因此，就需要在selenium中查找元素。2.3.1 单个元素selenium查找元素有两种方法。第一种，是指定使用哪种方法去查找元素，比如指定依照CSS选择或者依照xpath去进行查找下面是详细的元素查找方法第二种，是直接使用find_element()，传入的第一个参数为需要使用的元素查找方法2.3.2 多个元素查找多个元素和查找单个元素的方法基本一致(只需要将查找单个元素的func里加一个s)。查找多个元素返回的是一个list。2.5 交互动作交互动作是将动作附加到交互链中串行执行，需要使用到ActionChains。2.6 执行JavaScript比如拖拽下拉2.8 Frame如果定位到父frame，是无法查找到子frame的信息的，因此需要切换到子frame再进行查找。同理，在子frame也无法查找到父frame的信息2.9.2 显式等待显示等待包含了等待条件和等待时间。首先判定等待条件是否成立，如果成立，则直接返回；如果条件不成立，则等待香港云主机最长时间为等待时间，如果超过等待时间后仍然没有满足等待等待条件，则抛出异常。显式等待是对指定的元素进行等待。2.11 对Cookies进行操作到此，关于“Python爬虫Selenium库的详细用法”的学习就结束了，希望能够解决大家的疑惑。理论与实践的搭配能更好的帮助大家学习，快去试试吧！若想继续学习更多相关知识，请继续关注开发云网站，小编会继续努力为大家带来更多实用的文章！

相关推荐: Spark Python操作命令三

12 数据格式[[u’3′, u’5′], [u’4′, u’6′], [u’4′, u’5′], [u’4′, u’2′]] 拆分或截取的原始数据，可以通过 map 中的 x[0], x[1] 来获取对应列的数据　　可以通过 map 来转换为key-val…

免责声明：本站发布的图片视频文字，以转载和分享为主，文章观点不代表本站立场，本站不承担相关法律责任；如果涉及侵权请联系邮箱：360163164@qq.com举报，并提供相关证据，经查实将立刻删除涉嫌侵权内容。