这篇文章给大家分享的是有关selenium怎么处理iframe作用域问题的内容。小编觉得挺实用的,因此分享给大家做个参考,一起跟随小编过来看看吧。在使用python进行爬虫操作的过程中,一般为了防止爬虫,会使用iframe,但是由于ifra
这篇文章给大家分享的是有关selenium怎么处理iframe作用域问题的内容。小编觉得挺实用的,因此分享给大家做个参考,一起跟随小编过来看看吧。
在使用python进行爬虫操作的过程中,一般为了防止爬虫,会使用iframe,但是由于iframe有限制,iframe是前端内嵌页面,访问域名与主网页不同,所以有时会得到不自己想要的数据。本文针对抓包工具定位没有定位到iframe中的小的html中提供解决方法。
以文本块生成xpath为/html/body/text(),根据xpath进行如下代码编写。
#!/user/bin/# -*- coding:UTF-8 -*-# Author:Masterfrom selenium import WEBdriverimport timedriver = webdriver.Chrome(executable_path="./chromedriver")driver.get('https://www.runoob.com/try/runcode.PHP?filename=HelloWorld&type=python3')time.sleep(2)text = driver.find_element_by_xpath('/html/body').textprint(text)time.sleep(5)driver.quit()
得到结果
原因分析
当我们打开抓包工具定位到Hello, World!文本的时候会发现,该文本是在一个iframe中。这样的话我们xpath所定位到的内容则是大的html中的路径。我们需要的内容则是在iframe中的小的html中。
解决方法
通过分析发现,想要解决问题的实质就是改变作用域。通过switch_to.frame(‘id’)方法来改变作用域就可以了。
重新编写代码:
#!/user/bin/# -*- coding:UTF-8 -*-# Author:Masterfrom selenium import webdriverimport timedriver = webdriver.Chrome(executable_path="./chromedriver")driver.get('Https://www.runoob.com/try/runcode.php?filename=HelloWorld&type=Python3')time.sleep(2)driver.switch_to.frame('iframeResult')text = driver.find_element_by_xpath('/html/body').textprint(text)time.sleep(5)driver.quit()
运行结果
感谢各位的阅读!关于“selenium怎么处理iframe作用域问题”这篇文章就分享到这里了,希望以上内容可以对大家有一定的帮助,让大家可以学到更多知识,如果觉得文章不错,可以把它分享出去让更多的人看到吧!
--结束END--
本文标题: selenium怎么处理iframe作用域问题
本文链接: https://lsjlt.com/news/272666.html(转载时请注明来源链接)
有问题或投稿请发送至: 邮箱/279061341@qq.com QQ/279061341
2024-05-24
2024-05-24
2024-05-24
2024-05-24
2024-05-24
2024-05-24
2024-05-24
2024-05-24
2024-05-24
2024-05-24
回答
回答
回答
回答
回答
回答
回答
回答
回答
回答
0