实现自动化网页操作步骤
时间更新至, 二零二三年, 六月五日, 十一点, 四十五分, 三十秒 , 作者为安乐常。
这篇文章着重讲怎样达成自动化网页操作, 文中存有详尽的流程步骤以及代码示例, 对于我们的学习或者工作具备一定的助力, 有需求的朋友能够参照一下。
1 准备
推荐使用浏览器
1.1 安装程序包
激活虚拟环境,打开新的,输入以下代码:
python -m pip install selenium如下图所示,表示安装成功,版本为4.7.2
关闭虚拟环境,打开新的
1.2 引入函数模块
#引入time模块,实现延时 import time #引入selenium库中的webdriver模块,实现对网页的操作 from selenium import webdriver #引入By Class,辅助元素定位 from selenium.webdriver.common.by import By #引入ActionChains Class,辅助鼠标移动 from selenium.webdriver.common.action_chains import ActionChains2 实现2.1 打开网页
#打开谷歌浏览器 driver = webdriver.Chrome() #打开网页 driver.get('URL') #将URL替换为需要操作的网址2.2 元素定位
想要可以实现对于网页的控制, 那就务必得先去定位网页线上的元素, 通常大多讲的都是搜索的框子、选项以及按钮等这些标点符号。
4.超出0范围的版本进行了元素定位方式的更新, 这种更新需要借助函数, 函数用法的举例情况如下:
el = driver.find_element(By.NAME, "*")首先要获取元素的信息:
打开网页后,按F12,打开元素审查窗口
在窗口里, 点击那个被红框标记出来的图标, 然后呢, 就在页面当中去选择急需定位的元素, 就能够查看它的代码了。
通常而言, 可以用来定位的元素代码, 皆是从以input作为起始的部分开始的, 如下所展示的图示, 乃是关于搜索框的代码, 凭借这些代码, 能够从中提取出用于定位元素时所不可或缺的信息:
按照以下这些信息, 都能够定位元素, 不过务必要确保依据此信息能够做到唯一定位该元素。
By.*
NAME
name=“*”
=“*”
ID
id=“*”
=“*”
XPATH
Copy full XPath
倘若参照别的讯息没办法唯一确定该元素, 能够采用XPath定位, XPath的获取途径颇为特别, 要右键点击该代码行, 于下拉列表里挑选Copy full XPath, 如下方图片所展示。
2.3 元素控制
定位到元素后,可以进行下列操作,实现对元素的控制:
功能
click()
点击
(‘*’)
输入
clear()
清空
以输入文字为例,代码如下(*为需要输入的文字):
el.send_keys('*')如果在打开网页之际, 所要控制的元素并不处于可视范围以内, 那是需要通过滑动鼠标来进行定位的, 然而这是要借助于某种情况的, 不然的话就有可能会出现报错的情况: 找不到该元素。
ActionChains(driver).move_to_element(el).click().perform() el.click()上述示例为点击操作,其中第二行最好加上,确保点到该元素
存在另外一种会致使找不到元素的原因, 这种原因有可能是网页尚未完成加载, 在这样的情形下, 便能够借助延时功能。
time.sleep(1)2.4 弹出框的处理
若在点击按钮之后, 并非形成开启一个新页面的情况, 而是弹出了一回窗口, 并且此窗口需要在新的窗口当中进行操作, 那么这种状况下就得借助如下代码转向新的框架之下, 不然的话就极有可能出现报错: 无法找到该元素。
driver.switch_to.frame(0)随后继续按2.2定位元素即可。
就到这儿了, 关于达成自动化网页操作步骤的这篇文章, 这会儿要说的就这些了, 更多与之相关的自动化网页操作方面的内容, 倘若想要了解, 那就去搜索脚本之家以前所发布的文章, 或者接着浏览下面的相关文章, 期望大家往后能对脚本之家予以更多的支持!