python selenium API 常用方法
配置使用环境
下载相应的浏览器驱动, Firefox 是默认的
本文以 chrome 为主 ,放在scripts目录下
ChromeDriver 官方下载地址 : 所有版本的 ChromeDriver
文档参考
一份简单的测试 demo
关于 360 haosou.com
的测试 :
1 #coding=utf-8
2 from selenium import webdriver
3 import os
4 import time 5 # set little time stop and big time stop for viewing changes
6 little_time_stop = 1
7 big_time_stop = 2
8 # 默认广告条数
9 ads_num_require = 8
10 # 请求连接
11 req_url = "http://www.haosou.com/s?ie=utf-8&shb=1&src=360sou_newhome&q=%E9%B2%9C%E8%8A%B1"
12 # 打开浏览器
13
14 browser = webdriver.Chrome()
15 # 开始请求
16 17 browser.get(req_url)
18 # 获取所有的广告
19
20 all_ads_li = browser.find_elements_by_css_selector('#e_idea_pp li')
21 # 当前广告条数
22 ads_num_current = len(all_ads_li)
23 print "Has been got %d ads" %(ads_num_current)
24 # 如果广告条数与默认不符
25 if ads_num_current < ads_num_require:
26 print "The number of ads is not enough ( current : %d require: %d)" %(ads_num_current,ads_num_require)
27 # exit()
28 # 获取顶部连接
29 i = 0
30 for ads_li in all_ads_li:
31 time.sleep(big_time_stop)
32 i = i+1
33 print "ads %d :" %i
34 try:
35 main = ads_li.find_element_by_css_selector('h3 a')
36 except:
37 print "\tError: ads %d cann't find" %(i)
38 else:
39 print "\tReady: visit ads %d" %(i)
40 main.click()
41 print "\tSucess: visit ads %d" %(i)
42 time.sleep(little_time_stop)
43 try:
44 img_link = ads_li.find_element_by_class_name('e_biyi_img')
45 except:
46 print "\tError : no img in ads %d " %(i)
47 else:
48 print "\tReady : visit img_link %d" %(i)
49 img_link.click()
50 print "\tSuccess : visit img_link %d" %(i)
51 time.sleep(little_time_stop)
52 try:
53 child_div = ads_li.find_element_by_class_name('e_biyi_childLink');
54 except:
55 print "\tError : no child link in ads %d" %(i)
56 else:
57 try:
58 child_links = child_div.find_elements_by_css_selector('a')
59 except:
60 print "\tError : find child_links error"
61 else:
62 num_links = len(child_links)
63 print "\tSuccess : there are %d child_links" %(num_links)
64 j = 0
65 for child_a in child_links:
66 j = j + 1
67 print "\t\tReady : visit child link %d in ads %d" %(j, i)
68 child_a.click()
69 print "\t\tSuccess : visit child link %d in ads %d" %(j, i)
70 time.sleep(little_time_stop)
71 print "End and thanks for your using!"
72 # 下面代码选择取消注释
73 # 延时
74 # time.sleep(5)
75 # 关闭当前窗口
76 # browser.close()
77 # 关闭所有已经打开的窗口
78 # browser.quit()
定位操作
以下是所有定位操作的 API :
返回一个匹配元素, 即一个 WebElement 元素
find_element_by_id()
find_element_by_name()
find_element_by_class_name()
find_element_by_tag_name()
find_element_by_link_text()
find_element_by_partial_link_text()
find_element_by_xpath()
find_element_by_css_selector()
返回一个列表, 包含所有匹配的元素, 即一个 WebElement 列表
find_elements_by_id()
find_elements_by_name()
find_elements_by_class_name()
find_elements_by_tag_name()
find_elements_by_link_text()
find_elements_by_partial_link_text()
find_elements_by_xpath()
find_elements_by_css_selector()
使用的时候需注意下面几点 :
- python selenium 提供了两种对象 :
WebDriver
和WebElement
这两种对象都可以使用这些 API - 这些 API 一旦执行失败(即查找不到), 就会抛出异常
因此必须使用try: .. except: ...
机制避免错误的行为影响程序继续进行 WebDriver
调用以上 API 进行全局定位WebElement
调用以上 API 可以进行层级定位, 即查找当前元素的子元素
WebDriver 的使用
开始的时候必须要有初始化一个 WebDriver
实例, 即下面的 browser
用来对浏览器进行控制以及页面的访问
# 请求连接
req_url = "http://www.haosou.com/s?ie=utf-8&shb=1&src=360sou_newhome&q=%E9%B2%9C%E8%8A%B1"
# 打开浏览器
browser = webdriver.Chrome()
# 开始请求
browser.get(req_url)
接着, 就可以使用异常 API 进行当前页面的全局查找, 比如 :
# 获取所有的广告
all_ads_li = browser.find_elements_by_css_selector('#e_idea_pp li')
WebElement 的使用
使用
browser.find_element_by_xx()
得到的是一个WebElement
实例
使用获得的实例调用上面的 API 即可进行层级查找使用
browser.find_elements_by_xx()
得到的是一个元素是WebElement
实例的 list
通过对 list 的遍历, 即可对各个实例进行相应的操作
WebDriver 的一些常用操作
browser.curren_url
: 获取当前加载页面的 URLbrowser.close()
: 关闭当前窗口, 如果当前窗口是最后一个窗口, 浏览器将关闭browser.quit()
: 关闭所有窗口并停止 ChromeDriver 的执行browser.add_cookie(cookie_dict)
: 为当前会话添加 cookiebrowser.get_cookie(name)
: 得到执行 cookiebrowser.get_cookies()
: 得到所有的 cookiedriver.add_cookie({‘name’ : ‘foo’, ‘value’ : ‘bar’}) driver.add_cookie({‘name’ : ‘foo’, ‘value’ : ‘bar’, ‘path’ : ‘/’}) driver.add_cookie({‘name’ : ‘foo’, ‘value’ : ‘bar’, ‘path’ : ‘/’, ‘secure’:True})
browser.delete_all_cookies()
: 删除当前会话的所有cookiebrowser.delete_cookie(name)
: 删除指定 cookiebrowser.back()
: 相当于浏览器的后退历史记录browser.forward()
: 相当于浏览器的前进历史记录browser.execute_script(script, *args)
: 同步执行 js 脚本browser.execute_async_script(script, *args)
: 异步执行 js 脚本browser.get(url)
: 在当前窗口加载 urlbrowser.refresh()
: 刷新当前页面browser.current_window_handle
: 当前窗口的 handle, 相当于一个指针一样的东西, 用来指向当前窗口browser.window_handles
: 当前浏览器中的已经打开的所有窗口, 是一个 listbrowser.switch_to_window(window_handle)
: 切换 window_handle 指向的窗口browser.title
: 当前页面的 titlebrowser.name
: 当前浏览器的名字
WebElement 的一些常用操作
webEle.clear()
: 清楚元素的内容, 假如这个元素是一个文本元素webEle.click()
: 点击当前元素webEle,is_displayed()
: 当前元素是否可见webEle.is_enabled()
: 当前元素是否禁止, 比如经常会禁用一些元素的点击webEle.is_selected()
: 当前元素是否选中, 文本输入框的内容webEle.send_keys(*value)
: 向当前元素模拟键盘事件webEle.submit()
: 提交表单webEle.tag_name
: 当前元素的标签名webEle.text
: 当前元素的内容webEle.get_attribute(name)
: 获取当前元素执行属性的值
python selenium API 常用方法的更多相关文章
- Python Selenium Webdriver常用方法总结
Python Selenium Webdriver常用方法总结 常用方法函数 加载浏览器驱动: webdriver.Firefox() 打开页面:get() 关闭浏览器:quit() 最大化窗口: m ...
- python+selenium+API
一.浏览器操作 1.浏览器最大化 driver.maximize_window() #将浏览器最大化显示 2.设置浏览器宽.高 driver.set_window_size(480, 800)#设置浏 ...
- python selenium --一些常用方法
· text 获取该元素的文本 · submit 提交表单 · get_attribute 获得属性值 text 用于获取元素的文本信息 下面把百度首页底部的声明打印输出 #coding=u ...
- Selenium API常用方法
driver.findElements()//定位一组List元素集合 driver.findElement()//定位一个元素 driver.getTitle()//获取页面标题 driver.ge ...
- Python+Selenium笔记(十四)鼠标与键盘事件
(一) 前言 Webdriver高级应用的API,允许我们模拟简单到复杂的键盘和鼠标事件,如拖拽操作.快捷键组合.长按以及鼠标右键操作,都是通过使用webdriver的Python API 中的Ac ...
- Python+selenium常用方法(Webdriver API)
小编整理了目前学习的Python+selenium常用的一些方法函数,以后有新增再随时更新. 加载浏览器驱动: webdriver.Firefox() 打开页面:get() 关闭浏览器:quit() ...
- WEB自动化(Python+selenium)的API
在做Web自动化过程中,汇总了Python+selenium的API相关方法,给公司里的同事做了第二次培训,分享给大家 ...
- Selenium2+python自动化27-查看selenium API
前言 前面都是点点滴滴的介绍selenium的一些api使用方法,那么selenium的api到底有多少呢?本篇就叫大家如何去查看selenium api,不求人,无需伸手找人要,在自己电脑就有. p ...
- python+selenium自动化软件测试(第2章):WebDriver API
2.1 操作元素基本方法 前言前面已经把环境搭建好了,从这篇开始,正式学习selenium的webdriver框架.我们平常说的 selenium自动化,其实它并不是类似于QTP之类的有GUI界面的可 ...
随机推荐
- 修改mysql5.7数据表字符集编码的命令
查看表中字符集的命令 show variables like '%char%' 更改数据库中数据表的字符集靠谱命令,亲测可行,在workbench和phpmyadmin上都通过 alter table ...
- IPC 进程间通信方式——信号量
信号量 本质上是共享资源的数目,用来控制对共享资源的访问. 用于进程间的互斥和同步 每种共享资源对应一个信号量,为了便于大量共享资源的操作引入了信号量集,可对多对信号量一次性操作.对信号量集中所有的操 ...
- HDU-3374-String Problem(最小表示法, KMP)
链接: https://vjudge.net/problem/HDU-3374 题意: Give you a string with length N, you can generate N stri ...
- docker限制容器日志大小
1.新建/etc/docker/daemon.json,若有就不用新建了.添加log-dirver和log-opts参数,样例如下: # vim /etc/docker/daemon.json { & ...
- node 打包内存溢出 FATAL ERROR: Ineffective mark-compacts near heap limit Allocation failed - JavaScript heap out of memory
electron-vue加载了地图 openLayer后,打包就包内存溢出 解决办法: "build": "node --max_old_space_size=4096 ...
- 前端Web浏览器基于Flash如何实时播放监控视频画面(三)之使用ffmpeg‘推流’
本片文章只是起到抛砖引玉的作用,能从头到尾走通就行,并不做深入研究.为了让文章通俗易懂,尽量使用白话描述. 0x001: 下载ffmpeg 开源免费的推流软件有很多,这里以 ffmpeg 为例.ffm ...
- vue模板语法上集
模板语法上集 1.1 插值 1.1.1 文本 {{msg}} 1.1.2 html 使用v-html指令用于输出html代码 1.1.3 属性 HTML属性中的值应使用v-bind指令 1.1.4 表 ...
- [BJOI2015]树的同构 && 树哈希教程
题目链接 有根树的哈希 离散数学中对树哈希的描述在这里.大家可以看看. 判断有根树是否同构,可以考虑将有根树编码.而编码过程中,要求保留树形态的特征,同时忽略子树顺序的不同.先来看一看这个方法: 不妨 ...
- vue子组件改变父组件的值
1 在父组件的coment绑定事件 <template> <div :class="classObj" class="app-wrapper" ...
- Centos系统下载
在学习或者工作当中,难免会用到不同版本的CentOS镜像,下面就简单的介绍一下如何正确并快速的下载所需要的CentOS镜像. 一.官网下载 官网地址:https://www.centos.org/此种 ...