selenium快速入门

一、操作浏览器

python 复制代码
from selenium import webdriver
from selenium.webdriver.chrome.options import Options
from selenium.webdriver.chrome.service import Service
from selenium.webdriver.common.by import By

# 设置选项
q1 = Options()
q1.add_argument("--no-sandbox")
q1.add_experimental_option("detach", True)

# 创建并启动浏览器
a1 = webdriver.Chrome(service=Service(r"浏览器驱动的地址"), options=q1)

# 使用浏览器打开指定的网页
a1.get("http://baidu.com/")

二、元素定位

元素定位有两个函数:find_element() 和 find_elements()

find_element():在网页中找出首个符合指定条件的元素(找到的话返回结果,找不到的话报错)

find_elements():在网页中找出所有符合指定条件的元素(找到的话返回列表形式,找不到的话返回空列表)

1.ID

python 复制代码
# 示例
a1.get("http://baidu.com/")
a1.find_element(By.ID, "kw").send_keys("nihao")

(1) 通过ID定位元素,一般比较准确

(2) 并不是所有网页或者元素都有ID值

(3) send_keys()函数是在输入框中输入文字

2.NAME

python 复制代码
# 示例
a1.get("http://baidu.com/")
a1.find_element(By.NAME, "wd").send_keys("nihao")

(1) 通过NAME定位元素,一般比较准确

(2) 并不是所有网页或者元素都有NAME值

3.CLASS_NAME

python 复制代码
# 示例1
a1.get("http://baidu.com/")
a1.find_element(By.CLASS_NAME, "s_ipt").send_keys("nihao")

# 示例2
a1.get("https://bilibili.com/")
a1.find_elements(By.CLASS_NAME, "channel-icons__item")[1].click()

(1) class值不能有空格,否则会报错

(2) class值重复的有很多,需要切片 console -> document.getElementsByClassName()

(3) class值有的网站是随机的

4.TAG_NAME

python 复制代码
# 示例
a1.get("https://baidu.com")
a1.find_elements(By.TAG_NAME, "input")[7].send_keys("tag")

(1) 查找<开头标签名字>

(2) 重复的标签名字特别多,需要切片

python 复制代码
# 示例
a1.get("https://baidu.com/")
a1.find_element(By.LINK_TEXT, "新闻").click()

(1) 通过精确链接文本找到标签a的元素

(2) 如果有重复的文本,则需要切片

python 复制代码
# 示例
a1.get("https://bilibili.com/")
a1.find_element(By.PARTIAL_LINK_TEXT, "音").click()

(1) 通过精确链接文本找到标签a的元素[模糊文本定位]

(2) 如果有重复的文本,则需要切片

7.CSS_SELECTOR

python 复制代码
# 示例
a1.get("https://baidu.com/")
# (1) #id = # + id -> 通过ID定位
a1.find_element(By.CSS_SELECTOR, "#kw").send_keys("css")
# (2) .class = . + class -> 通过CLASS定位
a1.find_element(By.CSS_SELECTOR, ".s_ipt").send_keys("css")
# (3) 不加修饰符 = 标签头 -> 通过TAG_NAME定位
a1.find_elements(By.CSS_SELECTOR, "input")[7].send_keys("css")
# (4) 通过任意类型定位:"[类型='精确值']"
a1.find_element(By.CSS_SELECTOR, "[autocomplete='off']").send_keys("css")
# (5) 通过任意类型定位:"[类型*='模糊值']"
a1.find_element(By.CSS_SELECTOR, "[autocomplete*='of']").send_keys("css")
# (6) 通过任意类型定位:"[类型^='开头值']"
a1.find_element(By.CSS_SELECTOR, "[autocomplete^='o']").send_keys("css")
# (7) 通过任意类型定位:"[类型$='结尾值']"
a1.find_element(By.CSS_SELECTOR, "[autocomplete$='f']").send_keys("css")
# (8) 直接复制:Copy -> Copy selector
a1.find_element(By.CSS_SELECTOR, "#hotsearch-content-wrapper > li:nth-child(1) > a > span.title-content-title").click()

(1) #id = # + id -> 通过ID定位

(2) .class = . + class -> 通过CLASS定位

(3) 不加修饰符 = 标签头 -> 通过TAG_NAME定位

(4) 通过任意类型定位:"[类型='精确值']"

(5) 通过任意类型定位:"[类型*='模糊值']"

(6) 通过任意类型定位:"[类型^='开头值']"

(7) 通过任意类型定位:"[类型$='结尾值']"

(8) 直接复制:Copy -> Copy selector

8.XPATH

python 复制代码
# 示例
a1.get("https://baidu.com/")
# Copy -> Copy XPath
a1.find_element(By.XPATH, '//*[@id="s-top-left"]/a[1]').click()
# Copy -> Copy full XPath
a1.find_element(By.XPATH, '/html/body/div[1]/div[1]/div[3]/a[1]').click()

(1) 直接复制:Copy -> Copy XPath

(2) 直接复制:Copy -> Copy full XPath

相关推荐
萧曵 丶8 分钟前
Rust 所有权系统:深入浅出指南
开发语言·后端·rust
xiaolang_8616_wjl12 分钟前
c++文字游戏_闯关打怪2.0(开源)
开发语言·c++·开源
夜月yeyue18 分钟前
设计模式分析
linux·c++·stm32·单片机·嵌入式硬件
收破烂的小熊猫~20 分钟前
《Java修仙传:从凡胎到码帝》第四章:设计模式破万法
java·开发语言·设计模式
kfepiza43 分钟前
Debian的`/etc/network/interfaces`的`allow-hotplug`和`auto`对比讲解 笔记250704
linux·服务器·网络·笔记·debian
蹦蹦跳跳真可爱5891 小时前
Python----OpenCV(图像増强——高通滤波(索贝尔算子、沙尔算子、拉普拉斯算子),图像浮雕与特效处理)
人工智能·python·opencv·计算机视觉
nananaij1 小时前
【Python进阶篇 面向对象程序设计(3) 继承】
开发语言·python·神经网络·pycharm
雷羿 LexChien1 小时前
从 Prompt 管理到人格稳定:探索 Cursor AI 编辑器如何赋能 Prompt 工程与人格风格设计(上)
人工智能·python·llm·编辑器·prompt
阿蒙Amon1 小时前
为什么 12 版仍封神?《C# 高级编程》:从.NET 5 到实战架构,进阶者绕不开的必修课
开发语言·c#