搜索

Python 教学

基本介绍

Python 学习导读 使用 Google Colab 使用 Anaconda 使用 Python 虚拟环境 Python 范例集锦

数据型别

变数 variable 变数 ( 全域、区域 ) 数字 number 文字与字串 string 文字与字串 ( 常用方法 ) 文字与字串 ( 格式化 ) 串列 list 串列 ( 常用方法 ) 元组/数组 tuple 字典 dictionary 集合 set

语法观念

缩排和注解 运算子 operator 逻辑判断 ( if、elif、else ) 逻辑判断 ( and 和 or ) 重复循环 ( for、while ) 例外处理 ( try、except ) 生成式 comprehension 对象类别 class 对象继承 inheritance 导入模组 import

函数操作

函数 function 匿名函数 lambda 递回 recursion 产生器 generator 装饰器 decorator 闭包 closure

内建函数&方法

输入与输出 数学计算 字串操作与转换 迭代对象转换 迭代对象操作 文件读写 ( open ) eval() 与 exec()

标准函数库&模组

随机数 random 数学 math 数学统计函数 statistics 时间与日期 datetime 时间处理 time 日历 calendar 使用正规表达式 re 文件操作 os 查找匹配文件 glob 压缩文件 zipfile 高阶文件操作 shutil 高效迭代器 itertools 容器数据型态 collections CSV 文件操作 JSON 文件操作 threading 多执行绪处理 concurrent.futures

网络爬虫

Python 网络爬虫导读 关于网络爬虫 破解反爬虫的方法 Requests 函数库 Beautiful Soup 函数库 Selenium 函数库 爬取 PTT 文章标题 自动下载 PTT 正妹图片 同时下载多张图片 同时下载多张宝可梦图片 爬取 CCTV 即时图像 爬取统一发票号码对奖 爬取空气质量指标 ( AQI ) 爬取气象预报 爬取现在天气 LINE Notify 雷达回波图 LINE Notify 即时地震信息 爬取台湾银行牌告汇率 爬取 Yahoo 股市即时股价 爬取 LINE TODAY 留言 批次下载 Pinterest 图片 登录 Mobile01 截图下载 Twitter 自动上传图文

网页服务与应用

Flask 函数库 使用 ngrok 服务 Google Cloud Functions 串接 Gmail 寄送电子邮件 读取 Google 试算表 写入 Google 试算表 上传 Google 云端硬盘 发送 LINE Notify 通知 使用 Dialogflow Dialogflow + Webhook 服务器串接 Dialogflow 串接 Firebase 数据库 (1) 串接 Firebase 数据库 (2) 串接 Firebase 数据库 (3) 使用 OpenAI ChatGPT ChatGPT + Firebase

LINE BOT 教学

LINE BOT 教学导读 ( 免程序 ) 建立 LINE 官方账号 ( 免程序 ) 主动推播消息 ( 免程序 ) 自动回复消息 ( 免程序 ) 建立图文选单 ( 免程序 ) 基本消息类型 建立 LINE Channel 设定 Colab 开发环境 建立并串接 Webhook 解析 LINE 的消息 自动回复消息 主动推播消息 建立图文选单 切换图文选单 发送样板消息 发送 Flex Message 使用 Requests 传送消息 使用 LINE URL Scheme 储存用户的图片或影片 串接 Email 传送图片或影片 串接 Google 云端硬盘 气象机器人 (1) 气象机器人 (2) 气象机器人 (3) 气象机器人 (4) 串接 Dialogflow (1) 串接 Dialogflow (2) 串接 Dialogflow (3) 串接 Dialogflow (4) 串接 OpenAI ChatGPT (1) 串接 OpenAI ChatGPT (2) 串接 OpenAI ChatGPT (3)

OpenCV 教学

OpenCV 教学导读 OpenCV 函数库 打开并显示图片 写入并储存图片 读取并播放影片 写入并储存影片 取得图像信息 旋转/翻转/改变尺寸 图像的几何变形 图像的色彩转换 绘制各种形状 图像加入文字 剪裁图像 调整对比和亮度 负片效果 图像模糊化 图像的叠加与相减 二值化黑白图像 图像的侵蚀与膨胀 图像边缘侦测 魔术棒填充颜色 图像遮罩 边缘羽化效果 马赛克效果 子母画面影片 万花筒影片效果 多画面延迟播放影片 搞笑全景影片合成效果 凸透镜效果 ( 鱼眼效果 ) 倒数计时自动拍照效果 线性渐层填色 合成半透明图片 将指定的颜色变透明 处理 gif 动画 影片转透明 gif 动画 辨识 QRCode 和 BarCode 扫描 QRCode 切换效果 侦测鼠标事件 鼠标选取自动马赛克 即时在影片中绘图 侦测键盘行为 加入滑杆 ( Trackbar ) 拍照上传 Google 云端硬盘

AI 图像辨识教学

AI 图像辨识教学导读 OpenCV 人脸侦测 OpenCV 人脸马赛克 OpenCV 五官侦测 OpenCV 汽车侦测 OpenCV 行人侦测 OpenCV 辨识不同人脸 OpenCV 单对象追踪 OpenCV 多对象追踪 OpenCV 抓取特定颜色 OpenCV 追踪并标记颜色 情绪辨识与年龄侦测 辨识微笑,拍照储存 使用 Mediapipe ( 新 ) Mediapipe 人脸侦测 ( 新 ) Mediapipe 人脸特征点侦测 ( 新 ) Mediapipe 手掌侦测 ( 新 ) 使用 Mediapipe ( 旧 ) Mediapipe 人脸侦测 ( 旧 ) Mediapipe 人脸网格 ( 旧 ) Mediapipe 手掌侦测 ( 旧 ) Mediapipe 姿势侦测 Mediapipe 全身侦测 Mediapipe 物体侦测 Mediapipe 人物去背 Mediapipe 手势辨识 辨识比中指,自动马赛克 用手指在影片中画图 手指擦除镜子雾气效果 即时合成搞笑橘子脸 Jupyter 安装 Tensorflow 使用 Teachable Machine 辨识剪刀、石头、布 辨识是否戴口罩 辨识手写数字

NumPy 教学

NumPy 教学导读 NumPy 函数库 数据型态 建立数组 读取数组 迭代数组 数组项目赋值 修改数组形状 修改数组项目 填充数组 分割数组 合并数组 数组排序 广播 搜索数组项目 算数计算 数学函数 随机数 字串操作处理

matplotlib 图表

matplotlib 教学导读 matplotlib 函数库 Figure 和 Axes Figure 参数设定 建立多个子图表 设定图表标签 设定座标轴位置 设定座标轴刻度文字 数据文字标记 加入颜色对照表 使用极座标系统 使用 3D 图表 图表显示中文 下载储存图表 显示图片 制作图表动画 ( 图表 ) 折线图 ( 图表 ) 散布图 ( 图表 ) 长条图 ( 图表 ) 圆饼图 ( 图表 ) 甜甜圈图 ( 图表 ) 等高线图 ( 图表 ) 阶梯折线图 ( 图表 ) 堆叠折线图 ( 图表 ) 堆叠长条图 ( 图表 ) 极座标长条图 ( 图表 ) 极座标散布图 ( 图表 ) 3D 柱状长条图 ( 图表 ) 3D 散布图

Tkinter 界面设计

建立 Tkinter 视窗 Label 标签 Button 按钮 Radiobutton 单选按钮 Checkbutton 复选按钮 Entry 单行输入框 Text 多行输入框 Listbox 列表选择框 OptionMenu 下拉选单 Scale 数值调整滑杆 Spinbox 数值调整元件 Frame 框架 LabelFrame 标签框架 Scrollbar 滚动条 Canvas 画布 Menu 选单 Messagebox 消息提示框 Photoimage 显示图片 ttk.Progressbar 进度条 ttk.Combobox 下拉选单 Pack 基本版面布局 Grid 格状版面布局 Place 位置版面布局 范例 - Label 制作时钟 范例 - 点击按钮开文件 范例 - 打开多个文件 范例 - 打开并压缩文件 范例 - 打开并显示图片 范例 - 调整图片亮度对比 范例 - 简单计算机 范例 - 发送 LINE Notify

PyQt5 界面设计

PyQt5 函数库 使用 Qt designer 建立 PyQt5 视窗 QLabel 标签 QPushButton 按钮 QRadioButton 单选按钮 QCheckBox 复选按钮 QGraphicsView 显示图片 QLineEdit 单行输入框 QTextEdit 多行输入框 QListWidget 列表选择框 QComboBox 下拉选单 QSpinBox 数值调整元件 QTimeEdit 时间调整元件 QDateEdit 日期调整元件 QSlider 数值调整滑杆 QProgressBar 进度条 QFileDialog 选择文件视窗 QMessageBox 对话视窗 QInputDialog 输入视窗 QMenuBar 视窗选单 QTimer 定时器 QThread 多执行绪 QtCore.pyqtSignal 信号传递 QtMultimedia 播放声音 QPainter 绘图 QPainter 绘图 ( QPen ) QPainter 绘图 ( 储存图片 ) QSS 样式设定 QWebEngineView 网页显示 Layout 布局 ( 垂直水平 ) Layout 布局 ( Grid 网格 ) Layout 布局 ( Form 表单 ) 侦测鼠标事件 侦测键盘与快速键组合 侦测与控制视窗 视窗中打开新视窗 显示图片的三种方法 显示 Matplotlib 图表 显示 Pillow 图片 显示 OpenCV 图片和影片 范例 - 世界时钟 范例 - 简单计算机 范例 - 储存文件为压缩档 范例 - 发送 LINE Notify 范例 - 电脑摄影机 范例 - 摄影机拍照录影 范例 - 简单录音机 范例 - 小画家 范例 - 打开图片转档储存 范例 - 调整图片亮度对比

PyQt6 界面设计

PyQt6 函数库 PyQt6 和 PyQt5 的差异 建立 PyQt6 视窗 QLabel 标签 QPushButton 按钮 QRadioButton 单选按钮 QCheckBox 复选按钮 QGraphicsView 显示图片 QLineEdit 单行输入框 QTextEdit 多行输入框 QListWidget 列表选择框 QComboBox 下拉选单 QSpinBox 数值调整元件 QTimeEdit 时间调整元件 QDateEdit 日期调整元件 QSlider 数值调整滑杆 QProgressBar 进度条 QFileDialog 选择文件视窗 QMessageBox 对话视窗 QInputDialog 输入视窗 QMenuBar 视窗选单 QTimer 定时器 QThread 多执行绪 QtCore.pyqtSignal 信号传递 QtMultimedia 播放声音 QPainter 绘图 QPainter 绘图 ( QPen ) QPainter 绘图 ( 储存图片 ) QSS 样式设定 QWebEngineView 网页显示 Layout 布局 ( 垂直水平 ) Layout 布局 ( Grid 网格 ) Layout 布局 ( Form 表单 ) 侦测鼠标事件 侦测键盘与快速键组合 侦测与控制视窗 视窗中打开新视窗 显示图片的三种方法 显示 Matplotlib 图表 显示 Pillow 图片 显示 OpenCV 图片和影片 范例 - 世界时钟 范例 - 简单计算机 范例 - 储存文件为压缩档 范例 - 发送 LINE Notify 范例 - 电脑摄影机 范例 - 摄影机拍照录影 范例 - 简单录音机 范例 - 小画家 范例 - 打开图片转档储存 范例 - 调整图片亮度对比

影音处理范例

批次图片转档 批次调整图片尺寸 调整图片亮度和对比 裁切与旋转图片 拼接多张图片 图片加上 logo 浮水印 图片加上文字浮水印 图片马赛克效果 图片模糊化 图片锐利化 读取与修改图片 Exif 图片转文字 ( OCR ) 读取声音信息、输出声音 声音剪辑与串接 声音音量调整 声音混合与反转 改变声音速度 播放声音 麦克风录音 合成音符声音 显示声波图形 影片转档 取出影片声音或加入声音 影片剪辑与合并 影片混合与排列显示 改变影片尺寸、旋转翻转 调整影片速度、倒转影片 调整影片亮度/对比/颜色 影片转 gif 动画 影片中加入文字 影片自动加上字幕 影片截图、图片转影片

实际应用范例

下载 Youtube 影片 下载 Youtube 清单影片 定时自动屏幕截图 LINE Notify 传送屏幕截图 建立 MJPEG 即时图像串流 批次重新命名文件 产生 QRCode 产生 BarCode 读取 PDF 内容 PDF 拆分/合并/插入/删除 读取 EXCEL 内容 写入数据到 EXCEL CSV 写入 EXCEL 读取电脑信息 侦测电脑屏幕分辨率 查询电脑对内对外 IP 查询网站 IP、ping IP 制作 MacOS app

基础范例

电费试算 摄氏/华氏转换 厘米/英寸换算 判断平年与闰年 找出不重复字元 找出中间的字元 去除中英文夹杂的空白 大乐透电脑选号 下载进度条 星号金字塔 数字金字塔 猜数字 ( 猜大猜小 ) 猜数字 ( 几 A 几 B ) 简单时钟 ( 世界时间 ) 计算 BMI 数值 计算年纪 ( 岁、月、天 ) 产生身份证字号 ( 随机 ) 检查身份证字号 统一发票对奖 罗马数字转换

数学范例

两个数字的四则运算 计算多个数字的总和 费波那契数列 九九乘法表 质因数分解 快速找出质数 最小公倍数 ( 多个数字 ) 最大公因数 ( 多个数字 )

ZeroJudge 解答

关于 ZeroJudge a001: 哈啰 a002: 简易加法 a003: 两光法师占卜术 a004: 文文的求婚 a005: Eva 的回家作业 a006: 一元二次方程序 a009: 解码器 a010: 因数分解 a013: 罗马数字 a015: 矩阵的翻转 a017: 五则运算 a020: 身份证检验 a021: 大数运算 a022: 回文 a024: 最大公因数(GCD) a034: 二进位制转换 a038: 数字翻转 a040: 阿姆斯壮数 a042: 平面圆形切割 a044: 空间切割 a053: Sagit's 计分程序 a054: 电话客服中心 a058: MOD3 a059: 完全平方和 a065: 提款卡密码 a095: 麦哲伦的阴谋 a104: 排序 a147: Print it all a148: You Cannot Pass?! a149: 乘乘乐 a215: 明明爱数数 a216: 数数爱明明 a224: 明明爱明明 a225: 明明爱排列 a244: 新手训练~for+if a248: 新手训练~数组应用 a263: 日期差几天 a271: 彩色萝卜 a291: nAnB problem a410: 解方程 a414: 比特运算之进位篇 a417: 螺旋矩阵 a524: 手机之谜 a528: 大数排序 a647: 投资专家 a693: 吞食天地 a738: 最大公约数 a746: 画蛇添足 a799: 正值国 a915: 二维点排序 b265: Conformity b294: 经济大恐荒 b367: 翻转世界 b374: 求众数 b511: 换铜板 b558: 求数列第 n 项 e267: Group Reverse d073: 分组报告 d294: 算算算 Easy d485: 我爱偶数 d827: 买铅笔

Selenium 函数库

selenium 函数库 ( 模组 ) 是使用 Python 进行网络爬虫时,必备的函数库之一,透过 selenium 可以模拟出用户在浏览器的所有操作行为 ( 点击按钮、输入账号密码、卷动卷轴...等 ),因此除了爬虫的应用,也常作为“自动化测试”使用的工具,在网站开发完成后,透过自动化的脚本测试所有功能是否正常,这篇教学将会介绍 selenium 函数库的常见用法,更多用法可前往阅读 selenium 官方文件。

执行 selenium 会启动 chromedriver,所以所以请使用本机环境 ( 参考:使用 Python 虚拟环境 ) 或使用 Anaconda Jupyter 进行实作 ( 参考:使用 Anaconda ) 。

快速导览:

安装 selenium 模组

在本机环境输入下列指令,就能安装 selenium 函数库 ( 依据每个人的作业环境不同,可使用 pip 或 pip3 或 pipenv,Anaconda Jupyter 的安装指令为 !pip )。

pip install selenium

什么是 Selenium WebDriver

WebDriver 是用来执行并操作浏览器的 API 界面,每一个浏览器都会有各自对应的驱动程序 ( driver ),Selenium 会透过 WebDriver 来直接对浏览器进行操作,将所支援的浏览器进行自动化作业,就如同真的用户在操作。

下载 WebDriver

不同的浏览器会对应不同的 driver,以下提供几种常见的 driver ( 本篇范例使用的是 Chrome ):

下载 Chrome driver 时请,必须下载对应的 Chrome 的版本,点击右上角选单“说明 > 关于 Google Chrome”,可以查看版本。

Python 教学 - Selenium 函数库

下载后将 driver 与执行的 Python 文件放在同一个目录下,就比较不需要烦恼执行时路径的问题。

Python 教学 - Selenium 函数库

import selenium

要使用 requests 必须先 import selenium 模组,启用 webdriver 的功能。

from selenium import webdriver

使用 WebDriver 打开第一个网页

selenium 与 driver 都安装与准备好之后,下方的程序码执行后,会打开一个新的 Chrome 视窗,里面出现指定的 Google 网页,此时这个新的 Chrome 视窗会标明“受到自动测试软件控制”,表示程序正在控制相关的操作。

webdriver.Chrome(路径) 使用相对路径 chromedriver 和执行的程序位在同一层。

from selenium import webdriver
driver = webdriver.Chrome('./chromedriver')    # 指向 chromedriver 的位置
driver.get('https://www.google.com')           # 打開瀏覽器,開啟網頁

Python 教学 - Selenium 函数库

取得网页元素

要模拟真人操作网页的第一步,就是要知道触碰了哪些网页元素,首先加载 selenium 的 By 模组,接着就能使用 find_element() 搭配参数设定,取得指定的网页元素,下方列出 find_element() 常用参数设定 ( 如果将方法的 element 改为 elements,会以串列方式回传找到的元素 ):

新版本 selenium 取得元素的方法有所变更,本文也一并更新,详细的方法参考:selenium.webdriver.remote.webelement

参数 说明
By.ID, id 透过 id,寻找第一个相符的网页元素。
By.CLASS_NAME, class 透过 class,寻找第一个相符的网页元素。
By.CSS_SELECTOR, css selector 透过 css 选择器,寻找第一个相符的网页元素。
By.NAME, name 透过 name 属性,寻找第一个相符的网页元素。
By.TAG_NAME, tag 透过 HTML tag,寻找第一个相符的网页元素。
By.LINK_TEXT, text 透过超链接的文字,寻找第一个相符的网页元素
By.PARTIAL_LINK_TEXT, text 透过超链接的部分文字,寻找第一个相符的网页元素。
By.XPATH, xpath 透过 xpath 的方式,寻找第一个相符的网页元素。

下方的程序会用 selenium 打开范例网址 ( 网址链接 ),打开后会用上述的方法,选取特定的网页元素,接着套用点击的方法,依序点击各个按钮,最后会连续打开两次 Google 网站。

范例网址已经有做过点击的处理,点击按钮或下拉选单切换时,上方空格会显示对应的文字。

from selenium import webdriver
from selenium.webdriver.common.by import By
from selenium.webdriver.support.select import Select   # 使用 Select 對應下拉選單
import time

driver = webdriver.Chrome('./chromedriver')
driver.get('https://example.oxxostudio.tw/python/selenium/demo.html')  # 開啟範例網址
a = driver.find_element(By.ID, 'a')                # 取得 id 為 a 的網頁元素 ( 按鈕 A )
b = driver.find_element(By.CLASS_NAME, 'btn')      # 取得 class 為 btn 的網頁元素 ( 按鈕 B )
c = driver.find_element(By.CSS_SELECTOR, '.test')  # 取得 class 為 test 的網頁元素 ( 按鈕 C )
d = driver.find_element(By.NAME, 'dog')            # 取得屬性 name 為 dog 的網頁元素 ( 按鈕 D )
h1 = driver.find_element(By.TAG_NAME, 'h1')        # 取得 tag h1 的網頁元素
link1 = driver.find_element(By.LINK_TEXT, '我是超連結,點擊會開啟 Google 網站')  # 取得指定超連結文字的網頁元素
link2 = driver.find_element(By.PARTIAL_LINK_TEXT, 'Google') # 取得超連結文字包含 Google 的網頁元素
select = Select(driver.find_element(By.XPATH, '/html/body/select'))   # 取得 html > body > select 這個網頁元素

a.click()        # 點擊 a
print(a.text)    # 印出 a 元素的內容
time.sleep(0.5)
b.click()        # 點擊 b
print(b.text)    # 印出 b 元素的內容
time.sleep(0.5)
c.click()        # 點擊 c
print(c.text)    # 印出 c 元素的內容
time.sleep(0.5)
d.click()        # 點擊 d
print(d.text)    # 印出 d 元素的內容
time.sleep(0.5)
select.select_by_index(2)  # 下拉選單選擇第三項 ( 第一項為 0 )
time.sleep(0.5)
h1.click()       # 點擊 h1
time.sleep(0.5)
link1.click()    # 點擊 link1
time.sleep(0.5)
link2.click()    # 點擊 link2
print(link2.get_attribute('href'))   # 印出 link2 元素的 href 屬性

Python 教学 - Selenium 函数库

Python 教学 - Selenium 函数库

操作网页元素

使用 Selenium 函数库操作网页元素下列几种方法:

方法 ActionChains 参数 说明
click() element 按下鼠标左键。
click_and_hold() element 鼠标左键按著不放。
double_click() element 连续按两下鼠标左键。
context_click() element 按下鼠标右键 ( 需搭配指定元素定位 )。
drag_and_drop() source, target 点击 source 元素后,移动到 target 元素放开。
drag_and_drop_by_offset() source, x, y 点击 source 元素后,移动到指定的座标位置放开。
move_by_offset() x, y 移动鼠标座标到指定位置。
move_to_element() element 移动鼠标到某个元素上。
move_to_element_with_offset() element, x, y 移动鼠标到某个元素的相对座标位置。
release() element 放开鼠标。
send_keys() values 送出某个键盘按键值。
send_keys_to_element() element, values 向某个元素发送键盘按键值。
key_down() value 按著键盘某个键。
key_up() value 放开键盘某个键。
reset_actions() 清除储存的动作 ( 实测没有作用,查讯后是 Bug )。
pause() seconds 暂停动作。
perform() 执行储存的动作。

要使用这些方法的方式有两种,第一种就是“针对指定元素呼叫方法”,例如上方例子的 click() 方法,只要针对指定的元素,呼叫指定的方法,就会执行对应的动作,第二种是使用“ActionChains”,将所有需要执行的方法串成“链”,全部完成后执行 perform() 执行所有的过程。

下方的程序使用“针对指定元素呼叫方法”。

from selenium import webdriver
from selenium.webdriver.common.by import By
from time import sleep

driver = webdriver.Chrome('./chromedriver')
driver.get('https://example.oxxostudio.tw/python/selenium/demo.html')
a = driver.find_element(By.ID, 'a')
add = driver.find_element(By.ID, 'add')
a.click()     # 點擊按鈕 A,出現 a 文字
sleep(1)
add.click()   # 點擊 add 按鈕,出現 數字 1
add.click()   # 點擊 add 按鈕,出現 數字 2
sleep(1)
add.click()   # 點擊 add 按鈕,出現 數字 3
sleep(1)
add.click()   # 點擊 add 按鈕,出現 數字 4

下方的程序使用“ActionChains”的方式,结果与上述的执行结果相同。

from selenium import webdriver
from selenium.webdriver.common.by import By
from selenium.webdriver.common.action_chains import ActionChains

driver = webdriver.Chrome('./chromedriver')
driver.get('https://example.oxxostudio.tw/python/selenium/demo.html')
a = driver.find_element(By.ID, 'a')
add = driver.find_element(By.ID, 'add')
actions = ActionChains(driver)   # 使用 ActionChains 的方式
actions.click(a).pause(1)        # 點擊按鈕 A,出現 a 文字後,暫停一秒
actions.double_click(add).pause(1).click(add).pause(1).click(add)
# 連點 add 按鈕,等待一秒後再次點擊,等待一秒後再次點擊
actions.perform()  # 執行儲存的動作

Python 教学 - Selenium 函数库

虽然“针对指定元素呼叫方法”看起来满直觉,但相对来说能使用的方法有限 ( 只能使用 click、send_keys...等两三种 ),使用“ActionChains”才能完整发挥所有的方法,下方的程序码执行后,会自动在输入框内输入指定的文字。

from selenium import webdriver
from selenium.webdriver.common.by import By
from selenium.webdriver.common.action_chains import ActionChains

driver = webdriver.Chrome('./chromedriver')
driver.get('https://example.oxxostudio.tw/python/selenium/demo.html')
a = driver.find_element(By.ID, 'a')
show = driver.find_element(By.ID, 'show')
actions = ActionChains(driver)
actions.click(show).send_keys(['1','2','3','4','5'])    # 輸入 1~5 的鍵盤值 ( 必須是字串 )
actions.pause(1)    # 等待一秒
actions.click(a)    # 點擊按鈕 A
actions.pause(1)    # 等待一秒
actions.send_keys_to_element(show, ['A','B','C','D','E'])   # # 輸入 A~E 的鍵盤值
actions.perform()   # 送出動作

Python 教学 - Selenium 函数库

取得网页元素的内容

Selenium 不仅能模拟真人去控制网页元素,也可以取得网页元素的相关内容,甚至进一步执行网页截图并储存的功能,常用的内容如下:

内容 说明
text 元素的内容文字。
get_attribute 元素的某个 HTML 属性值。
id 元素的 id。
tag_name 元素的 tag 名称。
size 元素的长宽尺寸。
screenshot 将某个元素截图并储存为 png。
is_displayed() 元素是否显示在网页上。
is_enabled() 元素是否可用。
is_selected() 元素是否被选取。
parent 元素的父元素。

下方的程序码执行后,会取得元素的 id、内容文字、tag 名称、尺寸和属性值,最后会将整张网页截图为 test.png。

from selenium import webdriver
from selenium.webdriver.common.by import By

driver = webdriver.Chrome('./chromedriver')
driver.get('https://example.oxxostudio.tw/python/selenium/demo.html')
body = driver.find_element(By.TAG_NAME, 'body')
a = driver.find_element(By.ID, 'a')
b = driver.find_element(By.CLASS_NAME, 'btn')
c = driver.find_element(By.CSS_SELECTOR, '.test')
d = driver.find_element(By.NAME, 'dog')
link1 = driver.find_element(By.LINK_TEXT, '我是超連結,點擊會開啟 Google 網站')
link2 = driver.find_element(By.PARTIAL_LINK_TEXT, 'Google')

print(a.id)
print(b.text)
print(c.tag_name)
print(d.size)
print(link1.get_attribute('href'))
print(link2.get_attribute('target'))
body.screenshot('./test.png')

Python 教学 - Selenium 函数库

搭配 JavaScript,发挥最大效益

Selenium 除了内建的方法,也可以搭网页的 JavaScript,发挥网页控制的最大效益,下方的程序码执行后,会先上下滚动网页卷轴,接着弹出提示视窗,两秒后再关闭提示视窗。

from selenium import webdriver
from selenium.webdriver.common.by import By
from selenium.webdriver.common.alert import Alert
from time import sleep

driver = webdriver.Chrome('./chromedriver')
driver.get('https://www.selenium.dev/selenium/docs/api/py/webdriver_remote/selenium.webdriver.remote.webelement.html')

sleep(1)
driver.execute_script('window.scrollTo(0, 500)')   # 捲動到 500px 位置
sleep(1)
driver.execute_script('window.scrollTo(0, 2500)')  # 捲動到 2500px 位置
sleep(1)
driver.execute_script('window.scrollTo(0, 0)')     # 捲動到 0px 位置

h1 = driver.find_element(By.TAG_NAME, 'h1')
h3 = driver.find_element(By.TAG_NAME, 'h3')
script = '''
  let h1 = arguments[0];
  let h3 = arguments[1];
  alert(h1, h3)
'''
driver.execute_script(script, h1, h3)   # 執行 JavaScript,印出元素
sleep(2)
Alert(driver).accept()    # 點擊提示視窗的確認按鈕,關閉提示視窗

参考数据

Selenium 函数库不仅能应用于自动化测试,对于爬虫的应用而言也是必备的函数库,下方列出 Selenium 的官方文件,如果要了解更详细的信息可以前往阅读:

意见反馈

微信二维码 微信扫码关注 抖音二维码 抖音扫码关注