使用 Playwright 进行浏览器自动化
Playwright 让您可以从 Python 中点击、输入文字并截取屏幕截图——这是控制无头浏览器的标准工具。
使用 Playwright 进行浏览器自动化 是 CoddyKit 上的免费 AI Agents 课时。 这是第 1 节课,共 4 节。 你可以在下方免费阅读本课时的完整内容 — 然后在浏览器中使用内置代码编辑器和全天候 AI 导师进行实践。 这是 AI Agents 学习路径的一部分,你的进度在网页和 CoddyKit 应用中同步。 AI Agents 课程共包含 4 节课。
本课时的部分内容尚未翻译,以英文显示。
Playwright 是事实标准
如果要从 Python 控制真实浏览器,Playwright 是事实标准。在大多数使用场景中,它取代了 Selenium。
Install
# pip install playwright
playwright install # downloads Chromium, Firefox, WebKitBasic Usage
from playwright.sync_api import sync_playwright
with sync_playwright() as p:
browser = p.chromium.launch(headless=True)
page = browser.new_page()
page.goto('https://example.com')
print(page.title())
browser.close()选择器
Playwright 支持 CSS、XPath 和文本选择器:
page.click('button.submit') # CSS
page.click('text=Submit') # text
page.click('role=button[name="Submit"]') # ARIAFilling Forms
page.fill('input[name="email"]', 'alice@example.com')
page.fill('input[name="password"]', 'secret')
page.click('button[type="submit"]')
page.wait_for_url('https://example.com/dashboard')等待元素
Playwright 会自动等待元素变得可见并可交互:
page.click('button.export')
page.wait_for_selector('text=Download Ready')
page.click('text=Download Ready')Reading Content
title = page.title()
body_text = page.inner_text('body')
href = page.get_attribute('a.download', 'href')Screenshots
page.screenshot(path='page.png')
page.locator('.header').screenshot(path='header.png')Full-Page Screenshot
page.screenshot(path='full.png', full_page=True)网络拦截
拦截广告和跟踪器,或模拟 API:
def block_ads(route):
if 'analytics' in route.request.url:
route.abort()
else:
route.continue_()
page.route('**/*', block_ads)Async API
from playwright.async_api import async_playwright
import asyncio
async def main():
async with async_playwright() as p:
browser = await p.chromium.launch()
page = await browser.new_page()
await page.goto('https://example.com')
await browser.close()
asyncio.run(main())浏览器上下文 = 一个会话
使用上下文隔离不同代理运行之间的 Cookie:
context = browser.new_context()
page = context.new_page()
# context.cookies, context.storage_state are isolated持久化存储
保存登录状态,以跳过重新认证:
context.storage_state(path='state.json')
# Later:
context = browser.new_context(storage_state='state.json')Tracing for Debugging
context.tracing.start(screenshots=True, snapshots=True)
# do stuff
context.tracing.stop(path='trace.zip')
# Open with: playwright show-trace trace.zip为什么选择 Playwright
Playwright 为什么比旧的浏览器自动化工具更好?
回顾
使用 Playwright 控制浏览器:安装、goto、click、fill、screenshot。这是任何浏览器代理的基础层。
常见问题解答
「使用 Playwright 进行浏览器自动化」课时是免费的吗?
是的 — 「使用 Playwright 进行浏览器自动化」的完整文本可在网页上免费阅读。要进行交互式练习(内置代码编辑器和全天候 AI 导师)并解锁 AI Agents 课程的其余内容,请升级到 CoddyKit PRO。 AI Agents 课程共包含 4 节课。
「使用 Playwright 进行浏览器自动化」这节课中我会学到什么?
Playwright 让您可以从 Python 中点击、输入文字并截取屏幕截图——这是控制无头浏览器的标准工具。 你通过在浏览器中直接运行的动手代码来练习 AI Agents,全天候 AI 导师会在你学习这节课的过程中回答你的问题。
学习 AI Agents 需要有经验吗?
无需任何先前经验。CoddyKit 上的 AI Agents 课程适合初学者到高级学习者,你可以从这里开始或从头开始,按照自己的节奏学习。 这是第 1 节课,共 4 节。
「使用 Playwright 进行浏览器自动化」课时需要多长时间?
大多数 CoddyKit 课程大约需要 5–10 分钟。每节课都很精短且互动,所以你能稳步进步,并在网页和应用中从离开的地方继续。
我能在这节 AI Agents 课中编写并运行代码吗?
能。每节 AI Agents 课都包含内置代码编辑器,你可以在浏览器中直接编写并运行真实代码,并获得即时 AI 反馈 — 无需本地设置。
此课程中的所有课时
- 使用 Playwright 进行浏览器自动化
- 用于屏幕理解的视觉模型
- 计算机使用模式(Anthropic Computer-Use)
- 构建可靠的表单填写代理