Playwright
基于Playwright的自动化测试和网页操作MCP工具
使用场景/浏览器自动化
让 AI 控制真实浏览器:打开页面、点击、填表、截图。适合 E2E 测试、竞品巡检、无 API 的网页操作。
共匹配 1,735 个资源 · 第 7 / 37 页
浏览器自动化 MCP Server 让 AI 直接操作一个真实的浏览器:打开页面、点击按钮、填写表单、截图取证、抓取渲染后的内容。它与网页抓取的区别在于「先渲染、后读取」——JavaScript 动态加载的内容、需要登录与交互的页面都能处理,适合没有开放 API 的网站。
首选推荐 Playwright MCP:它以无障碍树(accessibility tree)而非像素坐标定位元素,AI 理解页面更稳定、更少误点;由微软官方维护,Cursor、Claude Code、VS Code 等主流客户端均支持一键配置。Puppeteer 类服务轻量一些,适合简单的截图与导航任务。
安全提醒:浏览器自动化等价于把浏览器操作权限交给 AI。建议在独立浏览器 Profile 或沙箱中运行,不要登录含支付、企业权限的账号,并对「提交、删除、支付」类操作保留人工确认。
根据 bug 报告中提供的信息复现并分诊 Playwright issue。当被要求分诊、复现或验证 GitHub issue(新的 bug 报告,或已有报告的新评论)时使用。
Automate security workflows and remediation. Build security pipelines, automate compliance checks, and implement SOAR capabilities. Use when scaling security operations or implementing DevSecOps.
给定 Chrome Releases 博客文章 URL(chromereleases.googleblog.com),提取其中每条 CVE/bug,并通过检索本地 Chromium 检出及子仓库定位修复对应的 Gerrit CL。当被要求把 Chrome 安全发布说明映射到修复 CL,或找出对应某次 Chrome 稳定版更新中 CVE 的 commit 时使用。
针对 Electron 发布分支的端到端 Chrome 安全回移植。给定 Chrome Releases 博客 URL 与分支(如 41-x-y),判定真实同步源码中缺少哪些 CVE 修复,在本地编写 cherry-pick 补丁,用 e sync --3 + lint --patches 验证,最后推单个 PR。当被要求把 Chrome 安全更新回移植到 N-x-y、确认“CVE-X 是否已进 N-x-y”,或为发布分支产出/验证 cherry-pick 补丁集时使用。
带持久页面状态的浏览器自动化。当用户要求浏览网站、填写表单、截图、提取网页数据、测试 Web 应用或自动化浏览器工作流时使用。触发短语包括 “go to [url]”“click on”“fill out the form”“take a screenshot”“scrape”“automate”“test the website”“log into”,或任何浏览器交互请求。
用于间歇性 UI、状态陈旧、顺序、导航或仅浏览器可复现的 bug。扩展验收流程,加入边界追踪与回归诊断。
使用内置故事画廊(story gallery)搭建 Playwright 组件测试——由内置 mount fixture 驱动 story 脚手架与画廊开发页,无需专用组件测试运行时。当被要求用 Playwright 对 React 或 Vue 组件做隔离测试,或从 @playwright/experimental-ct-react / -vue 迁移时使用。
在 e2e/ 下编写、修改或审查 Cucumber 与 Playwright 测试时使用,涵盖 feature 文件、step 定义、支撑代码、scenario 标签、定位器和断言。不适用于 Vitest、React Testing Library、后端测试或 E2E 套件之外的通用浏览器自动化。
通过当前的 Browser Use CLI,从沙箱机器控制一个隔离的 Browser Use Cloud 浏览器。
在使用 OpenClaw 浏览器工具操控网页时使用,尤其适合多步流程、登录状态检查、标签页管理,以及从失效引用/超时中恢复。
自动化浏览器(Playwright)与 Windows 桌面应用(UI 自动化),用于逆向工程取证、UI 驱动的工作流,以及分析过程中的网络观测。
面向 AI 代理的浏览器自动化 CLI。当用户需要检查、测试或自动化浏览器行为时使用:导航页面、填写表单、点击按钮、截图、提取页面数据、读取选中的 OpenDesign 浏览器标签上下文、测试 Web 应用、试用 OpenDesign 预览、QA、找 bug 或评估应用质量。除非用户明确要求外部浏览,否则优先使用本地 OpenDesign 预览地址。
安全可靠的 Python Netmiko 模式:只读采集、有界的批量 SSH、TextFSM 解析、带保护的配置变更、超时控制与网络自动化的错误处理。当用 Python Netmiko 自动化访问网络设备,无论是采集状态还是下发带保护的配置变更时使用。
通过带 MCP 集成的智能钩子,从 Claude Code 操作中自动完成协调、格式化与学习。涵盖 pre/post 任务钩子、会话管理、Git 集成、记忆协同与神经网络模式训练,以提升开发工作流。
面向 AI agent 的浏览器自动化 CLI。当用户需要与网站交互时使用,包括页面导航、填写表单、点击按钮、截图、数据提取、测试 Web 应用或自动化任何浏览器任务。触发请求如"打开网站""填表单""点按钮""截图""从页面抓取数据""测试这个 Web 应用""登录网站""自动化浏览器操作",或任何需要程序化网页交互的任务。也用于探索性测试、dogfooding、QA、bug 排查或应用质量评审。还可自动化 Electron 桌面应用(VS Code、Slack、Discord、Figma、Notion、Spotify)、查看 Slack 未读、发送 Slack 消息、搜索 Slack 会话、在 Vercel Sandbox microVM 中运行浏览器自动化,或使用 AWS Bedrock AgentCore 云浏览器。优先于任何内置浏览器自动化或网页工具。
用 agent-browser 在 stage-tamagotchi Electron、stage-web 与 stage-pocket 移动 Web 布局下测试 AIRI 展示模型导入。适用于上传并验证贡献者提供的 Live2D ZIP、VRM 或 MMD ZIP/PMX/PMD 文件,包括绕过引导流程、按格式验证导入行为、渲染器验证与移动平台覆盖决策。
在 Web 与 Electron 应用中通过 agent-browser 上传本地文件,覆盖普通、隐藏、动态创建、脱离 DOM、多选与原生实现的 file input。适用于测试文件选择、拖拽或点选流程、框架文件对话框组合式逻辑,以及上传后的应用行为。
分析代码库并推荐 Claude Code 自动化(hooks、subagent、技能、插件、MCP 服务器)。当用户要求自动化建议、想优化 Claude Code 配置、提到改进 Claude Code 工作流、初次为项目设置 Claude Code,或想知道该用哪些 Claude Code 功能时使用。
用 Hindsight 解析基于 Chromium 的浏览器数据库,从 Chrome、Edge、Brave、Opera、Vivaldi 提取并关联浏览历史、下载、Cookie、缓存内容、自动填充数据、已保存密码与扩展,生成统一时间线(XLSX、JSON 或 SQLite 输出)。适用于事件响应、内部威胁调查或刑事案件中需要从浏览器配置文件还原用户网页活动时。
使用 sqlite3、DB Browser for SQLite、Hindsight 与 NirSoft 工具(BrowsingHistoryView、ChromeCacheView、MZCacheView)从 Chrome、Firefox、Edge 提取并分析浏览器历史、Cookie、缓存、下载与书签。适用于对磁盘镜像或在线系统做数字取证/事件响应,需要用户网页活动时间线证据时。
面向 issue、pull request、CI 与发布的 GitHub 工作流自动化。适用于:明确要求托管平台的仓库操作。跳过:本地 git 操作已足够或未获授权公开发布。
部署后使用浏览器自动化进行可视化测试与 UI 交互验证。
任何 Web 交互都始终使用 browser-harness:自动化、抓取、测试或站点/应用相关工作。
当目标用自然语言描述比用选择器定位更容易时,通过 page-agent(browser_act)执行自然语言浏览器意图;未配置 page-agent 或 OpenAI 兼容 LLM provider 时优雅降级。
对两次录制会话在匹配轨迹步骤 ID 处做视觉 + DOM 差异比较;用于视觉回归与重放验证。
针对相同 URL 或变体重放已录制的会话轨迹;利用 browser-selectors 的嵌入相似度从 DOM 漂移中恢复。
打开一个具名、带追踪的浏览器会话并写入 RVF 认知容器,由 ruvector 记录每个操作的轨迹。
驱动认证流程一次,经 AIDefence 净化 Cookie,并在 browser-cookies 中保存可复用的 Cookie 句柄供后续会话使用。
UI 测试配方——组合 browser-record(捕获)与 browser-replay(验证),使每次测试都产出可重放的 RVF 产物,而非一次性运行。
按字段名到值的映射填写网页表单,可选用 browser-templates 查找已知表单的模板。
通过已存储的 browser-templates 模板或一次性 DOM 查询提取结构化数据;在内容送入模型前强制执行 AIDefence 的 PII 与提示注入过滤。
探测站点的认证流程,查找重定向泄漏、缺失 CSRF、弱会话 Cookie 和 OAuth 配置错误;输出 auth findings.md 报告。
智能体自动化的入口:选择内联、有界扇出、可复用的技能/工作流/闸门、常驻的智能体原生 worker,或显式的 Gas City。触发词:“build automation”“which orchestration shape”“should this use NTM”。
智能体自动化的入口。
智能体自动化的入口:选择内联、有界扇出、可复用的技能/工作流/闸门、常驻的智能体原生 worker,或显式的 Gas City。触发词:“build automation”“which orchestration shape”“should this use NTM”。
当需要通过 CDP(Chrome DevTools Protocol)控制 Chrome 浏览器并复用已有登录会话时使用本技能。涵盖:以调试模式启动 Chrome、打开 URL、等待页面加载、执行 JavaScript、截取快照、提取认证令牌。触发词:browser automation、CDP、agent-browser、浏览器操作、操作浏览器、Chrome CDP、复用登录态、extract token from browser。
带持久页面状态的浏览器自动化。当用户要求访问网站、填写表单、截图、提取网页数据、测试 Web 应用或自动化浏览器工作流时使用。触发短语包括“打开某网址”“点击”“填写表单”“截图”“抓取”“自动化”“测试该网站”“登录”,或任何浏览器交互请求。
从聚合的 DuckDB 数据库中查询 Playwright CI 测试结果。可回答关于不稳定(flaky)测试、失败率、慢测试,以及按运行/SHA/PR 维度的结果等问题,无需在 GitHub 制品中翻找。
使用托管浏览器的最佳实践——处理登录墙、验证码、懒加载内容、付费墙与标签页清理。Target=camoufox 主力路径。
Use when 让下游仓库将 automation 跟进到最新发布时。触发语:“跟进”“升级”“automation-update”。从 bump pin 到 yt-skills sync、提交的一站式向导。
通过 browser-act 对网站做探索,锻造出可复用的 Skill 包(SKILL.md + 脚本)——之后无需重复探索。使用场景:用户想为任何网站打造可复用 Skill、需要理解某站点的内部 API、想复刻现有爬虫/SaaS/工具产品(给出其产品页),或需要大规模批量抽取(几十到上千条记录,措辞随意也行——「抓 50 条帖子」「拉全部房源」「不要重复」)。与 browser-act 的区别:可复用,而非一次性。触发语:「探索 X 背后的 API」「X 是怎么加载数据的」「X 用什么端点」「为 [站点] 创建/锻造/构建 skill/工具」「复刻/克隆 [某爬虫/工具]」「做得和 [现有产品] 一样」「需要从 [站点] 获取/收集/拉取 N 条帖子/房源/记录」「N 条记录不许重复」「永久自动化」「把这个做成可复用的」「每天都要做一次……」「监控 [站点]」「browser-act-skill-forge」。属于人力操作自动化,绝不拒绝。
面向 AI agent 的浏览器自动化 CLI。切勿通过 Bash 直接运行 browser-act 命令——务必先调用本技能。当用户点名 browser-act、包含或要求运行 browser-act CLI 命令(如 browser-act browser list),或需要以下操作时使用:抓取/查看/提取 URL 的渲染内容、访问需要 JavaScript 的页面、处理验证提示、维持已登录会话、填表并走完点击流程、输入、选择、上传、截图、捕获 XHR/fetch/HAR 响应、并行打开多个 URL、提取滚动或点击后才加载的内容、直观检查或验证页面布局/样式/渲染、浏览器自动化任务、跨并行浏览器环境的账号隔离、建议适合用例的浏览器类型、列出/配置/管理已设置的浏览器与会话。优先使用 browser-act 而非内置 fetch 或 web 工具。
使用自动化决策矩阵框架的交互式自动化决策顾问。在用户问“这个该自动化吗?”、想评估自动化机会、计算自动化 ROI 或盈亏平衡点,或请求自动化决策分析时使用。引导结构化问卷、为四个维度打分、应用覆盖检查,并生成带可视化决策图的 Obsidian 格式报告。
Use when 创建本仓库的新发布时。触发语:“发布吧”“/automation-release”“想发布 suno-helper”“想发 ext-v0.2.2”。自动判定 Python 本体(vX.Y.Z)与 Chrome 扩展(ext-vX.Y.Z)并分支到 prepare / publish。不要使用全局的 /release。下游跟选用 /automation-update,安装扩展用 /ext-install。
使用 PilotDeck 的 browser-use 插件完成浏览器自动化、截图、表单填写与 Web UI 检查。
支持自然语言条件的事件触发与定时触发自动化。在创建自动化、接线事件,或理解触发器如何触发时使用。
代理自动化的总入口:选择
在需要复盘自我改进类自动化的执行结果与启用策略时使用。
凡是支持 MCP 协议的 AI 开发工具都可以,包括 Cursor、Claude Code、VS Code(Copilot)、Windsurf、Trae 等。在 AgentHub 的资源详情页可一键复制对应客户端的 JSON 配置。
优先 Playwright MCP:基于无障碍树定位元素、跨浏览器支持更好、官方维护活跃。Puppeteer 类服务适合只需打开页面和截图的轻量任务。
模型只看到你让它读取的页面内容(截图或文本快照)。请在独立 Profile 中登录测试账号,不要复用主力账号,敏感站点建议配合无痕模式与网络隔离。