web scraping
共收录 17 个与 web scraping 相关的 MCP Server 与 Agent Skill,均附安装命令、来源与热度数据,可直接复制到 Cursor、Claude Code 等客户端。
Playwright 网页抓取
v1.2.0
io.clawhub.waisimon/playwright-scraper-skill
基于 Playwright 的网页抓取技能,具备反爬对抗能力。已在 Discuss.com.hk 等复杂站点实测成功。
网页抓取 Web Scraping
v1.0.0
io.clawhub.zhangqixin9527/web-scraping
使用 web_fetch(简单页面)和浏览器自动化(动态站点、需登录流程、分页、无限滚动等)从网站提取结构化信息。
网页抓取器 Web Scraper
v0.1.1
io.clawhub.guifav/web-scraper
网页抓取与内容理解智能体——多策略提取带级联回退、新闻检测、样板内容移除、结构化元数据。
抓取 Scrape
v1.0.0
io.clawhub.ivangdavila/scrape
合法的网页抓取,具备 robots.txt 合规、限速和 GDPR/CCPA 感知的数据处理。
Scrapling 自适应爬虫
v1.0.8
io.clawhub.zendenho7/scrapling
具备反机器人绕过与爬虫式爬取的自适应网页抓取框架。
Reddit 抓取器
v1.0.0
io.clawhub.javicasper/reddit-scraper
通过抓取 old.reddit.com 阅读与搜索 Reddit 帖子。当 Clawdbot 需要浏览 Reddit 内容时使用:读取指定板块的帖子、搜索感兴趣的话题、监控特定社区。只读访问,不发帖不评论。
Scrapling 网页抓取
v1.0.0
io.clawhub.zhengxinjipai/scrapling-web-scraper
面向 OpenClaw 的零机器人检测网页抓取。绕过 Cloudflare、处理重 JavaScript 网站,并自动适应网站改版。当你需要……时使用。
Crawl4ai
v1.0.0
io.clawhub.codylrn804/crawl4ai
AI 驱动的网页抓取框架,用于从网站提取结构化数据。当 Codex 需要抓取、爬取或使用 AI 解析从网页提取数据、处理动态内容或应对复杂 HTML 结构时使用。
Firecrawler 网页抓取
v1.0.0
io.clawhub.capt-marbles/firecrawler
使用 Firecrawl API 抓取与爬取网页。以 markdown 获取页面内容、截图、抽取结构化数据、搜索网络、爬取文档站。当用户需要抓取某个 URL、获取网页最新信息、截取屏幕、从页面提取特定数据或爬取框架/库文档时使用。
Crawl4AI 网页抓取器
v1.0.1
io.clawhub.angusthefuzz/crawl-for-ai
基于本地 Crawl4AI 实例的完整网页抓取,支持 JavaScript 渲染,输出干净的 Markdown 或含链接与媒体的详细 JSON。
Firecrawl CLI
v1.0.0
io.clawhub.yash-kavaiya/firecrawl-cli
通过 Firecrawl CLI(firecrawl)进行网页抓取、爬取、搜索与浏览器自动化。适用于把 URL 抓取为 markdown/HTML、爬取整站... 等场景。
defuddle 网页正文提取
v1.0.0
io.clawhub.extrastu/defuddle
从 URL 或 HTML 中提取并清洗可读的文章正文、元数据与 Markdown,用于研究、笔记与网页抓取。
Bright Data 抓取
v1.0.0
io.clawhub.meirkad/bright-data
通过 Bright Data API 进行网页抓取与搜索。需要 BRIGHTDATA_API_KEY 与 BRIGHTDATA_UNLOCKER_ZONE。用于把任意网页抓取为 Markdown(绕过机器人检测与验证码),或搜索 Google 并获取结构化结果。
Actionbook 网页动作库
v0.1.1
io.clawhub.adcentury/actionbook
当需要与任何网站交互时使用——浏览器自动化、网页抓取、截图、表单填写、UI 测试、监控或构建 AI Agent。提供经过预验证的页面动作,附逐步说明与已测试的选择器。
Bits 浏览器自动化
v1.0.0
io.clawhub.robbiethompson18/bits
通过 Bits MCP 服务器控制浏览器自动化代理。运行网页抓取、表单填写、数据抽取或任何基于浏览器的自动化任务时使用。Bits 代理可导航网站、点击元素、填写表单、处理 OAuth 流程并抽取结构化数据。
Luma 活动管理
v2.1.1
io.clawhub.mariovallereyes/luma-event-manager
面向 Clawdbot 的 Luma 活动管理器——按主题或地点发现活动、发送 RSVP、查看嘉宾名单并同步到 Google 日历。无需 API 密钥(网页抓取),无需 Luma Plus 订阅。
XPR 网页抓取
v0.2.11
io.clawhub.paulgnz/xpr-web-scraping
抓取并提取单个或多个网页的干净文本、元数据与链接的工具,支持格式选项与链接过滤。