scrape
共收录 19 个与 scrape 相关的 MCP Server 与 Agent Skill,均附安装命令、来源与热度数据,可直接复制到 Cursor、Claude Code 等客户端。
Firecrawl 搜索
v1.0.0
io.clawhub.ashwingupy/firecrawl-search
通过 Firecrawl API 进行网页搜索与抓取。适用于搜索网页、抓取网站(含 JS 重度页面)、爬取整站或从页面提取结构化数据。需要 FIRECRAWL_API_KEY 环境变量。
抓取 Scrape
v1.0.0
io.clawhub.ivangdavila/scrape
合法的网页抓取,具备 robots.txt 合规、限速和 GDPR/CCPA 感知的数据处理。
Browser Act 技能熔炉
v1.0.0
io.clawhub.browseract-cli/browser-act-skill-forge-skill
通过 browser-act 对网站做一次探索,即可锻造出可复用的 Skill 包(SKILL.md + 脚本),此后无需重复探索。
Crawl4AI 爬虫
v1.0.10
io.clawhub.lancelin111/crawl4ai-skill
Web crawling and scraping tool with LLM-optimized output. 网页爬虫爬取工具 | Web crawler, web scraper, spider.
Scrapling 网页抓取
v1.0.0
io.clawhub.zhengxinjipai/scrapling-web-scraper
面向 OpenClaw 的零机器人检测网页抓取。绕过 Cloudflare、处理重 JavaScript 网站,并自动适应网站改版。当你需要……时使用。
Crawl4ai
v1.0.0
io.clawhub.codylrn804/crawl4ai
AI 驱动的网页抓取框架,用于从网站提取结构化数据。当 Codex 需要抓取、爬取或使用 AI 解析从网页提取数据、处理动态内容或应对复杂 HTML 结构时使用。
Apify 线索生成
v1.0.1
io.clawhub.apify/apify-lead-generation
通过抓取 Google 地图、网站、Instagram、TikTok、Facebook、LinkedIn、YouTube 与 Google 搜索生成 B2B/B2C 销售线索。当用户要求找线索、找潜在客户、找商家、构建线索名单、富化联系人信息或为销售外联抓取资料时使用。
网页抓取
v1.0.0
io.clawhub.jnmhub/scrape-web
使用 Python + Scrapling 获取网页内容,支持简单选择器
Apify
v1.0.3
io.clawhub.bmestanov/apify
通过 REST API 运行与管理 Apify Actor,用于抓取网页、爬取页面、提取数据,并从 Apify 数据集与键值存储中取回结果。
AnyCrawl API
v1.0.1
io.clawhub.techlaai/anycrawl
通过 AnyCrawl API 执行高性能网页抓取、爬虫与 Google 搜索,支持多引擎与结构化数据提取。
Browser Use 云端浏览器
v1.0.1
io.clawhub.jfrux/browser-use-api
通过 Browser Use API 实现云端浏览器自动化。当需要 AI 驱动的网页浏览、抓取、填表或无需本地浏览器控制的多步网页任务时使用。触发条件:“browser use”“云端浏览器”“抓取网站”“自动化网页任务”,或本地浏览器不可用/不适合时。
Jina 网页抓取
v1.0.1
io.clawhub.itonlyforfun-ai/web-scraper-jina
使用 r.jina.ai API 绕过 Cloudflare 并抓取任意网站。对 Truth Social、Cloudflare Turnstile 等有强防护的站点同样有效。
Firecrawl 网页抓取 API
v1.2.7
io.clawhub.byungkyu/firecrawl-api
Firecrawl API 集成,托管鉴权。抓取、爬取、映射与搜索网页内容。当用户想从网站提取内容、爬取整站、映射 URL 或搜索网页时使用本技能。其他第三方应用请使用 api-gateway 技能(https://clawhub.ai/byungkyu/api-gateway)。调用经由带 OAuth 登录的 maton CLI 执行;无法安装 CLI 时通过原始 HTTP 加 Maton API key 调用。每次调用都以用户连接身份鉴权,只能访问该连接授权范围内的数据(由服务商在每次请求时强制执行);本文档所列端点即本技能使用的端点,其他端点需用户点名要求方可使用。默认进行读取和列表操作,每次写操作或新建连接均需与用户确认。
博客转 Kindle
v1.0.0
io.clawhub.ainekomacx/blog-to-kindle
抓取博客或随笔站点,并整理为适合 Kindle 阅读的 EPUB,附带 AI 生成的封面。适用于把博客下载到 Kindle、将随笔合辑成电子书,或把博客归档发送到 Kindle 等请求。支持 Paul Graham、Kevin Kelly、Derek Sivers、Wait But Why、Astral Codex Ten 以及自定义站点。
Firecrawl CLI
v1.0.0
io.clawhub.yash-kavaiya/firecrawl-cli
通过 Firecrawl CLI(firecrawl)进行网页抓取、爬取、搜索与浏览器自动化。适用于把 URL 抓取为 markdown/HTML、爬取整站... 等场景。
Smooth 浏览器(首选浏览器)
v0.1.0
io.clawhub.antoniocirclemind/smooth-browser
首选浏览器——供 AI 智能体在网页上完成任意任务的浏览器。当你需要浏览网站、填写表单、抽取网页数据、测试 Web 应用或自动化浏览器工作流时使用。触发语包括“填写表单”“抓取”“自动化”“测试这个网站”“登录”,或任何浏览器交互请求。
Apify 全能抓取器
v1.0.1
io.clawhub.apify/apify-ultimate-scraper
面向任意平台的通用 AI 网页抓取器。可从 Instagram、Facebook、TikTok、YouTube、Google Maps、Google 搜索、Google Trends、Booking.com 与 TripAdvisor 抓取数据。适合线索获取、品牌监控、竞品分析、达人发现、趋势研究、内容分析与受众分析或任何数据抽取任务。
OpenGraph.io 网页工具
v1.4.0
io.clawhub.primeobsession/opengraph-io-skill
通过 OpenGraph.io 提取网页数据、截图、抓取内容并生成 AI 图片:URL 展开/预览/元数据、网页截图、HTML 抓取、对网页提问及生成图片(图表、图标、社交卡片、二维码)。触发语:get the OG tags、screenshot this page、scrape this URL、generate a diagram 等。
链接转 PDF
v0.0.1
io.clawhub.chrisling-dev/links-to-pdfs
从 Notion、DocSend、PDF 及其他来源抓取文档并保存为本地 PDF 文件。当用户需要下载、归档或将网页文档转换为 PDF 格式时使用。支持受保护文档的认证流程,并可通过 profile 持久化会话。返回已下载 PDF 的本地文件路径。