AnyCrawl API
v1.0.1
io.clawhub.techlaai/anycrawl
通过 AnyCrawl API 执行高性能网页抓取、爬虫与 Google 搜索,支持多引擎与结构化数据提取。
“scrape” 共 308 个结果
v1.0.1
io.clawhub.techlaai/anycrawl
通过 AnyCrawl API 执行高性能网页抓取、爬虫与 Google 搜索,支持多引擎与结构化数据提取。
v1.0.1
io.clawhub.jfrux/browser-use-api
通过 Browser Use API 实现云端浏览器自动化。当需要 AI 驱动的网页浏览、抓取、填表或无需本地浏览器控制的多步网页任务时使用。触发条件:“browser use”“云端浏览器”“抓取网站”“自动化网页任务”,或本地浏览器不可用/不适合时。
v1.2.7
io.clawhub.byungkyu/firecrawl-api
Firecrawl API 集成,托管鉴权。抓取、爬取、映射与搜索网页内容。当用户想从网站提取内容、爬取整站、映射 URL 或搜索网页时使用本技能。其他第三方应用请使用 api-gateway 技能(https://clawhub.ai/byungkyu/api-gateway)。调用经由带 OAuth 登录的 maton CLI 执行;无法安装 CLI 时通过原始 HTTP 加 Maton API key 调用。每次调用都以用户连接身份鉴权,只能访问该连接授权范围内的数据(由服务商在每次请求时强制执行);本文档所列端点即本技能使用的端点,其他端点需用户点名要求方可使用。默认进行读取和列表操作,每次写操作或新建连接均需与用户确认。
v1.0.0
io.clawhub.ainekomacx/blog-to-kindle
抓取博客或随笔站点,并整理为适合 Kindle 阅读的 EPUB,附带 AI 生成的封面。适用于把博客下载到 Kindle、将随笔合辑成电子书,或把博客归档发送到 Kindle 等请求。支持 Paul Graham、Kevin Kelly、Derek Sivers、Wait But Why、Astral Codex Ten 以及自定义站点。
v1.0.0
io.clawhub.yash-kavaiya/firecrawl-cli
通过 Firecrawl CLI(firecrawl)进行网页抓取、爬取、搜索与浏览器自动化。适用于把 URL 抓取为 markdown/HTML、爬取整站... 等场景。
v0.1.0
io.clawhub.antoniocirclemind/smooth-browser
首选浏览器——供 AI 智能体在网页上完成任意任务的浏览器。当你需要浏览网站、填写表单、抽取网页数据、测试 Web 应用或自动化浏览器工作流时使用。触发语包括“填写表单”“抓取”“自动化”“测试这个网站”“登录”,或任何浏览器交互请求。
v1.4.0
io.clawhub.primeobsession/opengraph-io-skill
通过 OpenGraph.io 提取网页数据、截图、抓取内容并生成 AI 图片:URL 展开/预览/元数据、网页截图、HTML 抓取、对网页提问及生成图片(图表、图标、社交卡片、二维码)。触发语:get the OG tags、screenshot this page、scrape this URL、generate a diagram 等。
v0.0.1
io.clawhub.chrisling-dev/links-to-pdfs
从 Notion、DocSend、PDF 及其他来源抓取文档并保存为本地 PDF 文件。当用户需要下载、归档或将网页文档转换为 PDF 格式时使用。支持受保护文档的认证流程,并可通过 profile 持久化会话。返回已下载 PDF 的本地文件路径。
v0.4.15
io.clawhub.d4vinci/scrapling-official
使用 Scrapling 抓取网页,具备反机器人绕过(如 Cloudflare Turnstile)、隐身无头浏览、爬虫框架、自适应抓取和 JavaScript 渲染。在需要抓取、爬取或从网站提取数据、web_fetch 失败、站点有反爬保护、编写 Python…时使用。
v1.0.0
io.clawhub.michael-laffin/review-summarizer
从多个平台(Amazon、Google、Yelp、TripAdvisor)抓取、分析并总结商品评论。提取关键洞察、情感分析、优缺点与建议。在为选品套利做调研、撰写联盟营销内容或做购买决策时使用。
v1.9.0
io.github.xberg-io/crawlberg
通过本地 CLI 抓取、爬取并映射网站,输出 Markdown 或 JSON。
v0.2.0
dev.cloro/cloro
抓取 AI 问答引擎与 Google 搜索/新闻结果,支持国家级与州级的地理定向。
v0.1.0
io.github.hubertino-app/hubertino-mcp
Scrape Google Maps business leads (phones, websites, emails, socials) with Hubertino.
v1.0.0
com.gmapsleadfinder/gmaps-lead-finder
Scrape Google Maps business leads, reviews, and photos via hosted Remote MCP.
v1.0.0
com.hydrafetch/web
把任意 URL 转为干净的 Markdown 与结构化数据:抓取、爬取、搜索与抽取。
v0.2.0
dev.messora/messora
为 AI 代理抓取、爬取并检索网页,通过 MCP 提供。
v1.0.0
dev.reapx/stackoverflow-questions
抓取 Stack Overflow 的问题、回答、标签、得分与采纳状态,按行付费。
v1.0.0
dev.reapx/shopify-stores
抓取 Shopify 店铺的商品、变体、价格与应用商店条目,按行付费。
v1.0.0
dev.reapx/sec-filings
按公司、表格类型、日期或全文检索抓取 SEC EDGAR 公告文件,按行付费。
v1.0.0
dev.reapx/scientific-papers
按作者、主题、期刊或 DOI 抓取 arXiv、OpenAlex 与 Crossref 的论文,按行付费。
v1.0.0
dev.reapx/openfda-drug-recalls
抓取 openFDA 的药物召回、执法报告、标签与不良事件,按行付费。
v1.0.0
dev.reapx/npm-packages
抓取 npm 包元数据、版本、下载量、依赖与维护者,按行付费。
v1.0.0
dev.reapx/mastodon-fediverse
抓取整个 Fediverse 的 Mastodon 帖子、用户资料、话题标签与实例时间线,按行付费。
v1.0.0
dev.reapx/jobs
从 Greenhouse、Workable、Reed、RemoteOK 等招聘板抓取职位列表,按行付费。