Spotify 元数据抓取
v3.9.2
为 LLM 智能体提供公开的 Spotify 元数据、歌词与播客信息,只读且无需 API 密钥。
使用场景/网页抓取与采集
从网页提取结构化内容、爬取文档、监控变更。适合调研、内容聚合、知识库构建。
共匹配 1,401 个资源 · 第 7 / 30 页
网页抓取类 MCP Server 把互联网内容变成 AI 可直接消费的结构化文本:Firecrawl 类服务负责整站爬取与 Markdown 转换,Fetch 类服务负责单页拉取与重定向处理。相比浏览器自动化,它们不渲染交互、速度快、token 消耗低,是构建 RAG 语料与知识库的首选采集层。
典型工作流:用 Firecrawl MCP 批量爬取文档站 → 清洗为 Markdown → 送入向量库(如 Qdrant / Chroma MCP)→ 再用检索 MCP 让 AI 基于自有语料回答。AgentHub 上每个抓取类资源都附带安装命令与客户端配置,可直接复制到 Cursor 或 Claude Code。
合规边界:只抓取公开页面,遵守目标站点 robots.txt 与服务条款;控制并发与频率,避免给对方服务造成压力;需要登录才能访问的内容不要自动化批量拉取。
v3.9.2
为 LLM 智能体提供公开的 Spotify 元数据、歌词与播客信息,只读且无需 API 密钥。
v1.0.0
通过 HTTP 将 HTML 与 CSS 渲染为 PNG 图片。发送 HTML 和 CSS,返回 PNG。
v1.0.0
大规模爬取、抓取与搜索网页,并提供带反爬破解能力的浏览器自动化。
v0.3.0
通过本地 CLI 抓取、爬取并映射网站,输出 Markdown 或 JSON。
v1.0.1
通过 x402 计费的网页提取网关,工具:extract、extract_batch。
v1.0.1
14 个网页抓取器作为 MCP 工具:Reddit、Amazon、Google Maps、Yelp、YouTube、Indeed 等。
v0.3.3
抓取网页资源并进行内容提取与反爬绕过的 MCP 服务器。
v0.1.8
Fetch Pet 保险理赔管理的 MCP 服务器,基于 Playwright 自动化。
v0.1.2
供 AI 智能体生成 HTML 内容的 MCP 服务。
v1.0.0
通过 MCP 将 AI 生成的 HTML 与 Markdown 发布到托管、可分享的 URL。
v0.1.0
MCP 服务(stdio):通过 AgentForge API 把网页抓取为干净易读的 Markdown。
v0.2.1
电商竞品情报、VOC 情感分析、Amazon ASIN 分析与 Reddit 增长方案。
v1.0.0
来自 SEOcrawl AI 的实时 Google Search Console 数据、关键词与页面分析、站点审计及 SEO 任务。
v2.0.5
自托管的技术 SEO 审计 MCP:50 多项检查、WAF 检测、临时环境。基于 LibreCrawl 构建。
v1.0.0
抓取任意 URL 并输出干净的 Markdown,面向 AI 智能体的网页抓取。
v0.1.1
从 AI 智能体运行 Scrapeer 可视化网页抓取流程。
v0.6.3
教会 AI 编写能在 Outlook、Gmail 与 Apple Mail 中正确渲染的 HTML 邮件,含 19 条规则与 6 个组件。
v0.2.3
分享你的编码智能体生成的 HTML:难以猜到的 URL 加访问数据分析。
v0.13.5
面向 AI 编码 Agent 的公开社交数据 API 与实时文档。
v1.0.0
维生素 D 合成计算器:太阳位置、UV、每分钟 IU、达到剂量所需时间、晒伤风险、每日窗口。
v0.1.1
面向 AI 智能体的防 SSRF URL 抓取——输出干净的 markdown/文本/HTML/JSON,并支持带防护的 REST 调用。
v0.6.1
面向 AI 智能体的按次付费网页抓取,通过 x402 用 Base 链上的 USDC 结算;六个工具,无需注册。
v0.1.2
供 AI 智能体极速生成 HTML:15 个工具、22 个组件、25 个模板。
v1.0.0
面向智能体 HTML 导出 QA MCP 的付费远程 MCP,提供结构化回执。
v0.1.0
面向 AI 智能体的反向链接分析 MCP:权威度、引荐域名与竞品链接缺口。
v0.2.14
从网页提取干净结构化内容的 MCP 服务器,具备反爬绕过能力。
v1.2.0
从任意 URL 提取干净的 Markdown,去除页面冗余模板,适用于 RAG 管线。支持 x402。
v1.1.0
抓取 Twitter/X 主页、推文与搜索结果,无需 API key,返回结构化 JSON。x402 按次计费。
v1.1.0
将 Markdown 转为干净 HTML,含标题、列表与代码块。支持 x402 微支付。
v1.1.0
将 HTML 转为干净 Markdown,自动去除脚本与样式。支持 x402 微支付。
v1.0.0
部署在 Cloudflare Workers 上的 MCP 服务器:ai-crawler-policy。
v0.1.4
抓取 Amazon 商品与搜索结果,支持跨 20 个站点的异步批量 ASIN 查询。
v0.1.0
将 HTML 转为 Markdown 或提取为纯文本,适用于网页抓取智能体。
v0.1.5
以许可优先的联邦式图片搜索,附带署名信息、尺寸参数与下载工具。
v0.1.2
抓取网页并内置 SSRF 防护,可将任意 URL 转为干净易读的 Markdown。
v0.2.3
Outscraper MCP:企业发现、地图情报、数据富化、评论与联系人信息。
v1.0.1
为 AI 智能体按 token 预算抓取网页,自动路由 Jina、FireCrawl、Trafilatura 与 PDF 解析。
v4.0.1
Evocrawl 的 MCP 服务器——搜索、抓取并与网页交互。
v1.1.0
用你设计系统中的真实组件与 token,把 HTML 原型转换到 Figma。
v3.0.1
抓取网页并将其转换为干净、易读 Markdown 的 MCP 服务器。
v1.1.0
补全 IP、邮箱、域名与企业信息;抓取 SEC、新闻、招聘与 Crunchbase 数据,支持比特币按量付费。
v1.0.6
LionScraper Python 版:MCP stdio + CLI + HTTP API,将 AI 桥接到 LionScraper 浏览器扩展。
v1.0.6
LionScraper Node 版:MCP stdio + CLI + HTTP API,将 AI 桥接到 LionScraper 浏览器扩展。
v1.0.0
抓取公开 Telegram 频道的消息并提取潜在客户线索,无需登录。
v0.1.1
面向 AI 智能体的可靠网页抓取:重试、熔断、缓存与反爬绕过。
v0.2.1
多引擎学术检索服务器,支持搜索、引用追踪、全文获取与阅读列表。
v0.1.2
网页内容 token 压缩——HTML 转整洁 Markdown,减少 70-80%。
v1.0.1
B2B 线索获取 MCP 服务器——20+ 抓取器、邮箱查找、人员背景溯源等。
静态或服务端渲染的页面、整站文档爬取用抓取类(Firecrawl/Fetch);需要点击、滚动、登录交互或抓渲染后截图,用浏览器自动化(Playwright MCP)。
托管版需要;也可以自部署开源版,或用免费的 Fetch MCP 做单页抓取。资源详情页会标注分发方式与所需环境变量。
常见做法是 Markdown 清洗后写入向量库 MCP(Qdrant、Chroma、pgvector 等),再配合检索 Skill 或 Context7 类知识库 MCP 完成问答。