substrate-browser
v2.0.2
Token-first headless browser for AIs. Extracts a tiny semantic graph, cutting HTML bloat by 95%.
使用场景/网页抓取与采集
从网页提取结构化内容、爬取文档、监控变更。适合调研、内容聚合、知识库构建。
共匹配 889 个资源 · 第 14 / 19 页
网页抓取类 MCP Server 把互联网内容变成 AI 可直接消费的结构化文本:Firecrawl 类服务负责整站爬取与 Markdown 转换,Fetch 类服务负责单页拉取与重定向处理。相比浏览器自动化,它们不渲染交互、速度快、token 消耗低,是构建 RAG 语料与知识库的首选采集层。
典型工作流:用 Firecrawl MCP 批量爬取文档站 → 清洗为 Markdown → 送入向量库(如 Qdrant / Chroma MCP)→ 再用检索 MCP 让 AI 基于自有语料回答。AgentHub 上每个抓取类资源都附带安装命令与客户端配置,可直接复制到 Cursor 或 Claude Code。
合规边界:只抓取公开页面,遵守目标站点 robots.txt 与服务条款;控制并发与频率,避免给对方服务造成压力;需要登录才能访问的内容不要自动化批量拉取。
v2.0.2
Token-first headless browser for AIs. Extracts a tiny semantic graph, cutting HTML bloat by 95%.
v1.0.0
截图/PDF/HTML 渲染 API;需 API 密钥或 x402,已关闭免密钥访问。
v1.3.2
Parsed SEC events by CIK/CUSIP: 8-K items, Form 144, Form D, FTD. Not EDGAR HTML.
v16.0.0
597 motion/3D UI patterns as ready HTML/CSS/JS, served over MCP. The entire library is free.
v1.0.1
由 HTML 生成带旁白的演示文稿,可轮询构建状态、列出租户清单,并把其中一份读回为文本。
v2.0.0
Google 评论 API——从 Google、Trustpilot、TripAdvisor、G2 等 50 多个平台抓取评论。
v0.5.0
AI 设计工作室:从简报出发产出方向板、HTML 原型、图片与视频,使用 OAuth 登录。
v0.1.6
通过 MCP 从 FRED API 检索约 80 万条美联储经济时间序列。
v1.0.0
Deploy HTML or dist/ to a live HTTPS URL. No account. Drop, MCP, or CLI.
v3.1.0
26 pay-per-call tools for agents: scrape, verify, guards, crypto. x402 USDC on Base.
v1.2.0
按工种或地点检索美国持牌承包商,获取档案与评价,并提交线索。
v1.1.1
Search people open to work and fetch their machine-readable cv.json, from any AI assistant.
v0.3.0
通过一个远程 MCP 工具,把公开 HTML 或公开 URL 转成 token 密度更高的 Markdown。
v2.0.1
Search song lyrics on lyrics.com by word or by title, and fetch full lyrics. No API key required.
v0.2.5
Convert web pages or HTML to clean Markdown for LLM context. Local, no external API calls.
v1.0.2
Paid x402 MCP utilities for AI agents on Base: JSON, HTML, CSV, hashing, attestations.
v0.1.0
Shared copies of public web pages for AI agents. Search stored pages or fetch a URL.
v1.0.0
文档问答:检索 169 篇数据与 AI 指南,任意页面可取 Markdown 格式内容;只读且无需密钥。
v1.5.3
AI visibility checker: GPTBot vs OAI-SearchBot, robots.txt audit, raw-HTML schema. 165 crawlers.
v1.0.1
x402 pay-per-call APIs for AI agents on Base: site audits, llms.txt, wallet watch, prices, fetch.
v1.5.0
检索经认证的 Claude Code 插件与技能,获取可移植的 SKILL.md 源码;只读。
v1.28.1
基于我们自建抓取索引的实时网页搜索、图片搜索、主题过滤与全文抓取。
v0.1.3
通过 FileChanger API 在文本类文档格式(Markdown、HTML 等)之间转换。
v1.0.0
搜索并获取 AgendaForge 的公开文档与营销内容,无需鉴权。
v0.1.0
Market evidence with receipts: every claim resolves to a real stored record you can fetch back.
v0.4.1
跨客户端 ECharts 图表 MCP server:数据 -> 可交互 HTML 与内联图片
v0.3.1
Render-and-verify API: HTML/CSS to image or PDF, screenshot any URL, confirm the text rendered.
v0.56.3
HSM 支撑的 AI 智能体密钥库(JIT 即时取密),附带提示注入与威胁扫描。
v0.3.3
MCP server for Singapore Statutes Online: browse, fetch, and cite Singapore Acts.
v0.3.3
MCP server for Laws of Malaysia Online: fetch and cite Malaysian principal Acts.
v0.3.3
MCP server for Japan's e-Gov law search API: search, fetch, and cite national legislation.
v0.6.2
在 21 个邮件客户端中分析、审计、修复与对比 HTML、MJML、Maizzle 和 React Email。
v0.2.1
Web toolkit for AI agents: read any URL as Markdown, screenshot, extract data, or crawl a site.
v0.3.1
发布众包内容采集任务,并经 FirstHandAPI 拉取审核通过的文件。
v1.0.0
The documentation, as a tool your agent can call: 950+ AI-dev guides. Search + fetch tools.
v0.6.0
从任意 MCP 兼容 AI 智能体将 HTML 发布到私有、不可猜测、可原地替换的 URL。
v3.5.0
X/Twitter 自动化 MCP:抓取、发帖、排期、分析与互动,无需 API 密钥。
v0.1.2
浏览社区 3D 创作画廊,按查看 URL 获取作品,并提交作品。
v1.0.0
WhatsApp 资料数据 API,可编程获取用户的头像等资料。
v1.0.0
Instagram 公开数据抓取 API,可搜索用户、帖子、话题标签、地点等。
v1.2.0
Cloud PDF generation from HTML, CSS and XSL-FO, with PDF/A and PDF/UA support.
v1.6.0
用模板+JSON 生成 PDF/DOCX/XLSX/PPTX,将 Office/HTML/MD 转为 PDF,支持通用模板。
v0.2.0
Web toolkit for AI agents: read any URL as Markdown, screenshot, extract data, or crawl a site.
v1.0.1
Publish an HTML presentation — a slide deck or scrolling document — at a shareable link.
v1.0.0
Turn an HTML template plus JSON into a finished PDF: a quote, invoice, work order or certificate.
v1.0.0
Deploy HTML from any agent: POST markup, get a live URL. Static hosting API with MCP tools.
v0.1.1
Browserbase MCP server: cloud browser sessions, agents, contexts, fetch, search, functions
v0.3.0
Stdio + HTTP MCP gateway: SSRF-hardened web_fetch, web_search, metis_verify, market_search.
静态或服务端渲染的页面、整站文档爬取用抓取类(Firecrawl/Fetch);需要点击、滚动、登录交互或抓渲染后截图,用浏览器自动化(Playwright MCP)。
托管版需要;也可以自部署开源版,或用免费的 Fetch MCP 做单页抓取。资源详情页会标注分发方式与所需环境变量。
常见做法是 Markdown 清洗后写入向量库 MCP(Qdrant、Chroma、pgvector 等),再配合检索 Skill 或 Context7 类知识库 MCP 完成问答。