tablestakes
v1.1.0
通过 MCP 工具读取并编辑 GitBook 同步文档中的 HTML/Markdown 表格。
使用场景/网页抓取与采集
从网页提取结构化内容、爬取文档、监控变更。适合调研、内容聚合、知识库构建。
共匹配 889 个资源 · 第 19 / 19 页
网页抓取类 MCP Server 把互联网内容变成 AI 可直接消费的结构化文本:Firecrawl 类服务负责整站爬取与 Markdown 转换,Fetch 类服务负责单页拉取与重定向处理。相比浏览器自动化,它们不渲染交互、速度快、token 消耗低,是构建 RAG 语料与知识库的首选采集层。
典型工作流:用 Firecrawl MCP 批量爬取文档站 → 清洗为 Markdown → 送入向量库(如 Qdrant / Chroma MCP)→ 再用检索 MCP 让 AI 基于自有语料回答。AgentHub 上每个抓取类资源都附带安装命令与客户端配置,可直接复制到 Cursor 或 Claude Code。
合规边界:只抓取公开页面,遵守目标站点 robots.txt 与服务条款;控制并发与频率,避免给对方服务造成压力;需要登录才能访问的内容不要自动化批量拉取。
v1.1.0
通过 MCP 工具读取并编辑 GitBook 同步文档中的 HTML/Markdown 表格。
v1.0.1
为 AI 智能体提供网页抓取、搜索、监控与 HTML 转 Markdown。
v0.1.1
将 HTML MUP 面板转换为供 LLM 使用的交互式 UI 工具的 MCP 服务器。
v0.5.2
分析 Figma 设计稿对开发与 AI 的就绪度,含 39 条规则、评分与 HTML 报告。
v0.1.2
通用网页内容抽取——任意 URL 转为适配 LLM 的 markdown,支持 HTML、YouTube、PDF、DOCX。
v1.0.2
ZebPay 加密货币交易所的 MCP 服务器——获取行情、余额并管理订单。
v1.1.1
codewiki.google 的 MCP 服务器:搜索仓库、获取 wiki 文档、提问答疑。
v0.2.2
转换 PDF、DOCX、HTML、Markdown 与纯文本,便于注入 AI 助手上下文。
v1.0.0
面向 AI Agent 的即时网页发布——POST 一段 HTML 即得到线上可访问 URL,无需注册账号。
v1.1.0
使用 Prince 将 Markdown、HTML 与网页转换为高质量 PDF。
v1.0.3
Markdown MCP 服务器:表格、目录、HTML 转换与格式化。
v1.0.2
生成可直接上线的 HTML 落地页的 MCP 服务器。
v1.0.3
Base64、URL 与 HTML 编解码的 MCP 服务器。
v1.0.1
Markdown 处理、目录生成与 HTML 转换。
v1.0.1
生成 HTML meta 标签与 Open Graph 元数据。
v1.2.0
通过粘贴、上传与 ZIP 部署,快速发布并管理 HTML 站点
v1.2.0
基于 Playwright 将 HTML 或 URL 转换为 PDF 文档
v1.3.5
OpenGraph.io API 的 MCP 服务器——获取 OG 数据、截图、网页抓取与图片生成。
v0.1.4
在 AWS 无服务器 RAGStack 知识库上检索、对话、上传与抓取网页。
v1.4.7
轻量级 DMARC 解析器:自动拉取邮件报告,在一体化应用中可视化合规情况。
v1.0.0
一个面向全网络的 MCP。
v1.0.0
检索 VeChain 文档、查询链上数据并获取手续费建议。
v1.14.0
发送快速问候、抓取网站内容,并按需生成文本或图像。
v0.0.1
查找开源库并按版本获取上下文相关的代码片段。
v1.0.0
远程 MCP server:网页抓取、搜索、Python、TTS、记忆、图像与视频。
静态或服务端渲染的页面、整站文档爬取用抓取类(Firecrawl/Fetch);需要点击、滚动、登录交互或抓渲染后截图,用浏览器自动化(Playwright MCP)。
托管版需要;也可以自部署开源版,或用免费的 Fetch MCP 做单页抓取。资源详情页会标注分发方式与所需环境变量。
常见做法是 Markdown 清洗后写入向量库 MCP(Qdrant、Chroma、pgvector 等),再配合检索 Skill 或 Context7 类知识库 MCP 完成问答。