mcp-design-system-extractor
v1.2.0
MCP server for Storybook design systems — extract component HTML, styles and metadata.
使用场景/网页抓取与采集
从网页提取结构化内容、爬取文档、监控变更。适合调研、内容聚合、知识库构建。
共匹配 889 个资源 · 第 16 / 19 页
网页抓取类 MCP Server 把互联网内容变成 AI 可直接消费的结构化文本:Firecrawl 类服务负责整站爬取与 Markdown 转换,Fetch 类服务负责单页拉取与重定向处理。相比浏览器自动化,它们不渲染交互、速度快、token 消耗低,是构建 RAG 语料与知识库的首选采集层。
典型工作流:用 Firecrawl MCP 批量爬取文档站 → 清洗为 Markdown → 送入向量库(如 Qdrant / Chroma MCP)→ 再用检索 MCP 让 AI 基于自有语料回答。AgentHub 上每个抓取类资源都附带安装命令与客户端配置,可直接复制到 Cursor 或 Claude Code。
合规边界:只抓取公开页面,遵守目标站点 robots.txt 与服务条款;控制并发与频率,避免给对方服务造成压力;需要登录才能访问的内容不要自动化批量拉取。
v1.2.0
MCP server for Storybook design systems — extract component HTML, styles and metadata.
v1.0.0
Route web, social, and filings data tasks to the best available scraper.
v0.2.6
为 AI 智能体提供无需密钥的多引擎网页搜索、抓取与干净的 Markdown 阅读,不需要任何 API 密钥。
v1.0.1
MCP server for the Unsplash API: search & fetch photos with attribution + download tracking.
v0.1.1
Search AI-native jobs, inspect application forms, and fetch free interview-prep resources.
v1.0.1
将 HTML 页面或 PDF 分享为短公开链接,无需账号或 API 密钥,到期自动失效。
v0.2.0
Reusable visual design systems for AI coding agents — browse, fetch, and submit styles via MCP.
v0.2.4
Residential proxy for AI agents via x402 — fetch, sessions, exit country
v0.6.0
Summarize YouTube videos or fetch transcripts. Pay-per-call via x402 (USDC on Base), no account.
v1.1.0
Share prototypes for team review: publish HTML, reviewers pin notes, pull feedback back to apply.
v0.1.2
MCP server that lets AI agents create, fetch, verify, and publish Molpha oracle data.
v0.2.1
面向 AI 代理的网页数据:抓取、爬取、搜索、深度研究、站点监控与浏览器自动化。
v0.2.1
Search Luogu problems, fetch statements, explore problem sets and get practice recommendations.
v0.1.0
Search AtCoder problems and fetch public problem statements through MCP.
v0.1.0
MCP server for KoboToolbox: list forms, fetch submissions, and export field data.
v1.0.0
Private living HTML pages agents publish, recall, update, and share at name.notepad.page.
v1.3.0
Screenshots, PDFs and Markdown from any URL or HTML for AI agents, via the SnapForge API
v1.8.2
把 HTML、Markdown 或 URL 渲染为图片、PDF 或带品牌标识的物料,并可提取内容、监测页面变化。
v1.0.1
一部由众包持续写作的 AI 小说——领取任务、撰写一章并提交,采用 CC0 授权。
v1.0.1
MCP server for Api2Pdf — generate PDFs & images from HTML, URLs or office files; merge, barcodes.
v1.0.1
Turn HTML or a live URL into polished PDF and Excel files — hosted downloads, async jobs, history.
v0.2.0
将购物者的意图与商家的商品匹配,并抓取实时价格、库存与商品问答。
v1.0.1
Car logo API and image CDN: search automotive brands, fetch brand data, and build logo CDN URLs.
v0.2.1
非官方 TikTok API 与爬虫:创作者分析、视频数据、评论与搜索,走 x402 且无需 API 密钥。
v3.0.0
搜索 WindowsForum.com 的帖子与 Windows 新闻;获取文档与微软 KB 信息。
v0.37.0
将 HTML、文件或 URL 发布为永久公开链接,随后可更新——支持任意 MCP 智能体。
v0.2.0
为 AI 智能体把 HTML/CSS 像素级渲染为 PNG/JPG/WebP,可内联返回图片或提供 24 小时托管链接。
v0.1.2
为智能体的 HTML 制品提供归宿——通过 MCP 发布、拉取、分享与审阅。
v1.1.0
将任意 URL/HTML 截图为 PNG/JPEG/WebP,或转换为干净的 Markdown/文本供 LLM 阅读。
v1.2.0
AI-agent marketplace: agent templates, web search & crawl, SEO audit, RO company data, city info.
v0.1.4
UK planning application data for AI agents: search, geo-query and fetch applications.
v0.1.1
Submit AI inference to XFuel, pay per task (USDC via x402 or TFUEL), fetch/verify ZK proofs.
v0.1.1
MCP tools for AI agents: render URLs to image/PDF, check link health, convert HTML/CSV/JSON.
v1.0.0
发布并管理由你的 LLM 产出的可分享 HTML/Markdown 页面,支持访问控制。
v1.0.0
Self-hosted artifact publishing: POST HTML/JSX/Markdown/zip, get an unguessable URL on your domain
v1.8.0
网页抓取 MCP 服务器——抓取页面、提取结构化数据、对任意网站截图,支持反爬绕过。
v1.1.0
托管你的 AI 生成的 HTML 或 Markdown 页面,每个页面以链接分享并支持评论与访问控制。
v1.0.1
将 HTML 批量或单个生成 PDF 文档——支持原始变量替换,或基于条件与循环生成。
v0.1.0
为代理生成的 HTML 提供人工可视化评审:发布作品、拉取定位评论并推送修改。
v0.1.3
面向 AI 智能体的隐身浏览器:抓取 Cloudflare/DataDome/验证码之后的页面,并提取干净数据。
v0.24.0
为 AI 打造的纯 Go 浏览器:抓取页面、无需 Chromium 即可渲染 JS,经 MCP 返回整洁 Markdown。
v0.1.1
用一把密钥即可从任意 MCP 客户端调用 120 多个 AI 模型与实时网页上下文(抓取/爬取/抽取)。
v0.4.1
面向 SearXNG 的 MCP 服务器:引擎定向、多页扩散抓取,以及网页 URL 转 Markdown 阅读。
v1.2.1
一次调用即可把 HTML 或 Markdown 发布为公开链接;零配置,首次使用自动注册。
v1.0.15
面向 AI 代理的 Metalift MCP:网页搜索(2 积分)、抓取、整站爬取与站点地图工具。
v1.0.0
将 PDF/Word/PPT/HTML 解析为 Markdown;表格转 JSON、图片提取、RAG 分块与页码范围。
v1.0.0
网页抓取并转为干净 Markdown,支持 JS 渲染、多页爬取、结构化提取与站点地图。
v1.1.0
确定性的 AI 代理微型工具,无需账户/API 密钥。fetch_extract 可减少 98% 的 token,共 38 个工具。
静态或服务端渲染的页面、整站文档爬取用抓取类(Firecrawl/Fetch);需要点击、滚动、登录交互或抓渲染后截图,用浏览器自动化(Playwright MCP)。
托管版需要;也可以自部署开源版,或用免费的 Fetch MCP 做单页抓取。资源详情页会标注分发方式与所需环境变量。
常见做法是 Markdown 清洗后写入向量库 MCP(Qdrant、Chroma、pgvector 等),再配合检索 Skill 或 Context7 类知识库 MCP 完成问答。