PageCrawl
v1.0.0
监控网页变化,提供 AI 驱动的变化检测、差异对比与提醒。
使用场景/网页抓取与采集
从网页提取结构化内容、爬取文档、监控变更。适合调研、内容聚合、知识库构建。
共匹配 889 个资源 · 第 7 / 19 页
网页抓取类 MCP Server 把互联网内容变成 AI 可直接消费的结构化文本:Firecrawl 类服务负责整站爬取与 Markdown 转换,Fetch 类服务负责单页拉取与重定向处理。相比浏览器自动化,它们不渲染交互、速度快、token 消耗低,是构建 RAG 语料与知识库的首选采集层。
典型工作流:用 Firecrawl MCP 批量爬取文档站 → 清洗为 Markdown → 送入向量库(如 Qdrant / Chroma MCP)→ 再用检索 MCP 让 AI 基于自有语料回答。AgentHub 上每个抓取类资源都附带安装命令与客户端配置,可直接复制到 Cursor 或 Claude Code。
合规边界:只抓取公开页面,遵守目标站点 robots.txt 与服务条款;控制并发与频率,避免给对方服务造成压力;需要登录才能访问的内容不要自动化批量拉取。
v1.0.0
监控网页变化,提供 AI 驱动的变化检测、差异对比与提醒。
v1.0.0
抓取 URL 并返回带元数据的干净 Markdown,无需 API key,按 IP 限速。
v1.0.0
网页抓取 MCP 服务器:URL、链接、元数据与 CSS 提取。
v2.3.0
Rust MCP 隐蔽抓取器:具备反爬搜索/抓取、CDP 回退与 HITL 非机器人验证。
v2.0.0-rc
隐蔽抓取与搜索,通过 Cyborg HITL 方式绕过 Cloudflare、DataDome 与 LinkedIn。
v1.0.1
通过 ScrapeGraph API 提供 AI 驱动的网页抓取与数据提取能力。
v2.0.1
使用 Crawlee 抓取并分析网站的 SEO 错误,结果存储于 SQLite。
v1.0.0
托管版 Crawleo MCP(远程可流式 HTTP 端点)。
v1.0.2
智能网页内容抓取 MCP 服务器,将 HTML 转换为干净、AI 可读的 JSONL 格式。
v1.0.4
从网页抓取内容并整理成适合 LLM 的精净文本(基于 Defuddle)。
v0.3.0
将 HTML 转换为 Markdown,自动摘要并按章节抽取,支持 Playwright。
v1.16.0
让语言模型以企业级可靠性执行高级 AI 网页抓取。
v1.0.0
一个向网页发起 fetch 请求的简单工具。
v1.0.0
抓取网页并精准提取你所需的内容。
v1.15.0
将网页提取并解析为干净的 HTML、链接或 Markdown。
v0.1.1
用于网页内容抓取、摘要、对比与信息提取的 MCP 服务器。
v1.0.0
提供从网页抓取、转换和提取数据工具的 MCP 服务器。
AI 会话记忆:每次会话前由你的 AI 阅读的简报,避免任何会话从零开始。跨 Claude、ChatGPT、Cursor 与 Codex 加载项目当前任务、近期决策与未决问题。
v1.1.0
EU-native web scraping for AI agents. scrape pages, map sites, run background jobs, check usage.
v0.6.0
将 HTML 发布为带追踪的链接,查看谁打开过以及读了哪些章节。
v0.3.2
面向 AI 智能体的网页情报:抓取、渲染、抽取与研究。使用 x402 微支付,无需 API 密钥。
v2.3.1
免费发现 BitBooth API,再购买限额的 x402 抓取、PageDelta 与钱包检查。
v1.0.0
BCP 47 lang attribute shape
v1.0.5
MCP server for HTML2PDF Converter
v1.1.0
付费前先检查 x402 端点:可用性、价格历史与刷量农场检测。另提供俄语网页访问。
v0.1.1
YouTube transcripts for AI agents: videos, channels, playlists, search. Timestamps, SRT, VTT.
v0.3.5
从任意 MCP 客户端把 HTML 或 Markdown 发布为 htmldrop.app 上可分享的真实链接。
v1.0.0
4 Yelp endpoints. Pay per call in USDC via x402.
v1.0.0
9 App Store endpoints. Pay per call in USDC via x402.
v1.0.0
7 Google Play endpoints. Pay per call in USDC via x402.
v1.0.0
12 Google News endpoints. Pay per call in USDC via x402.
v1.0.0
4 Google Maps endpoints. Pay per call in USDC via x402.
v1.0.0
1 Google Search endpoints. Pay per call in USDC via x402.
v1.0.0
15 Reddit endpoints. Pay per call in USDC via x402.
v1.0.0
16 Instagram endpoints. Pay per call in USDC via x402.
v1.0.0
13 TikTok endpoints. Pay per call in USDC via x402.
v1.0.0
15 YouTube endpoints. Pay per call in USDC via x402.
v1.0.0
15 Twitter / X endpoints. Pay per call in USDC via x402.
v1.9.0
SpiderIQ Leads 获客 MCP:招聘岗位、营销活动、IDAP、地图、人物信息、核验、企业背景与 spiderPR。
v0.1.2
See and kill the dev servers your coding agents leave running, and get collision-free ports.
v0.1.1
Scrape Google Maps business data from any MCP client — names, phones, emails, websites, ratings.
v0.1.1
Curated SISTRIX SEO tools: visibility, rankings, keywords, backlinks, AI visibility, Amazon data.
v0.1.3
Curated read-only Matomo Analytics tools: traffic, pages, referrers, e-commerce, real-time & more.
v1.1.0
SpiderIQ Media:SpiderMedia 文件、视频与按租户划分的媒体目录(只读)。
v1.3.0
SpiderIQ Gate:SpiderGate LLM 网关(补全、模型、用量、追踪)。
v1.4.0
SpiderIQ Mail:为 AI 代理提供 SpiderMail 邮箱、消息、会话、发送与撰写。
v1.25.0
SpiderIQ Publish:内容平台 MCP(页面、文章、模板、组件、域名、媒体)。
v1.0.0
面向 AI agent 的图原生持久记忆:33 个 MCP 工具,写入过程零 LLM 开销。
静态或服务端渲染的页面、整站文档爬取用抓取类(Firecrawl/Fetch);需要点击、滚动、登录交互或抓渲染后截图,用浏览器自动化(Playwright MCP)。
托管版需要;也可以自部署开源版,或用免费的 Fetch MCP 做单页抓取。资源详情页会标注分发方式与所需环境变量。
常见做法是 Markdown 清洗后写入向量库 MCP(Qdrant、Chroma、pgvector 等),再配合检索 Skill 或 Context7 类知识库 MCP 完成问答。