TheCrawler 通用网页抓取
v0.5.8
io.github.manchittlab/thecrawler
通用网页抓取器,输出适配 LLM 的 Markdown,支持 RAG 分块与 PDF/DOCX 解析。
“crawl scrape firecrawl fetch” 共 242 个结果
v0.5.8
io.github.manchittlab/thecrawler
通用网页抓取器,输出适配 LLM 的 Markdown,支持 RAG 分块与 PDF/DOCX 解析。
v0.1.2
io.github.jsilets/twscrape-twitter-mcp
只读的 X/Twitter MCP:帖子、推文串、回复与搜索,基于 twscrape,无需 API key。
v3.9.2
io.github.AliAkhtari78/spotifyscraper
为 LLM 智能体提供公开的 Spotify 元数据、歌词与播客信息,只读且无需 API 密钥。
v0.3.0
io.github.kreuzberg-dev/kreuzcrawl
通过本地 CLI 抓取、爬取并映射网站,输出 Markdown 或 JSON。
v1.0.1
io.github.Perufitlife/multi-scraper-mcp
14 个网页抓取器作为 MCP 工具:Reddit、Amazon、Google Maps、Yelp、YouTube、Indeed 等。
v0.3.3
com.pulsemcp/pulse-fetch
抓取网页资源并进行内容提取与反爬绕过的 MCP 服务器。
v0.1.8
com.pulsemcp/fetchpet
Fetch Pet 保险理赔管理的 MCP 服务器,基于 Playwright 自动化。
v0.1.0
io.github.CedricKouma/fetch-extract
MCP 服务(stdio):通过 AgentForge API 把网页抓取为干净易读的 Markdown。
v0.1.1
com.scrapeer/mcp-server
从 AI 智能体运行 Scrapeer 可视化网页抓取流程。
v0.1.1
io.github.infoinlet-marketplace/mcp-fetch
面向 AI 智能体的防 SSRF URL 抓取——输出干净的 markdown/文本/HTML/JSON,并支持带防护的 REST 调用。
v0.2.14
com.pulsemcp.servers/pulse-fetch
从网页提取干净结构化内容的 MCP 服务器,具备反爬绕过能力。
v0.1.4
io.github.ChocoData-com/amazon-scraper-api-mcp
抓取 Amazon 商品与搜索结果,支持跨 20 个站点的异步批量 ASIN 查询。
v0.1.5
io.github.ashlrai/webfetch
以许可优先的联邦式图片搜索,附带署名信息、尺寸参数与下载工具。
v0.1.2
io.github.paimonchan/paimon-mcp-fetch
抓取网页并内置 SSRF 防护,可将任意 URL 转为干净易读的 Markdown。
v0.2.3
io.github.outscraper/outscraper-mcp-server
Outscraper MCP:企业发现、地图情报、数据富化、评论与联系人信息。
v1.0.1
io.github.bch1212/agentfetch
为 AI 智能体按 token 预算抓取网页,自动路由 Jina、FireCrawl、Trafilatura 与 PDF 解析。
v4.0.1
io.github.superaihuman/evocrawl-mcp
Evocrawl 的 MCP 服务器——搜索、抓取并与网页交互。
v3.0.1
io.github.j0hanz/fetch-url-mcp
抓取网页并将其转换为干净、易读 Markdown 的 MCP 服务器。
v1.0.6
io.github.dowant/lionscraper-python
LionScraper Python 版:MCP stdio + CLI + HTTP API,将 AI 桥接到 LionScraper 浏览器扩展。
v1.0.6
io.github.dowant/lionscraper-node
LionScraper Node 版:MCP stdio + CLI + HTTP API,将 AI 桥接到 LionScraper 浏览器扩展。
v1.0.0
io.github.khadinakbaronline/telegram-channel-scraper-mcp
抓取公开 Telegram 频道的消息并提取潜在客户线索,无需登录。
v0.1.1
io.github.carsonroell-debug/steadyfetch
面向 AI 智能体的可靠网页抓取:重试、熔断、缓存与反爬绕过。
v0.1.2
io.github.robot-resources/scraper
网页内容 token 压缩——HTML 转整洁 Markdown,减少 70-80%。
v1.0.1
io.github.scrapercity/scrapercity-cli
B2B 线索获取 MCP 服务器——20+ 抓取器、邮箱查找、人员背景溯源等。