prismcrawl
v1.0.3
Live Google, Bing, Amazon, Maps, Yelp & app store data. As low as $0.15/1K successes; failures free.
使用场景/网页抓取与采集
从网页提取结构化内容、爬取文档、监控变更。适合调研、内容聚合、知识库构建。
共匹配 889 个资源 · 第 2 / 19 页
网页抓取类 MCP Server 把互联网内容变成 AI 可直接消费的结构化文本:Firecrawl 类服务负责整站爬取与 Markdown 转换,Fetch 类服务负责单页拉取与重定向处理。相比浏览器自动化,它们不渲染交互、速度快、token 消耗低,是构建 RAG 语料与知识库的首选采集层。
典型工作流:用 Firecrawl MCP 批量爬取文档站 → 清洗为 Markdown → 送入向量库(如 Qdrant / Chroma MCP)→ 再用检索 MCP 让 AI 基于自有语料回答。AgentHub 上每个抓取类资源都附带安装命令与客户端配置,可直接复制到 Cursor 或 Claude Code。
合规边界:只抓取公开页面,遵守目标站点 robots.txt 与服务条款;控制并发与频率,避免给对方服务造成压力;需要登录才能访问的内容不要自动化批量拉取。
v1.0.3
Live Google, Bing, Amazon, Maps, Yelp & app store data. As low as $0.15/1K successes; failures free.
v2.6.2
PubMed 与 Europe PMC 文献检索、美英药品说明书查询与临床试验检索,供 AI 助手使用。
v0.1.1
用该爬虫抓取任意公司的 Recruitee 招聘板。
v0.1.1
抓取 YouTube 视频与频道:标题、播放量、点赞数、订阅数与上传日期。
v0.1.1
轻松抓取 Yelp 商家评论,提取评分、评论正文、评价者。
v0.1.1
从 Yahoo Finance 抓取股票行情、历史价格与财务报表。
v0.1.1
抓取任意公司的 Workable 招聘板,得到清洗去重的职位数据:标题。
v0.1.1
抓取酒店、餐厅、景点与体验活动的 TripAdvisor 评论。
v0.1.1
把任意公司的 Atlassian Statuspage 提取为干净的 JSON——组件等字段。
v0.1.1
抓取 SmartRecruiters 公司招聘板,得到清洗去重的 JSON:标题。
v0.1.1
Extract all URLs from any XML sitemap into clean JSON, including lastmod, changefreq and priority.
v0.1.1
用于快速市场调研的 Shopify 与 eBay 商品抓取提取器,可拉取 Shopify 商品数据。
v0.1.1
抓取澳大利亚与新西兰的 SEEK 招聘信息。
v0.1.1
Rippling ATS job scraper pulls live postings from any company's Rippling job board via API.
v0.1.1
针对任意城市房产中介与经纪人的 Google 地图爬虫。
v0.1.1
一键抓取任意公司的 Pinpoint 招聘板。
v0.1.1
把任意公司的 Personio 招聘板转换为清洗去重后的 JSON。
v0.1.1
Get any company's OpenStatus status page as clean JSON — monitors, components and live status.
v0.1.1
抓取任意公司的 Lever 招聘板,得到清洗去重后的职位数据:标题、团队。
v0.1.1
把任意 Open Collective 的公开支出与交易抓取为干净的 JSON——金额。
v0.1.1
把任意公司的 Instatus 状态页转换为干净的 JSON——组件等字段。
v0.1.1
Scrape Hacker News stories, comments and user profiles as clean JSON with points.
v0.1.1
通过高速 API 抓取使用 Greenhouse ATS 的公司的招聘信息。
v0.1.1
搜索或监控任意 Flarum 论坛的讨论、回复、参与者。
v0.1.1
抓取任意公开 Discourse 论坛:主题标题、作者、回复数。
v0.1.1
搜索或监控任意自托管的 Cachet 状态页,不绑定单一服务商。
v0.1.1
把 BetterStack 状态页(status page)以干净的 JSON 取回——组件、事件。
v0.1.1
Ashby ATS 职位爬虫,通过 API 拉取实时招聘信息并支持按团队筛选。
v0.1.1
Amazon 评论爬虫可提取评分、评论正文、作者、日期。
v0.1.1
Scrape jobs from Greenhouse, Lever, Ashby, Workable, Recruitee, SmartRecruiters.
v0.1.1
把任意网站转换为符合你自定义 schema 的结构化 JSON 数据。
v1.3.0
Live web research with related queries, browser-rendered sources, images, and evidence.
v0.1.2
ScraperAPI MCP — wraps ScraperAPI (scraperapi.com), a proxy-based web
v0.1.2
ScrapeCreators MCP — wraps the ScrapeCreators social-media + ad-library
v1.0.8
Google Trends Scraper API: Interest and Trending Now
v1.0.0
YouTube videos and channels with top comments in the same row, plus dislike estimates. No API key.
v1.0.0
Public Instagram reels, posts, profiles and comments, plus reel-to-text transcripts. No login.
v1.0.0
Public social media, search and e-commerce data from 70+ platforms, on one API key.
v1.0.2
Reddit posts, comments, search, users & subreddits as JSON via Apify. No Reddit API key. $1.50/1k
v2.0.0
Rotomolding mold-on-arm layout feasibility: which molds fit on a machine arm/spider, and how.
v1.0.0
Printwren: web page or HTML to PDF with real Chrome; pages, base64 or download link. Free, no key.
v1.0.1
Google Trends for agents: trend verdict, stats, rising queries, regions, trending now.
v1.0.1
Current pricing, cost estimates and recommendations for web scraping APIs, with official sources.
v1.0.0
Printwren: web page or HTML to PDF with real Chrome; pages, base64 or download link. Free, no key.
v0.1.2
Crawlbase MCP — wraps the Crawlbase Crawling API (crawlbase.com, formerly
v0.1.1
Common Crawl's public web archive — find every time a URL was crawled since 2008 and read.
v0.1.1
HTML 转纯文本 MCP。
v0.1.1
HTML 实体转换 MCP。
静态或服务端渲染的页面、整站文档爬取用抓取类(Firecrawl/Fetch);需要点击、滚动、登录交互或抓渲染后截图,用浏览器自动化(Playwright MCP)。
托管版需要;也可以自部署开源版,或用免费的 Fetch MCP 做单页抓取。资源详情页会标注分发方式与所需环境变量。
常见做法是 Markdown 清洗后写入向量库 MCP(Qdrant、Chroma、pgvector 等),再配合检索 Skill 或 Context7 类知识库 MCP 完成问答。