reapx GitHub 仓库元数据与动态
v1.0.0
dev.reapx/github-repos
抓取 GitHub 仓库元数据、star、fork、话题、许可证与活动情况,按行付费。
“Scrape” 共 308 个结果
v1.0.0
dev.reapx/github-repos
抓取 GitHub 仓库元数据、star、fork、话题、许可证与活动情况,按行付费。
v1.0.0
dev.reapx/federal-register
按机构或日期抓取 Federal Register 的规则、拟议规则、公告与行政令,按行付费。
v1.0.0
dev.reapx/docker-containers
抓取 Docker Hub 的容器镜像、标签、拉取量与发布者元数据,按行付费。
v1.0.0
dev.reapx/discogs-music
抓取 Discogs 的唱片发行、艺人、厂牌、介质格式与目录编号,按行付费。
v1.0.0
dev.reapx/crypto-coingecko
抓取 CoinGecko 的币种价格、市值、成交量与交易所上线情况,按行付费。
v1.0.0
dev.reapx/clinical-trials
按病症、申办方、试验分期、状态或地点抓取 ClinicalTrials.gov 研究记录,按行付费。
v1.0.0
dev.reapx/books-library
抓取 Open Library 的图书版本、作者、主题与标识符,按行付费。
v1.0.0
dev.reapx/app-store-reviews
按应用、国家、评分或日期抓取 App Store 评论与评分历史,按行付费。
v2.1.0
dev.weblens/weblens
抓取、爬行、梳理并抽取网页;按次以 USDC 计费,无需账号或 API 密钥。
v1.0.0
io.github.johnisanerd/linkedin-posts
Scrape and analyze public LinkedIn posts as structured JSON via the Apify LinkedIn Posts API.
v1.0.0
com.thenextgennexus/healthcare-fda-intelligence-mcp
按 N-number 注册号抓取 FAA 航空器登记库——飞机制造商、型号、年份、所有者姓名、地址。
v1.0.0
io.github.us/fastcrw
抓取、爬取、映射并搜索网页——开源、可自托管的 Rust 爬虫与搜索引擎,面向 AI 智能体。
v0.3.0
io.github.kreuzberg-dev/kreuzcrawl
通过本地 CLI 抓取、爬取并映射网站,输出 Markdown 或 JSON。
v2.0.0
io.github.olamide-olaniyan/sociavault-mcp
抓取 TikTok、Instagram、YouTube、X、LinkedIn、Reddit 及广告库的社交数据。
v1.0.2
com.mcparmory/google-search
抓取 Google 搜索结果,获取 SERP 数据、广告与知识面板
v1.0.3
com.mcparmory/firecrawl
大规模抓取、爬取网页并提取结构化数据
v1.0.1
com.mcparmory/scrapingant
抓取网页、处理 JavaScript 与验证码,提取结构化数据
v1.0.0
io.scrapfly.mcp/mcp
借助 AI agent 大规模抓取任意网站、提取结构化数据并采集网页内容。
v1.14.0
ai.smithery/blacklotusdev8-test_m
按名字问候任何人。
io.github.D4Vinci/Scrapling/Scrapling-Skill
使用 Scrapling 抓取网页,支持反爬绕过(如 Cloudflare Turnstile)、隐身无头浏览、spider 框架、自适应抓取和 JavaScript 渲染。需要抓取/爬取/提取网站数据、web_fetch 失败、站点有反爬防护、编写 Python 抓取代码或 spider 时使用。
io.github.danielmiessler/LifeOS/Apify
通过 Apify actor 抓取社交平台、商业数据与电商内容——Instagram、LinkedIn、TikTok、YouTube、Facebook、Google Maps、Amazon 及通用网页爬取——并在代码中过滤。适用场景:抓取 Instagram/LinkedIn/TikTok/YouTube/Facebook、Google Maps 销售线索、Amazon 评论、商业智能、多平台社媒监听、竞品分析、线索生成、社媒监控、Apify actor、网页爬取、提取联系人。不适用于 X/Twitter 操作(用 _X)、四级代理递进式抓取(用 BrightData)、真实 Chrome 反爬绕过与 computer use(用 Interceptor)。
io.github.danielmiessler/LifeOS/Apify
通过 Apify actor 抓取社交媒体平台、商业数据与电商内容——Instagram 资料/帖子/话题标签/评论、LinkedIn 资料/职位/帖子、TikTok 资料/话题标签/视频/评论、YouTube 频道/搜索/评论、Facebook 帖子/群组/评论、Google Maps 商家搜索并提取联系方式/评论/图片、Amazon 商品/评论/价格,以及配合自定义 pageFunction 提取逻辑的通用多页网页爬取。基于文件的 TypeScript 封装(scrapeInstagramProfile、searchGoogleMaps、scrapeAmazonProduct、scrapeWebsite 等)在返回模型上下文前于代码中过滤与转换数据,相比直接走 MCP 协议可节省 95-99% 的 token。通过 Promise.all 并行查询多平台,支撑社媒监听看板。线索富化流水线:Google Maps → 合格过滤 → 可选 LinkedIn 富化。可同时在 Instagram、YouTube、TikTok 上做竞品分析。适用场景:抓取 Instagram、抓取 LinkedIn、抓取 TikTok、抓取 YouTube、抓取 Faceboo
io.github.danielmiessler/Personal_AI_Infrastructure/Apify
通过 Apify actor 抓取社交媒体平台、商业数据与电商内容——Instagram 资料/帖子/话题标签/评论、LinkedIn 资料/职位/帖子、TikTok 资料/话题标签/视频/评论、YouTube 频道/搜索/评论、Facebook 帖子/群组/评论、Google Maps 商家搜索并提取联系方式/评论/图片、Amazon 商品/评论/价格,以及配合自定义 pageFunction 提取逻辑的通用多页网页爬取。基于文件的 TypeScript 封装(scrapeInstagramProfile、searchGoogleMaps、scrapeAmazonProduct、scrapeWebsite 等)在返回模型上下文前于代码中过滤与转换数据,相比直接走 MCP 协议可节省 95-99% 的 token。通过 Promise.all 并行查询多平台,支撑社媒监听看板。线索富化流水线:Google Maps → 合格过滤 → 可选 LinkedIn 富化。可同时在 Instagram、YouTube、TikTok 上做竞品分析。适用场景:抓取 Instagram、抓取 LinkedIn、抓取 TikTok、抓取 YouTube、抓取 Faceboo
io.github.sickn33/antigravity-awesome-skills/apify-lead-generation
使用 Apify Actor 从多个平台抓取销售线索(leads)。