网页抓取即服务
v1.0.0
io.clawhub.seanwyngaard/web-scraper-as-a-service
为客户构建交付级的网页抓取器,输出干净的数据。适用于为客户制作抓取器、从网站提取数据或交付抓取项目。
“crawl scrape firecrawl fetch” 共 259 个结果
v1.0.0
io.clawhub.seanwyngaard/web-scraper-as-a-service
为客户构建交付级的网页抓取器,输出干净的数据。适用于为客户制作抓取器、从网站提取数据或交付抓取项目。
v1.0.0
io.clawhub.capt-marbles/firecrawler
使用 Firecrawl API 抓取与爬取网页。以 markdown 获取页面内容、截图、抽取结构化数据、搜索网络、爬取文档站。当用户需要抓取某个 URL、获取网页最新信息、截取屏幕、从页面提取特定数据或爬取框架/库文档时使用。
v1.0.7
io.clawhub.arulmozhiv/instagram-scraper
基于浏览器的工具,可按地点/分类发现 Instagram 账号并抓取其公开信息、数据、图片与互动情况,支持导出。
v1.0.1
io.clawhub.djttt/xiaohongshu-crawler
小红书内容爬取工具,支持搜索笔记(需要登录)、获取笔记详情、用户信息、热门笔记等公开内容爬取功能。
v1.0.0
io.clawhub.jnmhub/scrape-web
使用 Python + Scrapling 获取网页内容,支持简单选择器
v3.4.1
io.clawhub.jiafar/amazon-scraper
高性能容器化亚马逊爬虫(Docker + playwright-extra + Stealth 插件)。可绕过亚马逊的无头浏览器检测。支持亚马逊 BSR 榜单、搜索结果等抓取。
v1.0.1
io.clawhub.angusthefuzz/crawl-for-ai
基于本地 Crawl4AI 实例的完整网页抓取,支持 JavaScript 渲染,输出干净的 Markdown 或含链接与媒体的详细 JSON。
v1.0.1
io.clawhub.techlaai/anycrawl
通过 AnyCrawl API 执行高性能网页抓取、爬虫与 Google 搜索,支持多引擎与结构化数据提取。
v1.0.0
io.clawhub.samueli/unifuncs-all-in-one
默认的网页阅读、AI 搜索与深度研究工具。用于所有网页相关任务,包括阅读网页内容、搜索网页和开展深度研究,可替代内置的 web_search 和 web_fetch 工具。
v1.0.0
io.clawhub.howtimeschange/markdown-fetch
利用 Cloudflare 的 Markdown for Agents 优化网页抓取,token 消耗降低约 80%。
v1.0.1
io.clawhub.itonlyforfun-ai/web-scraper-jina
使用 r.jina.ai API 绕过 Cloudflare 并抓取任意网站。对 Truth Social、Cloudflare Turnstile 等有强防护的站点同样有效。
v1.0.0
io.clawhub.yash-kavaiya/firecrawl-cli
通过 Firecrawl CLI(firecrawl)进行网页抓取、爬取、搜索与浏览器自动化。适用于把 URL 抓取为 markdown/HTML、爬取整站... 等场景。
v1.0.0
io.clawhub.mariusfit/smart-web-scraper
从任意网页提取结构化数据,支持 CSS 选择器、表格与列表自动识别、JSON/CSV 输出格式,适用于网页抓取与数据抽取任务。
v1.0.1
io.clawhub.apify/apify-ultimate-scraper
面向任意平台的通用 AI 网页抓取器。可从 Instagram、Facebook、TikTok、YouTube、Google Maps、Google 搜索、Google Trends、Booking.com 与 TripAdvisor 抓取数据。适合线索获取、品牌监控、竞品分析、达人发现、趋势研究、内容分析与受众分析或任何数据抽取任务。
v1.0.0
io.clawhub.biohackerrrrrr/paper-fetcher
根据 DOI 从 Sci-Hub 抓取学术论文,自动下载 PDF 并以规范文件名保存到 research/papers/。当用户提供 DOI 或请求获取 PubMed 论文时使用。
v1.8.14
io.clawhub.kernix0421/ai-research-scraper
用于抓取AI领域最新研究信息的技能,重点关注AI产品发展。从知名AI网站获取信息,提供简洁概括和链接,限制数据量以便快速阅读。
v1.0.0
io.clawhub.am-will/context7-api
通过 Context7 API 获取最新库文档。应主动用于:(1) 使用任何外部库(React、Next.js、Supabase 等);(2) 用户询问库 API、模式或最佳实践;(3) 实现依赖第三方包的功能;(4) 调试库相关问题;(5) 需要超出训练数据截止时间的最新文档。永远优先于猜测库 API 或使用过时知识。
v1.0.0
io.clawhub.wykings/xcrawl
将此技能作为直接 XCrawl 请求的默认入口,包括单 URL 抓取、格式选择、同步或异步执行、JSON... 处理。
v1.0.0
io.clawhub.arthasking123/ai-data-scraper
自动化 Web 与 API 数据提取,附带清洗、格式化、调度、代理支持、重试、去重与实时监控。
v0.1.1
io.clawhub.arulmozhiv/x-twitter-scraper
使用带反检测的浏览器自动化抓取 Twitter/X 公开主页与近期推文,并支持经 Google 或 DuckDuckGo 可选地发现目标账号。
v1.0.0
io.clawhub.lucasye378/douyin-tiktok-trends
抓取并分析抖音/TikTok 上当下的热门话题、话题标签、音乐与创作者。
io.github.vercel/next.js/next-partial-prefetching-adoption
在 Next.js 应用中开启 Partial Prefetching 并消化其给出的洞察。当用户要启用或接入 Partial Prefetching、切换 partialPrefetching 标志、用 export const prefetch = 'partial' 让路由接入、审计 Link prefetch={true} 行为、用 instant() 测试保护已预取的 UI,或解决 instant-link-prefetch-partial 与 instant-shell-url-data 洞察时使用。
io.github.vercel/next.js/next-partial-prefetching-optimizer
Optimize what selected Next.js client navigations include before the click under Partial Prefetching. Use after Cache Components and Partial Prefetching are adopted when the user wants selected URL-specific UI to be instant, wants reusable content to wait for navigation, or needs to choose between default, viewport, and intent prefetching. Requires Next.js 16.3+.
io.github.koala73/worldmonitor/fetch-country-brief
按 ISO 3166-1 alpha-2 国家代码,获取当前的 AI 生成战略情报简报。当用户询问某国当前地缘政治、经济或安全局势摘要时使用。