browser-scrape(浏览器抓取,已弃用)
io.github.ruvnet/ruflo/browser-scrape
v0.2.0 起弃用——请改用 browser-extract;本技能仅为向后兼容的薄壳,将在 v0.3.0 移除。
“scrape” 共 97 个结果
io.github.ruvnet/ruflo/browser-scrape
v0.2.0 起弃用——请改用 browser-extract;本技能仅为向后兼容的薄壳,将在 v0.3.0 移除。
io.github.sickn33/antigravity-awesome-skills/apify-ultimate-scraper
借助 55+ Actor 在所有主流平台上进行 AI 驱动的数据提取。该技能会自动为你的任务挑选最合适的 Actor。
io.github.affaan-m/ECC/data-scraper-agent
构建一个全自动化的AI驱动数据收集代理,适用于任何公共来源——招聘网站、价格信息、新闻、GitHub、体育赛事等任何内容。按计划进行抓取,使用免费LLM(Gemini Flash)丰富数据,将结果存储在Notion/Sheets/Supabase中,并从用户反馈中学习。完全免费在GitHub Actions上运行。适用于用户希望自动监控、收集或跟踪任何公共数据的场景。
io.github.davila7/claude-code-templates/x-twitter-scraper
面向 AI 编码智能体的 X API 与 Twitter 抓取技能。基于 Xquik REST API、MCP server 与 webhook 构建集成:推文搜索、用户查询、粉丝提取、互动指标、抽奖开奖、热门话题、账号监控、回复/转推/引用抽取、社群与 Space 数据、互相关注检查。支持 Claude Code、Cursor、Codex、Copilot、Windsurf 等 40+ 智能体。
v1.0.0
io.clawhub.zhengxinjipai/scrapling-web-scraper
面向 OpenClaw 的零机器人检测网页抓取。绕过 Cloudflare、处理重 JavaScript 网站,并自动适应网站改版。当你需要……时使用。
v1.0.0
io.clawhub.ashwingupy/firecrawl-search
通过 Firecrawl API 进行网页搜索与抓取。适用于搜索网页、抓取网站(含 JS 重度页面)、爬取整站或从页面提取结构化数据。需要 FIRECRAWL_API_KEY 环境变量。
v1.0.0
io.clawhub.browseract-cli/browser-act-skill-forge-skill
通过 browser-act 对网站做一次探索,即可锻造出可复用的 Skill 包(SKILL.md + 脚本),此后无需重复探索。
v1.0.10
io.clawhub.lancelin111/crawl4ai-skill
Web crawling and scraping tool with LLM-optimized output. 网页爬虫爬取工具 | Web crawler, web scraper, spider.
v1.0.0
io.clawhub.codylrn804/crawl4ai
AI 驱动的网页抓取框架,用于从网站提取结构化数据。当 Codex 需要抓取、爬取或使用 AI 解析从网页提取数据、处理动态内容或应对复杂 HTML 结构时使用。
v1.0.1
io.clawhub.apify/apify-lead-generation
通过抓取 Google 地图、网站、Instagram、TikTok、Facebook、LinkedIn、YouTube 与 Google 搜索生成 B2B/B2C 销售线索。当用户要求找线索、找潜在客户、找商家、构建线索名单、富化联系人信息或为销售外联抓取资料时使用。
v1.0.3
io.clawhub.bmestanov/apify
通过 REST API 运行与管理 Apify Actor,用于抓取网页、爬取页面、提取数据,并从 Apify 数据集与键值存储中取回结果。
v1.0.1
io.clawhub.techlaai/anycrawl
通过 AnyCrawl API 执行高性能网页抓取、爬虫与 Google 搜索,支持多引擎与结构化数据提取。
v1.0.1
io.clawhub.jfrux/browser-use-api
通过 Browser Use API 实现云端浏览器自动化。当需要 AI 驱动的网页浏览、抓取、填表或无需本地浏览器控制的多步网页任务时使用。触发条件:“browser use”“云端浏览器”“抓取网站”“自动化网页任务”,或本地浏览器不可用/不适合时。
v1.2.7
io.clawhub.byungkyu/firecrawl-api
Firecrawl API 集成,托管鉴权。抓取、爬取、映射与搜索网页内容。当用户想从网站提取内容、爬取整站、映射 URL 或搜索网页时使用本技能。其他第三方应用请使用 api-gateway 技能(https://clawhub.ai/byungkyu/api-gateway)。调用经由带 OAuth 登录的 maton CLI 执行;无法安装 CLI 时通过原始 HTTP 加 Maton API key 调用。每次调用都以用户连接身份鉴权,只能访问该连接授权范围内的数据(由服务商在每次请求时强制执行);本文档所列端点即本技能使用的端点,其他端点需用户点名要求方可使用。默认进行读取和列表操作,每次写操作或新建连接均需与用户确认。
v1.0.0
io.clawhub.ainekomacx/blog-to-kindle
抓取博客或随笔站点,并整理为适合 Kindle 阅读的 EPUB,附带 AI 生成的封面。适用于把博客下载到 Kindle、将随笔合辑成电子书,或把博客归档发送到 Kindle 等请求。支持 Paul Graham、Kevin Kelly、Derek Sivers、Wait But Why、Astral Codex Ten 以及自定义站点。
v1.0.0
io.clawhub.yash-kavaiya/firecrawl-cli
通过 Firecrawl CLI(firecrawl)进行网页抓取、爬取、搜索与浏览器自动化。适用于把 URL 抓取为 markdown/HTML、爬取整站... 等场景。
v0.1.0
io.clawhub.antoniocirclemind/smooth-browser
首选浏览器——供 AI 智能体在网页上完成任意任务的浏览器。当你需要浏览网站、填写表单、抽取网页数据、测试 Web 应用或自动化浏览器工作流时使用。触发语包括“填写表单”“抓取”“自动化”“测试这个网站”“登录”,或任何浏览器交互请求。
v1.4.0
io.clawhub.primeobsession/opengraph-io-skill
通过 OpenGraph.io 提取网页数据、截图、抓取内容并生成 AI 图片:URL 展开/预览/元数据、网页截图、HTML 抓取、对网页提问及生成图片(图表、图标、社交卡片、二维码)。触发语:get the OG tags、screenshot this page、scrape this URL、generate a diagram 等。
v0.0.1
io.clawhub.chrisling-dev/links-to-pdfs
从 Notion、DocSend、PDF 及其他来源抓取文档并保存为本地 PDF 文件。当用户需要下载、归档或将网页文档转换为 PDF 格式时使用。支持受保护文档的认证流程,并可通过 profile 持久化会话。返回已下载 PDF 的本地文件路径。
v0.4.15
io.clawhub.d4vinci/scrapling-official
使用 Scrapling 抓取网页,具备反机器人绕过(如 Cloudflare Turnstile)、隐身无头浏览、爬虫框架、自适应抓取和 JavaScript 渲染。在需要抓取、爬取或从网站提取数据、web_fetch 失败、站点有反爬保护、编写 Python…时使用。
v1.0.0
io.clawhub.michael-laffin/review-summarizer
从多个平台(Amazon、Google、Yelp、TripAdvisor)抓取、分析并总结商品评论。提取关键洞察、情感分析、优缺点与建议。在为选品套利做调研、撰写联盟营销内容或做购买决策时使用。
io.github.D4Vinci/Scrapling/Scrapling-Skill
使用 Scrapling 抓取网页,支持反爬绕过(如 Cloudflare Turnstile)、隐身无头浏览、spider 框架、自适应抓取和 JavaScript 渲染。需要抓取/爬取/提取网站数据、web_fetch 失败、站点有反爬防护、编写 Python 抓取代码或 spider 时使用。
io.github.danielmiessler/LifeOS/Apify
通过 Apify actor 抓取社交平台、商业数据与电商内容——Instagram、LinkedIn、TikTok、YouTube、Facebook、Google Maps、Amazon 及通用网页爬取——并在代码中过滤。适用场景:抓取 Instagram/LinkedIn/TikTok/YouTube/Facebook、Google Maps 销售线索、Amazon 评论、商业智能、多平台社媒监听、竞品分析、线索生成、社媒监控、Apify actor、网页爬取、提取联系人。不适用于 X/Twitter 操作(用 _X)、四级代理递进式抓取(用 BrightData)、真实 Chrome 反爬绕过与 computer use(用 Interceptor)。
io.github.danielmiessler/LifeOS/Apify
通过 Apify actor 抓取社交媒体平台、商业数据与电商内容——Instagram 资料/帖子/话题标签/评论、LinkedIn 资料/职位/帖子、TikTok 资料/话题标签/视频/评论、YouTube 频道/搜索/评论、Facebook 帖子/群组/评论、Google Maps 商家搜索并提取联系方式/评论/图片、Amazon 商品/评论/价格,以及配合自定义 pageFunction 提取逻辑的通用多页网页爬取。基于文件的 TypeScript 封装(scrapeInstagramProfile、searchGoogleMaps、scrapeAmazonProduct、scrapeWebsite 等)在返回模型上下文前于代码中过滤与转换数据,相比直接走 MCP 协议可节省 95-99% 的 token。通过 Promise.all 并行查询多平台,支撑社媒监听看板。线索富化流水线:Google Maps → 合格过滤 → 可选 LinkedIn 富化。可同时在 Instagram、YouTube、TikTok 上做竞品分析。适用场景:抓取 Instagram、抓取 LinkedIn、抓取 TikTok、抓取 YouTube、抓取 Faceboo