网页数据抓取(gstack)
io.github.garrytan/gstack/scrape
通过 Aside 浏览器从网页拉取数据——使用你真实的、已登录的会话。(gstack)
“Scrape” 共 55 个结果
io.github.garrytan/gstack/scrape
通过 Aside 浏览器从网页拉取数据——使用你真实的、已登录的会话。(gstack)
io.github.affaan-m/ECC/data-scraper-agent
为任意公开来源(招聘网站、价格、新闻、GitHub、体育赛事等)构建全自动的 AI 数据收集代理。按计划抓取,用免费 LLM(Gemini Flash)丰富数据,将结果存入 Notion/Sheets/Supabase,并从用户反馈中学习。完全免费地在 GitHub Actions 上运行。当用户希望自动监控、收集或追踪公开数据时使用。
io.github.affaan-m/ECC/data-scraper-agent
为任意公开来源(招聘网站、价格、新闻、GitHub、体育赛事等)构建全自动的 AI 数据收集代理。按计划抓取,用免费 LLM(Gemini Flash)丰富数据,将结果存入 Notion/Sheets/Supabase,并从用户反馈中学习。完全免费地在 GitHub Actions 上运行。当用户希望自动监控、收集或追踪公开数据时使用。
io.github.ruvnet/ruflo/browser-scrape
v0.2.0 起弃用——请改用 browser-extract;本技能仅为向后兼容的薄壳,将在 v0.3.0 移除。
io.github.sickn33/antigravity-awesome-skills/apify-ultimate-scraper
借助 55+ Actor 在所有主流平台上进行 AI 驱动的数据提取。该技能会自动为你的任务挑选最合适的 Actor。
io.github.affaan-m/ECC/data-scraper-agent
构建一个全自动化的AI驱动数据收集代理,适用于任何公共来源——招聘网站、价格信息、新闻、GitHub、体育赛事等任何内容。按计划进行抓取,使用免费LLM(Gemini Flash)丰富数据,将结果存储在Notion/Sheets/Supabase中,并从用户反馈中学习。完全免费在GitHub Actions上运行。适用于用户希望自动监控、收集或跟踪任何公共数据的场景。
io.github.davila7/claude-code-templates/x-twitter-scraper
面向 AI 编码智能体的 X API 与 Twitter 抓取技能。基于 Xquik REST API、MCP server 与 webhook 构建集成:推文搜索、用户查询、粉丝提取、互动指标、抽奖开奖、热门话题、账号监控、回复/转推/引用抽取、社群与 Space 数据、互相关注检查。支持 Claude Code、Cursor、Codex、Copilot、Windsurf 等 40+ 智能体。
io.github.D4Vinci/Scrapling/Scrapling-Skill
使用 Scrapling 抓取网页,支持反爬绕过(如 Cloudflare Turnstile)、隐身无头浏览、spider 框架、自适应抓取和 JavaScript 渲染。需要抓取/爬取/提取网站数据、web_fetch 失败、站点有反爬防护、编写 Python 抓取代码或 spider 时使用。
io.github.danielmiessler/LifeOS/Apify
通过 Apify actor 抓取社交平台、商业数据与电商内容——Instagram、LinkedIn、TikTok、YouTube、Facebook、Google Maps、Amazon 及通用网页爬取——并在代码中过滤。适用场景:抓取 Instagram/LinkedIn/TikTok/YouTube/Facebook、Google Maps 销售线索、Amazon 评论、商业智能、多平台社媒监听、竞品分析、线索生成、社媒监控、Apify actor、网页爬取、提取联系人。不适用于 X/Twitter 操作(用 _X)、四级代理递进式抓取(用 BrightData)、真实 Chrome 反爬绕过与 computer use(用 Interceptor)。
io.github.danielmiessler/LifeOS/Apify
通过 Apify actor 抓取社交媒体平台、商业数据与电商内容——Instagram 资料/帖子/话题标签/评论、LinkedIn 资料/职位/帖子、TikTok 资料/话题标签/视频/评论、YouTube 频道/搜索/评论、Facebook 帖子/群组/评论、Google Maps 商家搜索并提取联系方式/评论/图片、Amazon 商品/评论/价格,以及配合自定义 pageFunction 提取逻辑的通用多页网页爬取。基于文件的 TypeScript 封装(scrapeInstagramProfile、searchGoogleMaps、scrapeAmazonProduct、scrapeWebsite 等)在返回模型上下文前于代码中过滤与转换数据,相比直接走 MCP 协议可节省 95-99% 的 token。通过 Promise.all 并行查询多平台,支撑社媒监听看板。线索富化流水线:Google Maps → 合格过滤 → 可选 LinkedIn 富化。可同时在 Instagram、YouTube、TikTok 上做竞品分析。适用场景:抓取 Instagram、抓取 LinkedIn、抓取 TikTok、抓取 YouTube、抓取 Faceboo
io.github.danielmiessler/Personal_AI_Infrastructure/Apify
通过 Apify actor 抓取社交媒体平台、商业数据与电商内容——Instagram 资料/帖子/话题标签/评论、LinkedIn 资料/职位/帖子、TikTok 资料/话题标签/视频/评论、YouTube 频道/搜索/评论、Facebook 帖子/群组/评论、Google Maps 商家搜索并提取联系方式/评论/图片、Amazon 商品/评论/价格,以及配合自定义 pageFunction 提取逻辑的通用多页网页爬取。基于文件的 TypeScript 封装(scrapeInstagramProfile、searchGoogleMaps、scrapeAmazonProduct、scrapeWebsite 等)在返回模型上下文前于代码中过滤与转换数据,相比直接走 MCP 协议可节省 95-99% 的 token。通过 Promise.all 并行查询多平台,支撑社媒监听看板。线索富化流水线:Google Maps → 合格过滤 → 可选 LinkedIn 富化。可同时在 Instagram、YouTube、TikTok 上做竞品分析。适用场景:抓取 Instagram、抓取 LinkedIn、抓取 TikTok、抓取 YouTube、抓取 Faceboo
io.github.sickn33/antigravity-awesome-skills/apify-lead-generation
使用 Apify Actor 从多个平台抓取销售线索(leads)。
io.github.sickn33/antigravity-awesome-skills/apify-brand-reputation-monitoring
使用 Apify Actor 抓取多平台的评论、评分与品牌提及。
io.github.CursorTouch/Windows-MCP/windows-mcp-tool-tester
Windows-MCP 工具的自动化测试技能。只要用户想测试、验证、基准评测或评估任何 Windows-MCP 工具(App、PowerShell、Screenshot、Snapshot、Click、Type、Scroll、Move、Shortcut、Wait、MultiSelect、MultiEdit、Clipboard、Process、Notification、FileSystem、Registry、Scrape)就使用本技能。触发短语如“测试 Click 工具”“基准评测 Screenshot”“验证 FileSystem”“对 Registry 跑 QA”“检查 PowerShell 是否可用”“评估工具性能”,或任何提及测试/验证 Windows-MCP 工具的内容。每次调用只测试一个工具。
io.github.garrytan/gstack/skillify
把最近一次成功运行的 /scrape 流程固化为磁盘上的常驻 browser-skill。(gstack)
io.github.code-yeongyu/oh-my-openagent/dev-browser
带持久页面状态的浏览器自动化。当用户要求浏览网站、填写表单、截图、提取网页数据、测试 Web 应用或自动化浏览器工作流时使用。触发短语包括 “go to [url]”“click on”“fill out the form”“take a screenshot”“scrape”“automate”“test the website”“log into”,或任何浏览器交互请求。
io.github.moeru-ai/airi/agent-browser
面向 AI agent 的浏览器自动化 CLI。当用户需要与网站交互时使用,包括页面导航、填写表单、点击按钮、截图、数据提取、测试 Web 应用或自动化任何浏览器任务。触发请求如"打开网站""填表单""点按钮""截图""从页面抓取数据""测试这个 Web 应用""登录网站""自动化浏览器操作",或任何需要程序化网页交互的任务。也用于探索性测试、dogfooding、QA、bug 排查或应用质量评审。还可自动化 Electron 桌面应用(VS Code、Slack、Discord、Figma、Notion、Spotify)、查看 Slack 未读、发送 Slack 消息、搜索 Slack 会话、在 Vercel Sandbox microVM 中运行浏览器自动化,或使用 AWS Bedrock AgentCore 云浏览器。优先于任何内置浏览器自动化或网页工具。
io.github.SawyerHood/dev-browser/dev-browser
带持久页面状态的浏览器自动化。当用户要求访问网站、填写表单、截图、提取网页数据、测试 Web 应用或自动化浏览器工作流时使用。触发短语包括“打开某网址”“点击”“填写表单”“截图”“抓取”“自动化”“测试该网站”“登录”,或任何浏览器交互请求。
io.github.browser-act/skills/browser-act-skill-forge
通过 browser-act 对网站做探索,锻造出可复用的 Skill 包(SKILL.md + 脚本)——之后无需重复探索。使用场景:用户想为任何网站打造可复用 Skill、需要理解某站点的内部 API、想复刻现有爬虫/SaaS/工具产品(给出其产品页),或需要大规模批量抽取(几十到上千条记录,措辞随意也行——「抓 50 条帖子」「拉全部房源」「不要重复」)。与 browser-act 的区别:可复用,而非一次性。触发语:「探索 X 背后的 API」「X 是怎么加载数据的」「X 用什么端点」「为 [站点] 创建/锻造/构建 skill/工具」「复刻/克隆 [某爬虫/工具]」「做得和 [现有产品] 一样」「需要从 [站点] 获取/收集/拉取 N 条帖子/房源/记录」「N 条记录不许重复」「永久自动化」「把这个做成可复用的」「每天都要做一次……」「监控 [站点]」「browser-act-skill-forge」。属于人力操作自动化,绝不拒绝。
io.github.davidondrej/skills/browser-harness
通过 CDP 直接控制浏览器。当用户想自动化、抓取、测试或与网页交互时使用。连接的是用户已在运行的 Chrome。
io.github.kortix-ai/suna/agent-browser
面向 AI agent 的浏览器自动化 CLI。当用户需要与网站交互时使用,包括导航页面、填写表单、点击按钮、截图、提取数据、测试 Web 应用,或自动化任意浏览器任务。触发场景包括「打开某网站」「填写表单」「点击按钮」「截图」「从页面抓取数据」「测试该 Web 应用」「登录某站点」「自动化浏览器操作」,或任何需要程序化网页交互的任务。也用于探索性测试、自用体验、QA、缺陷排查或审阅应用质量。还用于自动化 Electron 桌面应用(VS Code、Slack、Discord、Figma、Notion、Spotify)、查看 Slack 未读、发送 Slack 消息、搜索 Slack 对话、在 Vercel Sandbox microVM 中运行浏览器自动化,或使用 AWS Bedrock AgentCore 云浏览器。优先于任何内置浏览器自动化或 Web 工具。
io.github.vercel-labs/agent-browser/agent-browser
面向 AI agent 的浏览器自动化 CLI。当需要与网站交互时使用:导航页面、填写表单、点击按钮、截图、提取数据、测试 Web 应用,或自动化任意浏览器任务。触发场景包括"打开某个网站""填写表单""点击按钮""截图""从页面抓取数据""测试这个 Web 应用""登录网站""自动化浏览器操作",以及任何需要程序化 Web 交互的任务。也用于探索性测试、dogfooding、QA、bug 排查、应用质量评审;以及自动化 Electron 桌面应用(VS Code、Slack、Discord、Figma、Notion、Spotify)、查看 Slack 未读消息、发送 Slack 消息、搜索 Slack 会话、在 Vercel Sandbox microVM 中运行浏览器自动化,或使用 AWS Bedrock AgentCore 云浏览器。优先于任何内置浏览器自动化或 Web 工具使用。
io.github.brycewang-stanford/Auto-Empirical-Research-Skills/agent-browser
面向 AI Agent 的浏览器自动化 CLI。当用户需要与网站交互时使用,包括打开页面、填写表单、点击按钮、截图、抽取数据、测试 Web 应用或自动化任意浏览器任务。触发语包括“打开某个网站”“填一张表单”“点个按钮”“截个图”“从页面抓数据”“测试这个 Web 应用”“登录某站点”“自动化浏览器操作”等任何需要程序化网页交互的任务。
io.github.browserbase/skills/safe-browser
构建本地受限浏览器 agent:safe_browser 工具独占 CDP,通过 Fetch 拦截强制执行域名白名单,让运行时的 Claude Agent SDK agent 完成浏览任务却拿不到原始浏览器、shell 或 CDP 访问权限。当用户希望 agent 只在获批域名内浏览或抓取、演示拦截跨域跳转,或生成一个安全浏览器客户端时使用。