爬虫代码重构
io.github.opensanctions/opensanctions/refactor-crawler
将杂乱或 AI 生成的爬虫代码重写为符合 zavod 最佳实践的整洁、生产级代码。当用户要求清理、重构、整理爬虫代码、“达到生产可用”或对齐最佳实践时使用。
“Crawl” 共 9 个结果
io.github.opensanctions/opensanctions/refactor-crawler
将杂乱或 AI 生成的爬虫代码重写为符合 zavod 最佳实践的整洁、生产级代码。当用户要求清理、重构、整理爬虫代码、“达到生产可用”或对齐最佳实践时使用。
io.github.jeremylongshore/claude-code-plugins-plus-skills/firecrawl-deploy-integration
将 Firecrawl 集成部署到 Vercel、Cloud Run 与 Docker。用于把 Firecrawl 驱动的应用部署到生产、配置平台密钥或自建 Firecrawl。触发语如 “deploy firecrawl”、“firecrawl Vercel”、“firecrawl production deploy”、“firecrawl Cloud Run”、“firecrawl Docker”。
io.github.openclaw/openclaw/slacrawl
Slack 归档:搜索、同步新鲜度、线程/私信、SQL 统计,以及 Slacrawl 仓库相关工作。
io.github.openclaw/openclaw/graincrawl
Granola 归档:搜索、同步新鲜度、笔记、会议记录、面板、SQL 统计,以及 Graincrawl 仓库相关工作。
io.github.openclaw/openclaw/notcrawl
Notion 归档:搜索、同步新鲜度、页面/数据库、Markdown 导出、SQL 统计,以及 Notcrawl 仓库相关工作。
io.github.openclaw/openclaw/gitcrawl
GitHub 归档:issue/PR 搜索、同步新鲜度、重复聚类、gh-shim PR 状态,以及 Gitcrawl 仓库相关工作。
io.github.D4Vinci/Scrapling/Scrapling-Skill
使用 Scrapling 抓取网页,支持反爬绕过(如 Cloudflare Turnstile)、隐身无头浏览、spider 框架、自适应抓取和 JavaScript 渲染。需要抓取/爬取/提取网站数据、web_fetch 失败、站点有反爬防护、编写 Python 抓取代码或 spider 时使用。
io.github.danielmiessler/LifeOS/Apify
通过 Apify actor 抓取社交平台、商业数据与电商内容——Instagram、LinkedIn、TikTok、YouTube、Facebook、Google Maps、Amazon 及通用网页爬取——并在代码中过滤。适用场景:抓取 Instagram/LinkedIn/TikTok/YouTube/Facebook、Google Maps 销售线索、Amazon 评论、商业智能、多平台社媒监听、竞品分析、线索生成、社媒监控、Apify actor、网页爬取、提取联系人。不适用于 X/Twitter 操作(用 _X)、四级代理递进式抓取(用 BrightData)、真实 Chrome 反爬绕过与 computer use(用 Interceptor)。
io.github.sickn33/antigravity-awesome-skills/nextjs-seo-indexing
修复 Next.js 应用的 SEO 索引问题、抓取配额(crawl budget)问题与 Search Console 覆盖率错误。涵盖 canonical 标签、noindex 审计、sitemap 健康检查、静态渲染与内部链接。