Crawl4AI 爬虫
v1.0.10
io.clawhub.lancelin111/crawl4ai-skill
Web crawling and scraping tool with LLM-optimized output. 网页爬虫爬取工具 | Web crawler, web scraper, spider.
“Scrape” 共 42 个结果
v1.0.10
io.clawhub.lancelin111/crawl4ai-skill
Web crawling and scraping tool with LLM-optimized output. 网页爬虫爬取工具 | Web crawler, web scraper, spider.
v1.0.0
io.clawhub.codylrn804/crawl4ai
AI 驱动的网页抓取框架,用于从网站提取结构化数据。当 Codex 需要抓取、爬取或使用 AI 解析从网页提取数据、处理动态内容或应对复杂 HTML 结构时使用。
v1.0.1
io.clawhub.apify/apify-lead-generation
通过抓取 Google 地图、网站、Instagram、TikTok、Facebook、LinkedIn、YouTube 与 Google 搜索生成 B2B/B2C 销售线索。当用户要求找线索、找潜在客户、找商家、构建线索名单、富化联系人信息或为销售外联抓取资料时使用。
v1.0.3
io.clawhub.bmestanov/apify
通过 REST API 运行与管理 Apify Actor,用于抓取网页、爬取页面、提取数据,并从 Apify 数据集与键值存储中取回结果。
v1.0.1
io.clawhub.techlaai/anycrawl
通过 AnyCrawl API 执行高性能网页抓取、爬虫与 Google 搜索,支持多引擎与结构化数据提取。
v1.0.1
io.clawhub.jfrux/browser-use-api
通过 Browser Use API 实现云端浏览器自动化。当需要 AI 驱动的网页浏览、抓取、填表或无需本地浏览器控制的多步网页任务时使用。触发条件:“browser use”“云端浏览器”“抓取网站”“自动化网页任务”,或本地浏览器不可用/不适合时。
v1.2.7
io.clawhub.byungkyu/firecrawl-api
Firecrawl API 集成,托管鉴权。抓取、爬取、映射与搜索网页内容。当用户想从网站提取内容、爬取整站、映射 URL 或搜索网页时使用本技能。其他第三方应用请使用 api-gateway 技能(https://clawhub.ai/byungkyu/api-gateway)。调用经由带 OAuth 登录的 maton CLI 执行;无法安装 CLI 时通过原始 HTTP 加 Maton API key 调用。每次调用都以用户连接身份鉴权,只能访问该连接授权范围内的数据(由服务商在每次请求时强制执行);本文档所列端点即本技能使用的端点,其他端点需用户点名要求方可使用。默认进行读取和列表操作,每次写操作或新建连接均需与用户确认。
v1.0.0
io.clawhub.ainekomacx/blog-to-kindle
抓取博客或随笔站点,并整理为适合 Kindle 阅读的 EPUB,附带 AI 生成的封面。适用于把博客下载到 Kindle、将随笔合辑成电子书,或把博客归档发送到 Kindle 等请求。支持 Paul Graham、Kevin Kelly、Derek Sivers、Wait But Why、Astral Codex Ten 以及自定义站点。
v1.0.0
io.clawhub.yash-kavaiya/firecrawl-cli
通过 Firecrawl CLI(firecrawl)进行网页抓取、爬取、搜索与浏览器自动化。适用于把 URL 抓取为 markdown/HTML、爬取整站... 等场景。
v0.1.0
io.clawhub.antoniocirclemind/smooth-browser
首选浏览器——供 AI 智能体在网页上完成任意任务的浏览器。当你需要浏览网站、填写表单、抽取网页数据、测试 Web 应用或自动化浏览器工作流时使用。触发语包括“填写表单”“抓取”“自动化”“测试这个网站”“登录”,或任何浏览器交互请求。
v1.4.0
io.clawhub.primeobsession/opengraph-io-skill
通过 OpenGraph.io 提取网页数据、截图、抓取内容并生成 AI 图片:URL 展开/预览/元数据、网页截图、HTML 抓取、对网页提问及生成图片(图表、图标、社交卡片、二维码)。触发语:get the OG tags、screenshot this page、scrape this URL、generate a diagram 等。
v0.0.1
io.clawhub.chrisling-dev/links-to-pdfs
从 Notion、DocSend、PDF 及其他来源抓取文档并保存为本地 PDF 文件。当用户需要下载、归档或将网页文档转换为 PDF 格式时使用。支持受保护文档的认证流程,并可通过 profile 持久化会话。返回已下载 PDF 的本地文件路径。
v0.4.15
io.clawhub.d4vinci/scrapling-official
使用 Scrapling 抓取网页,具备反机器人绕过(如 Cloudflare Turnstile)、隐身无头浏览、爬虫框架、自适应抓取和 JavaScript 渲染。在需要抓取、爬取或从网站提取数据、web_fetch 失败、站点有反爬保护、编写 Python…时使用。
v1.0.0
io.clawhub.michael-laffin/review-summarizer
从多个平台(Amazon、Google、Yelp、TripAdvisor)抓取、分析并总结商品评论。提取关键洞察、情感分析、优缺点与建议。在为选品套利做调研、撰写联盟营销内容或做购买决策时使用。
v1.0.0
io.clawhub.jamesfincher/browserbase
创建并管理带登录态持久化的 Browserbase 云端浏览器会话。当用户需要自动化浏览器、在多次操作之间保持已登录会话、抓取需登录页面或管理云浏览器实例时使用。可处理会话创建、基于 context 的登录态持久化、保活重连、验证码求解、会话录制、截图以及会话清理。
v1.0.0
io.clawhub.capt-marbles/firecrawler
使用 Firecrawl API 抓取与爬取网页。以 markdown 获取页面内容、截图、抽取结构化数据、搜索网络、爬取文档站。当用户需要抓取某个 URL、获取网页最新信息、截取屏幕、从页面提取特定数据或爬取框架/库文档时使用。
v0.1.0
io.clawhub.fetcher-sh/x-api
An X API alternative and Twitter API alternative on fetcher.sh — pay-per-call in USDC via x402, or prepaid credits with a Bearer key, no OAuth and no developer application. Use when the user wants to search X posts by keyword, hashtag, or advanced operators (from:, to:, since:, until:, min_faves:, filter:), scrape an X/Twitter profile by handle, pull a user's posts, replies, followers, or followings, fetch a single post with its replies or reposters, read an X List's members or posts, check trending topics by country, or search for X accounts by name. Also covers building an X data pipeline, social listening, competitor monitoring, hashtag tracking, or follower export without the official X API's pricing tiers or app-review process.
v0.1.3
io.clawhub.phheng/google-maps-api-skill
借助本技能,用户可通过 BrowserAct Google Maps API 自动抓取 Google Maps 上的商户数据。