mmx-cli
io.github.MiniMax-AI/skills/minimax-multimodal-toolkit
使用 mmx 通过 MiniMax AI 平台生成文本、图像、视频、语音与音乐。当用户想在终端里创作媒体内容、与 MiniMax 模型对话、执行网页搜索或管理 MiniMax API 资源时使用。
“Images” 共 639 个结果
io.github.MiniMax-AI/skills/minimax-multimodal-toolkit
使用 mmx 通过 MiniMax AI 平台生成文本、图像、视频、语音与音乐。当用户想在终端里创作媒体内容、与 MiniMax 模型对话、执行网页搜索或管理 MiniMax API 资源时使用。
io.github.leonxlnx/taste-skill/image-to-code-skill
面向 Codex 的图生代码技能,先出设计图再实现网站。
io.github.leonxlnx/taste-skill/imagegen-frontend-web
按页面板块逐张生成横向设计参考图,保持统一配色。
io.github.prime-skills/runcomfy-agent-skills/nano-banana-2
在 RunComfy 上用 Google Nano Banana 2 生成图像并附提示词范式。
io.github.prime-skills/runcomfy-agent-skills/image-edit
在 RunComfy 上按意图自动匹配最合适的图像编辑模型。
io.github.prime-skills/runcomfy-agent-skills/nano-banana-edit
用 Nano Banana 2 做图生图编辑,可保留主体或换背景。
io.github.leonxlnx/taste-skill/imagegen-frontend-mobile
生成 App 原生风格的界面概念与流程设计图,仅出图。
io.smithery.henry-ships.sparkforge
调用一整套媒体生成、网页抓取与加密货币研究工具。在多种数据格式之间转换、总结长文档,并从图片或 PDF 中提取文本。把 SEO 元数据抽取、代码审查、内容创作等任务自动化,简化你的工作流。
v1.0.1
io.clawhub.steipete/nano-banana-pro
用 Nano Banana Pro(Gemini 3 Pro Image)生成/编辑图像,适用于图像创建与修改(含编辑)请求。支持文生图与图生图,1K/2K/4K,可用 --input-image。
io.smithery.brave
用 Brave 独立索引搜索网页——网页、新闻、图片与视频。请在 Brave Search API 控制台(https://api-dashboard.search.brave.com)获取并自带订阅令牌。
v1.0.0
io.clawhub.steipete/markdown-converter
使用 markitdown 将文档与文件转换为 Markdown。在转换 PDF、Word(.docx)、PowerPoint(.pptx)、Excel(.xlsx/.xls)、HTML、CSV、JSON、XML、图片(含 EXIF/OCR)、音频(含转写)、ZIP 归档、YouTube 链接或 EPub 为 Markdown 以供 LLM 处理或文本分析时使用。
v1.0.0
io.clawhub.billyutw/web-search
当用户需要搜索网页信息、查找当前内容、检索新闻文章、图片或视频时使用。基于 DuckDuckGo 搜索 API,以干净的格式化输出返回(文本、markdown 或 JSON)。适用于调研、事实核查、查找最新信息或收集网络资源。
v1.0.3
io.clawhub.abk234/searxng
基于本地 SearXNG 实例的隐私友好型元搜索。无需依赖外部 API 即可搜索网页、图片、新闻等。
v1.0.0
io.clawhub.shaw555/ocr-local
使用 Tesseract.js OCR 从图片中提取文字(100% 本地运行,无需 API Key)。支持中文(简体/繁体)与英文。
v2.0.21
io.clawhub.cellcog/cellcog
任意输入到任意输出的 AI 子智能体——一次请求即可完成调研、图像、视频、音频、音乐、播客、数字人、语音克隆、文档、表格、仪表盘、3D 模型、图示与代码。采用智能体间协议并支持多步迭代以保证精度。DeepResearch Bench 第一名(2026 年 4 月)——深度推理覆盖所有模态,因此你的所有工作都能完成,而不只是代码。
v1.2.8
io.clawhub.byungkyu/klaviyo
Klaviyo API 集成,采用托管式 OAuth。访问用户档案、列表、细分、营销活动、自动化流程、事件、指标、模板、商品目录、webhook、标签、优惠券、图片、表单、评测与账号设置。当用户需要管理邮件营销、客户数据或对接 Klaviyo 工作流时使用本技能;其他第三方应用请使用 api-gateway 技能(https://clawhub.ai/byungkyu/api-gateway)。调用通过 `maton` CLI 配合 OAuth 登录执行,或在无法安装 CLI 时凭 Maton API Key 走原始 HTTP。每次调用都以用户连接身份认证,仅能访问该连接授权范围内的数据,服务端对每个请求强制执行鉴权;此处记录的端点即本技能所用端点,若需该应用的其他端点,须由用户点名提出。默认只做读取与列表调用,任何写入或新连接都需经用户确认。本文件还按使用顺序记录把 Klaviyo 连接变成自动化的三个构件……(原文截断)
v1.0.17
io.clawhub.cellcog/image-generation-cellcog
由 CellCog 驱动的 AI 图像生成与图片编辑。文生图、图生图、角色一致性、商品摄影、基于参考图生成、风格迁移、成套图片、社媒视觉、品牌资产、贴纸、漫画、GIF。用多种 AI 模型完成专业图像创作。
v1.0.10
io.clawhub.ivangdavila/docker
构建、调试、加固并交付 Docker 容器、镜像与 Compose 栈。在以下情况使用:编写或评审 Dockerfile、compose 文件或 CI 构建步骤时;容器秒退、无限重启循环、被 OOM 杀掉、停止时卡住或退出码 137/139/127 时;发布端口不通、容器互相无法解析或经 VPN 后请求挂起时;磁盘被占满且 `/var/lib/docker` 无法清理时;构建缓慢、缓存永不命中或仅在 CI 失败时;遇到 `exec format error` 或 musl 与 glibc 不兼容时;选择基础镜像或多阶段布局时;registry 登录失败或拉取限流时;密钥必须留在镜像历史之外时;以及卷需要备份、恢复或修权限时。涵盖 Compose 陷阱与 Desktop/colima/OrbStack/Podman 差异。不适用于 Kubernetes 清单与集群调度(`k8s`)。
v1.0.0
io.clawhub.xejrax/image-ocr
使用 Tesseract OCR 从图像中提取文字。
v1.0.0
io.clawhub.olliewazza/larry
为任意应用或产品自动化 TikTok 图文营销:竞品调研、AI 图像生成、文字叠加、经 Postiz 发帖、跟踪分析……(原文截断)
v2.0.15
io.clawhub.nitishgargiitd/cellcog
任意输入到任意输出的 AI 子代理——调研、图像、视频、音频、音乐、播客、数字人、声音克隆、文档、电子表格、仪表盘、3D 模型、图表等……(原文截断)
v2.0.0
io.clawhub.ipedrax/antigravity-image-gen
使用内部 Google Antigravity API(Gemini 3 Pro Image)生成图像。高质量原生生成,无需浏览器自动化。
v1.0.0
io.clawhub.garrisongg/summarize-1-0-0
使用 summarize CLI 摘要 URL 或文件(网页、PDF、图像、音频、YouTube)。
v1.2.0
io.clawhub.degausai/wonda
使用 Wonda CLI 在终端生成图像、视频、音乐与音频——并支持 LinkedIn、Reddit 和 X/Twitter 的调研与自动化。