图片 OCR 识别
v1.0.0
使用 OCR 从图片中提取文字,支持中英文,兼容 jpg、png、jpeg 等常见格式。
使用场景/设计与创意
Figma、图像生成、品牌素材。适合产品、运营、设计协作。
共匹配 1,857 个资源 · 第 4 / 39 页
设计类 MCP 把设计工具与图像生成能力接入 AI 工作流:Figma MCP 让 AI 读取设计稿的图层、变量与组件结构,直接生成对齐设计稿的前端代码;图像生成类 MCP 负责配图、图标与营销素材的批量产出。
典型用法:设计师在 Figma 中标注组件 → 开发者在 Cursor 中通过 Figma MCP 拉取节点信息 → AI 生成与设计系统一致的 React / Vue 代码。评审环节可以让 AI 对照设计稿截图做还原度检查。
注意版权与授权:仅处理团队有权访问的 Figma 文件;生成图片素材时确认模型的商用条款;字体与第三方素材仍需单独授权。
v1.0.0
使用 OCR 从图片中提取文字,支持中英文,兼容 jpg、png、jpeg 等常见格式。
v1.3.26
图像仿写工具:分析原图的视觉效果、构图、色彩、光影和风格,生成重绘提示词,并交给 Seedream 4.5 生成具有相同风格的新图像。
v2.1.1
数据库设计器(Database Designer)——POWERFUL 级别技能。
v0.1.0
打造有辨识度、可上生产的高品质前端界面。当用户要求构建 Web 组件、页面、artifact、海报或应用(如网站、落地页、仪表盘、React 组件、HTML/CSS 布局,或为任意 Web UI 做 styling/美化)时使用。生成富有创意、精致的代码与 UI 设计,避免千篇一律的 AI 审美。
v1.0.0
重构并审查 SwiftUI 视图文件,统一结构、依赖注入与 Observation 的用法。当被要求整理 SwiftUI 视图的布局与顺序、更安全地处理视图模型(尽量使用非可选类型),或统一依赖与 @Observable 状态的初始化和传递方式时使用。
v1.0.0
把表格渲染成图片,以便在 Telegram 等聊天应用中更易读。展示表格数据时使用。
v1.0.0
从 URL、截图和已有文档出发,生成完整的网站风格指南与设计系统。当用户要求基于某个网站、应用或现有资料创建风格指南、设计系统文档、品牌规范或设计说明时使用。该技能产出符合行业标准结构的规范 PDF 文档。
v1.0.0
全面的 UI 设计技能,涵盖基本功、设计模式与反模式。布局、字体排印、色彩、间距、无障碍、动效与组件设计。在构建任何 Web 界面、评审设计质量或打造独特 UI 时使用。
v0.1.0
当用户需要为 LinkedIn、Twitter/X、Instagram、TikTok、Facebook 等平台创作、排期或优化社媒内容时使用。也在用户提到「LinkedIn 帖子」「Twitter 长文」「社媒」「内容日历」「社媒排期」「互动」或「爆款内容」时使用。本技能涵盖内容创作、内容复用和平台专属策略。
v1.0.1
把 Canvas 当作应用平台:在 OpenClaw Canvas 上构建、存储并运行丰富的可视化应用。
v1.2.0
上传图片到 img402.dev 并获得公开 URL。1MB 及以下的图片免费且永久保存——无需账号、API 密钥或付费。更大的图片(至 10MB)免费保留 30 天,或通过 x402 支付 0.01 USDC 永久保存。当智能体需要一个托管图片 URL 时使用——用于消息分享、文档嵌入、发布到社交平台,或任何需要图片公开链接的场景。
v1.1.0
连接 ComfyUI 服务器,根据提示词生成图像,自动检测 URL,支持中文提示词转换,兼容 REST 与 WebSocket API。
v1.0.0
构建完整的本地获客网站,含 SEO 优化、转化跟踪和 RGPD 合规。用于面向本地市场(水管工、电工、家政服务等)创建含 10-20 个页面、结构化数据、统计与法规合规的服务型网站。
v0.1.0
使用 ImageRouter API 调用任意模型生成 AI 图片(需要 API Key)。
v1.0.1
从前端代码库提取可复用的 UI/UX 设计系统:设计令牌、全局样式、组件、交互模式与页面模板。分析任意前端仓库(React/Vue/Angular/Next/Vite 等)以沉淀或迁移 UI/UX 供跨项目复用时使用。只关注 UI/UX;明确忽略业务逻辑与领域流程。
v1.0.0
使用 OpenClaw 端到端构建与维护移动应用,包括需求梳理、架构、实现、调试、测试与发布。
v0.1.5
RunComfy 上的 GPT Image 2。
v1.0.0
从零打造独特设计系统的完整工作流,统筹美学文档、Token 架构、组件与动效。适用于新建或重构设计系统(触发词:create design system、design tokens、design system setup、visual identity、theming)。
v1.0.2
综合膳食规划系统:文化主题、地道菜谱、智能购物清单与惊喜揭晓。适用于:规划每周餐单、生成购物清单、寻求菜谱灵感或烹饪帮助、回顾过往餐食或提前规划、新用户上手膳食系统、寻找菜系灵感或饮食文化活动、追踪饮食目标与营养、管理收藏、踩雷与用餐历史。
v0.1.1
RunComfy 上的图像编辑。
v10.7.1
为 Solana 上的 Torch Market 借贷提供自主钱包式清算 keeper。使用 SDK 批量贷款功能扫描所有已迁移代币的不足额贷款头寸。
v1.0.0
访问 Canvas LMS(Instructure)的课程数据、作业、成绩与提交:查看截止日期、成绩、课程列表,或抓取课程资料。
v0.1.0
通过将颜色(或灰度)映射为高度,把源图片(或多色掩码图片)转为可 3D 打印的浮雕 STL。当你已有图像生成 skill(nano-banana-pro 等)产出的图片,并想通过确定性流水线得到真实可打印模型(STL)时使用。
v1.0.0
开箱即用的Windows桌面GUI自动化集成技能,整合原生UI自动化、鼠标控制、截图识别、AI视觉分析,一站式解决Windows桌面自动化需求。支持打开应用、点击、输入、截图、OCR识别、流程自动化。
v1.0.7
专业投资分析 AI:分析韩国股票的财务报表、新闻与图表,给出 0-100 的投资吸引力评分(Investment Attractiveness Score)与 BUY/HOLD/AVOID 建议;使用 Naver 金融数据,严格遵循提示词中规定的优先级(财务 > 新闻 > 图表)与权重。
v1.0.0
使用内置 image_generate.py 脚本生成图片, 准备清晰具体的 `prompt`。
v2.1.1
面向资深 UI 设计师的设计系统工具包,涵盖 design token 生成、组件文档。
v1.0.0
根据自然语言提示生成并输出实时 HTML/CSS/JS 界面设计。当用户要求设计、创建、构建或原型化网站、落地页、UI、仪表盘、网页或前端 mockup 时使用;也可用于更新、微调或迭代此前生成的设计。可替代传统的 UI 设计+前端开发流程。
v0.1.4
在 RunComfy 上使用 OpenAI GPT Image 2(ChatGPT Images 2.0 的 `/edit` 端点)编辑图片——内置该模型官方记录的提示词模式(原文截断)。
v1.1.0
AI 图像生成技能:通过统一 API 端点调用 Yollomi 的多模型图像生成能力生成 AI 图片,需要配置 YOLL 开头的密钥。
v2.0.0
使用 python-pptx 从零创建咨询级专业 PowerPoint 演示文稿,采用麦肯锡风格设计。当用户要求制作幻灯片时使用。
v1.0.0
前端 UI 界面设计。当用户要创建网页、landing page、dashboard、React/Vue 组件、前端页面时触发。 输出 HTML/CSS/JS 代码。不适用于:静态图片设计(用 canvas-design)、公众号配图(用 weixin-canvas-design)。
v1.0.1
面向 AI 真实成长的异步反思与记忆整合:在心跳时回顾近期会话,抽取带置信度的结构化记忆,生成追问问题,并在用户返回时呈现这些问题,把被动日志变成主动成长。
v1.0.0
面向 Markdown 笔记与文档的本地混合搜索。在搜索笔记、查找相关内容或从已索引集合检索文档时使用。
v1.0.0
当用户需要 Xcode 构建/测试/运行工作流、模拟器或真机控制、UI 自动化、截图/录屏、日志或通过 XcodeBuildMCP 工具进行 LLDB 调试时使用。含项目/scheme 发现、会话默认设置与常用模拟器/真机工作流。
v0.1.0
打造独特、可上生产、高设计品质的前端界面。当用户要求构建 Web 组件、页面、artifac... 时使用。
v1.0.0
通过本地 ComfyUI 生成图片并发送到指定飞书会话,成功发送后无回复文字,保持界面简洁。
v1.0.0
通过 cognary-cli 管理任务列表:列出、添加、更新、完成、撤销完成与删除任务。任何关于任务、待办、任务清单、把提醒当任务或追踪行动项的请求都可使用。语音想法即时变成组织好的可执行任务,AI 自动排定优先级并管理待办。
v1.0.0
将复杂用户请求分解为可执行子任务,识别所需能力,在 skills.sh 搜索现有技能并在无解时创建新技能。当用户提交复杂的多步请求、想要自动化工作流,或需要把大任务拆解为可管理部分时使用。
v2.0.0
数据库设计助手。表设计、范式化、索引策略、迁移脚本、测试数据、ER图描述。Database designer with normalization, indexing, migration, seeding, ER diagrams. 数据库、MySQL。
v0.1.3
创建、定稿并执行基于文件的项目计划,支持子计划,利用检查点和日志实现受控的分会话实施与进度跟踪。
v1.0.7
在 ContextUI(本地优先的 AI Agent 桌面平台)上构建、运行并发布可视化工作流。用 React TSX 编写工作流(仪表盘、工具、应用、可视化等)。
v1.0.0
创建高质量 MCP(Model Context Protocol)服务器的指南,通过设计良好的工具让 LLM 与外部服务交互。当需要构建 MCP 服务器以集成外部 API 或服务时使用,支持 Python(FastMCP)或 Node/TypeScript(MCP SDK)。
v1.0.0
使用 ComfyUI 的 Qwen3 TTS 节点生成俄语男声音频,并保存为 MP3 用于语音消息。
v0.1.2
在 RunComfy 上进行图生视频。该技能通过 RunComfy 模型 API 将任意静态图片转换为短视频片段。
v1.0.0
从源码构建 Clawdbot macOS 菜单栏应用。需要安装 Clawdbot.app 伴生应用(提供菜单栏状态、权限以及摄像头/录屏等 Mac 硬件访问)时使用。自动处理依赖安装、UI 构建、Swift 编译、代码签名与应用打包。
v1.0.0
在当前目录用 XcodeGen 生成单个 .xcodeproj,初始化最简 SwiftUI iOS 应用(除非明确要求,否则不创建 workspace、package 或测试)。
v0.1.0
图像处理工具:压缩、背景移除/替换与放大。当用户要求压缩图片、移除或更换背景等时使用。
需要 Figma 个人访问令牌(Personal Access Token)或企业 OAuth 授权,令牌只需授予文件读取范围。AgentHub 详情页标注了对应环境变量。
可以读到结构并生成初版代码,但复杂交互与响应式仍需人工调整。业界普遍把它用作「设计到代码」的第一稿加速器而非最终交付。
取决于模型训练与输出条款。商用发布前请确认服务提供方公开的版权政策,重要素材保留人工审核环节。