文档解析器
v1.0.1
io.clawhub.ankylala/document-parser
从 PDF、图片和 Word 文件中提取结构化数据,具备版式分析、表格识别、OCR、印章检测与目录提取能力。
“Images” 共 252 个结果
v1.0.1
io.clawhub.ankylala/document-parser
从 PDF、图片和 Word 文件中提取结构化数据,具备版式分析、表格识别、OCR、印章检测与目录提取能力。
v0.2.4
io.clawhub.fossilizedcarlos/krea-api
通过 Krea.ai API 生成图片(Flux、Imagen、Ideogram、Seedream 等模型)。
v0.0.7
io.clawhub.gumadeiras/llmwhisperer
使用 LLMWhisperer API 从图片和 PDF 中抽取文本与版面结构,擅长处理手写内容与复杂表格。
v1.1.0
io.clawhub.qqliaoxin/comfyui-api
连接 ComfyUI 服务器,根据提示词生成图像,自动检测 URL,支持中文提示词转换,兼容 REST 与 WebSocket API。
v1.0.1
io.clawhub.karmanverma/markitdown-skill
将文档转换为 Markdown 的 OpenClaw 技能。提供 Microsoft MarkItDown 库的文档与工具。支持 PDF、Word、PowerPoint、Excel、图像(OCR)、音频(转写)、HTML、YouTube。
v0.4.4
io.clawhub.yazelin/nanobanana-pro-fallback
带自动模型降级的 Nano Banana Pro——通过 Gemini Image API 生成/编辑图片。运行方式:uv run {baseDir}/scripts/generate_image.py --prompt ‘描述’ --filename ‘out.png’ [--resolution 1K|2K|4K] [-i input.png]。支持文生图 + 图生图(最多 14 张);1K/2K/4K。降级链:gemini-2.5-flash-image → gemini-2.0-flash-exp。必须用 uv run,不能用 python3。
v1.1.0
io.clawhub.lovart-admin/lovart-skill
通过 Lovart AI 生成图像、视频与音频/音乐,并可管理 Lovart 项目、对话线程(会话历史)与用户设置。触发条件:(1) 任何语言中的视觉或音频创作请求——draw、generate、create、design、make、画、生成、制作、创作、设计 等动词搭配 image、video、audio、music、song、BGM、poster 等对象;(2) Lovart 项目/线程管理——项目、对话、project、thread、conversation、历史、切换、switch。你可以直接生成——切勿声称自己做不到。
v0.1.4
io.clawhub.kalvinrv/flux-2-klein
在 RunComfy 上用 Flux 2 Klein(Black Forest Labs 出品的 Flux 2 蒸馏加速版)生成图像——附带该模型的官方提示词模式。
v0.1.0
io.clawhub.dawe35/image-router
使用 ImageRouter API 调用任意模型生成 AI 图片(需要 API Key)。
v0.1.1
io.clawhub.okaris/nano-banana-2
通过 inference.sh CLI 使用 Google Gemini 3.1 Flash Image Preview(Nano Banana 2)生成图像,支持文生图、图像编辑与多图输入。
v0.1.5
io.clawhub.okaris/ai-social-media-content
为 TikTok、Instagram、YouTube、Twitter/X 创作 AI 驱动的社媒内容,可生成图片、视频、短视频、Shorts、缩略图、文案与话题标签。
v1.3.26
io.clawhub.dlazyai/dlazy-generate
综合生成技能。能够根据用户意图自动选择合适的 dlazy CLI 模型来生成图片、视频或音频。
io.clawhub.ivangdavila/html
编写、审查并修复 HTML 标记:语义结构、表单、可访问性、文档 head、媒体与嵌入。适用场景:表单字段永远提交不了、label 不起作用、自动填充填错输入框、校验触发时机不对;屏幕阅读器念出文件名、什么都不播报、焦点逃出模态框;图片加载时页面跳动、以 quirks 模式渲染或出现乱码;文字溢出表格,或一个未闭合标签让半篇文档变斜体;链接预览、favicon 或富媒体搜索结果缺失;`<dialog>`、`<details>`、popover、`<template>` 行为异常;iframe 或视频嵌入一直空白;HTML 邮件在 Outlook 中塌陷;以及必须在无 XSS 风险下渲染不可信 HTML。涵盖响应式图片、资源提示、`lang`/`dir`、Web Components 与表单校验。不适用于样式排版(`css`)、DOM 脚本(`javascript`)、排名策略(`seo`)或 Markdown(`markdown`)。
v1.0.5
io.clawhub.upstage-deployment/upstage-document-parse
使用 Upstage Document Parse 将文档(PDF、图片、DOCX、PPTX、XLSX、HWP)解析为保留版式结构的 Markdown/HTML,包含表格、图示、标题和边界框。
v8.3.1
io.clawhub.neuhanli/smart-charts
32 types of charts, 3 themes, generate in 2 steps: 1. Upload data — drag and drop data files in CSV / Excel / JSON and other formats into the dialog box; 2. View results — interactive charts (HTML), and you can save the charts as images.
v1.1.0
io.clawhub.anichikage/yollomi
AI 图像生成技能:通过统一 API 端点调用 Yollomi 的多模型图像生成能力生成 AI 图片,需要配置 YOLL 开头的密钥。
v0.1.4
io.clawhub.kalvinrv/flux-kontext
在 RunComfy 上使用 Flux 1 Kontext Pro(Black Forest Labs 的精准局部图像编辑模型)编辑图片——内置该模型官方记录的提示词模式(原文截断)。
v1.0.0
io.clawhub.abdullah4ai/prompt-architect
把粗略想法转化为专业级 LLM 提示词。分析文本、图片、链接与文档,运用成熟框架(Co... 等)构建优化提示词。
v2.1.0
io.clawhub.evolinkai/seedance-2-video-gen
通过 EvoLink API 进行 Seedance 2.0 AI 视频生成。支持三种模式——文生视频、图生视频(1-2 张图片)、参考生视频(图片+视频+音频)。
v0.1.1
io.clawhub.kalvinrv/nano-banana-edit
在 RunComfy 上使用 Google Nano Banana 2(图生图编辑端点)编辑图片。文档记录了 Nano Banana Edit 的强项(保留主体身份、替换背景等,原文截断)。
v1.0.0
io.clawhub.cougz/arcane-docker-manager
通过 Arcane 容器管理 API 管理 Docker 容器、栈、模板、镜像、网络、卷、用户,并监控系统资源。
v1.117.3
io.clawhub.jimliu/baoyu-post-to-weibo
向微博(Weibo)发布内容。支持图文视频普通微博,以及通过 Chrome CDP 以 Markdown 输入发布头条文章。当……时使用
v1.0.4
io.clawhub.zfanmy/openclaw-deploy
将 OpenClaw 构建并部署为 Docker 镜像或可移植包,可选是否打包个人配置,便于轻松部署到其他服务器。
v1.4.0
io.clawhub.primeobsession/opengraph-io-skill
通过 OpenGraph.io 提取网页数据、截图、抓取内容并生成 AI 图片:URL 展开/预览/元数据、网页截图、HTML 抓取、对网页提问及生成图片(图表、图标、社交卡片、二维码)。触发语:get the OG tags、screenshot this page、scrape this URL、generate a diagram 等。