文本转语音 TTS
v0.1.5
io.clawhub.okaris/text-to-speech
通过 inference.sh 命令行使用 DIA TTS、Kokoro、Chatterbox 等把文本转为自然语音。
“Text-to-Speech” 共 32 个结果
v0.1.5
io.clawhub.okaris/text-to-speech
通过 inference.sh 命令行使用 DIA TTS、Kokoro、Chatterbox 等把文本转为自然语音。
v1.0.0
io.clawhub.steipete/sag
ElevenLabs 文字转语音,交互体验类似 mac 风格的说命令。
v2.0.0
io.clawhub.i3130002/edge-tts
使用 node-edge-tts npm 包进行文字转语音,把文本生成音频。支持多音色、多语言、语速调节、音高控制与字幕生成。适用于:(1) 用户以 tts 触发词请求音频/语音输出;(2) 内容需要听而非读(多任务、无障碍、开车、做饭场景);(3) 用户想指定音色、语速、音高或 TTS 输出格式。
v2.2.0
io.clawhub.robbyczgw-cla/elevenlabs-voices
基于 ElevenLabs API 的高质量语音合成:18 种人格音色、32 种语言、音效、批量处理与音色设计。
v1.0.0
io.clawhub.pors/openai-tts
通过 OpenAI Audio Speech API 实现文本转语音。
v2.4.0
io.clawhub.shaharsha/elevenlabs-tts
ElevenLabs TTS——为 OpenClaw 打造的最佳 ElevenLabs 集成。支持情感音频标签的 ElevenLabs 文本转语音,为 WhatsApp……进行语音合成
v1.0.17
io.clawhub.cellcog/audio-generation-cellcog
由 CellCog 驱动的 AI 音频生成与文本转语音。配音、旁白、语音克隆、数字人音色、音效、音乐、播客、对话。三家语音供应商(OpenAI、ElevenLabs、MiniMax)。从文本提示完成专业音频制作。
v1.0.0
io.clawhub.kalijason/mac-tts
使用 macOS 内置 `say` 命令实现文本转语音。用于语音通知、声音提醒、朗读文本或通过 Mac 扬声器播报消息。支持包括中文(普通话)、英语、日语在内的多种语言。
v1.3.4
io.clawhub.odrobnik/elevenlabs
通过 ElevenLabs API 实现文本转语音、音效、音乐生成、声音管理与配额查询。当需要用 ElevenLabs 生成音频或管理……时使用。
v1.0.12
io.clawhub.nitishgargiitd/audio-cog
由 CellCog 驱动的 AI 音频生成与文本转语音。配音、旁白、声音克隆、虚拟人声、音效、音乐、播客、对话。
v1.3.0
io.clawhub.mayank8290/youtube-factory
从一个提示词生成完整的 YouTube 视频——脚本、配音、素材库画面、字幕、封面。
v1.0.0
io.clawhub.strrl/macos-local-voice
使用 Apple 原生能力在 macOS 上实现本地 STT 与 TTS:通过 yap(Apple Speech.framework)语音转文字,通过 say + ffmpeg 文字转语音。完全离线,无需 API key。包含语音质量检测与智能音色选择。
v1.0.0
io.clawhub.amstko/tts
使用 Hume AI(或 OpenAI)API 将文本转为语音。当用户要求语音消息、语音回复或想“听”某段内容(法语 of vive voix)时使用。
v1.0.0
io.clawhub.stolot0mt0m/voice-reply
基于 sherpa-onnx 使用 Piper 音色的本地文本转语音。100% 离线,无需任何 API key。当用户要求语音回复、音频应答、朗读答案或希望听到朗读内容时使用。支持多语言,包括德语(thorsten)与英语(ryan)音色。输出兼容 Telegram 的语音消息(带 [[audio_as_voice]] 标签)。
v0.1.0
io.clawhub.danielsinewe/sherpa-onnx-tts
使用 sherpa-onnx 在本地进行文本转语音(离线运行,无需云端)。
v1.0.1
io.clawhub.zhaov1976/voice
使用 Microsoft Edge 的 TTS 引擎将文本转语音,支持自定义音色、直接播放与临时文件自动清理。
v1.0.0
io.clawhub.guang384/aliyun-tts
阿里云文字转语音(TTS)合成服务。
v1.0.4
io.clawhub.xmanrui/voice-message
使用 edge-tts 做文本转语音、ffmpeg 处理音频,在多个聊天渠道(Telegram、Discord、飞书/Lark、Signal。
v1.2.3
io.clawhub.rakesh1002/audiopod
使用 AudioPod AI API 处理音频任务:AI 音乐生成(文生音乐、文生说唱、伴奏、采样、人声)、音轨分离、文生语音、降噪、语音转写、说话人分离与媒体提取。当用户需要从文本生成音乐/歌曲/说唱、拆分歌曲音轨/人声/乐器、从文本生成语音、清理嘈杂音频、转写音频/视频,或从 YouTube/URL 提取音频时使用。需要 AUDIOPOD_API_KEY 环境变量或直接传入 api_key。
v1.0.0
io.clawhub.paki81/qwen-tts
基于 Qwen3-TTS-12Hz-1.7B-CustomVoice 的本地文本转语音。用于把文本生成音频、制作语音消息或被要求 TTS 时;支持含意大利语在内的 10 种语言、9 个高品质音色,以及基于指令的声音控制(情绪、语气、风格)。是 ElevenLabs 等云端 TTS 的替代方案,模型下载完成后可完全离线运行。
v1.0.0
io.clawhub.hopyky/tts-whatsapp
以 40 多种语言向 WhatsApp 发送高质量文本转语音消息,自动投递。
v1.1.0
io.clawhub.korddie/sapi-tts
基于 Windows SAPI5 的文本转语音,支持 Neural 神经音色。是重度依赖 GPU 的 TTS 方案的轻量替代——零 GPU 占用、即时生成。会自动为你的语言挑选最佳可用音色,适用于 Windows 10/11。
v1.0.1
io.clawhub.merend/openai-tts-python
使用 OpenAI 的 TTS API 进行文本转语音,生成高质量、自然的语音音频。支持 6 种音色(alloy、echo、fable、onyx、nova、shimmer)、语速控制(0.25x-4.0x)、HD 音质模型、多种输出格式(mp3、opus、aac、flac),并自动对长文本分块(单次请求 4096 字符上限)。使用场景:(1) 用户请求音频/语音输出,触发语如“读给我听”“转成音频”“生成语音”“text to speech”“tts”“narrate”“speak”,或出现关键词 openai tts、voice、podcast;(2) 内容更适合听而非读(多任务、无障碍);(3) 用户想要特定音色偏好(如 alloy、echo、fable、onyx、nova、shimmer)或语速调整。
v1.0.0
io.clawhub.al-one/edge-tts-uvx
使用 `uvx edge-tts` 把文本转换为语音。适用场景:(1)用户带“tts”关键词请求音频/语音输出;(2)内容更适合听而不是读(多任务并行、无障碍、开车、做饭);(3)用户想要特定的音色、语速、音调或 TTS 输出格式。