AgentHubAgentHub

text-to-speech

共收录 32 个与 text-to-speech 相关的 MCP Server 与 Agent Skill,均附安装命令、来源与热度数据,可直接复制到 Cursor、Claude Code 等客户端。

AudioPod 音频处理

v1.2.3

SkillClawHub4.4k

io.clawhub.rakesh1002/audiopod

使用 AudioPod AI API 处理音频任务:AI 音乐生成(文生音乐、文生说唱、伴奏、采样、人声)、音轨分离、文生语音、降噪、语音转写、说话人分离与媒体提取。当用户需要从文本生成音乐/歌曲/说唱、拆分歌曲音轨/人声/乐器、从文本生成语音、清理嘈杂音频、转写音频/视频,或从 YouTube/URL 提取音频时使用。需要 AUDIOPOD_API_KEY 环境变量或直接传入 api_key。

source

OpenAI TTS(Python)

v1.0.1

SkillClawHub3.9k

io.clawhub.merend/openai-tts-python

使用 OpenAI 的 TTS API 进行文本转语音,生成高质量、自然的语音音频。支持 6 种音色(alloy、echo、fable、onyx、nova、shimmer)、语速控制(0.25x-4.0x)、HD 音质模型、多种输出格式(mp3、opus、aac、flac),并自动对长文本分块(单次请求 4096 字符上限)。使用场景:(1) 用户请求音频/语音输出,触发语如“读给我听”“转成音频”“生成语音”“text to speech”“tts”“narrate”“speak”,或出现关键词 openai tts、voice、podcast;(2) 内容更适合听而非读(多任务、无障碍);(3) 用户想要特定音色偏好(如 alloy、echo、fable、onyx、nova、shimmer)或语速调整。

source

ElevenLabs API

v1.2.6

SkillClawHub3.7k

io.clawhub.byungkyu/elevenlabs-api

ElevenLabs API 集成,托管鉴权。AI 驱动的文字转语音、声音克隆、音效与音频处理。当用户要从文字生成语音、克隆声音、制作音效或处理音频时使用本技能。其他第三方应用请使用 api-gateway 技能(https://clawhub.ai/byungkyu/api-gateway)。调用经由带 OAuth 登录的 maton CLI 执行;无法安装 CLI 时通过原始 HTTP 加 Maton API key 调用。每次调用都以用户连接身份鉴权,只能访问该连接授权范围内的数据(由服务商在每次请求时强制执行);本文档所列端点即本技能使用的端点,其他端点需用户点名要求方可使用。默认进行读取和列表操作,每次写操作或新建连接均需与用户确认。

source

相关标签