Lyra · 语音与音乐
AI 音频工具
图谱里的 AI 音频工具:21 款,包括 ElevenLabs、Suno、Whisper、GPT-SoVITS、whisper.cpp、ChatTTS。
配音、歌曲、转写与干净的声音。
这个星系里的能力
产品9
- ElevenLabs2023逼真的语音合成、声音克隆与多语种配音。免费版 + 付费升级
- Suno2023写一句话,生成带人声与伴奏的完整歌曲。免费版 + 付费升级
- GPT-SoVITS2024用一分钟录音克隆音色并合成语音的网页工具。开源免费 · 可离线本地运行
- RVC2023用几分钟录音训练变声模型并进行音色转换的网页工具。开源免费 · 可离线本地运行
- Adobe Podcast2022一键让人声录音达到录音棚级清晰度。免费版 + 付费升级
- Granola2024会议记事本,结合转写把你的笔记补全润色。免费版 + 付费升级
- Otter.ai2018会议实时转写,自动生成摘要与待办。免费版 + 付费升级
- Udio2024高保真音乐生成,可精细控制每个段落。免费版 + 付费升级
- Fireflies.ai2018自动加入会议,录音、转写并可检索对话。免费版 + 付费升级
命令行工具1
框架3
模型8
- Whisper2022OpenAI 的开放权重语音识别模型,用 68 万小时多语种音频训练。开源免费 · 可离线本地运行
- ChatTTS2024为中英文日常对话调优的语音合成模型。开源免费 · 可离线本地运行
- Fish Speech2023开源多语言语音合成模型系列,支持声音克隆和情绪控制。开源免费 · 可离线本地运行
- Chatterbox2025支持多语言零样本声音克隆的开源语音合成模型系列。开源免费 · 可离线本地运行
- CosyVoice2024阿里巴巴开源的多语言语音生成模型,支持语音合成和零样本声音克隆。开源免费 · 可离线本地运行
- F5-TTS2024基于流匹配的语音合成模型,可用短样本克隆音色。开源免费 · 可离线本地运行
- WaveNet2016DeepMind 直接生成原始音频波形的模型,让合成语音更自然。
- ACE-Step2025根据歌词和风格描述生成带人声完整歌曲的开源音乐模型。开源免费 · 可离线本地运行
组织7
- ElevenLabs2022AI 音频公司,以逼真的语音合成、声音克隆与配音闻名。
- Suno2022美国麻省剑桥的公司,开发 Suno 歌曲生成应用与模型。
- iFlytek 科大讯飞1999合肥公司,以语音识别与合成闻名,也开发讯飞星火大模型。
- Otter.ai2016开发 AI 会议转写与笔记应用 Otter 的公司。
- Fireflies.ai2016开发会议记录与转写助手 Fireflies 的公司。
- Granola2023伦敦初创公司,开发会议 AI 记事本 Granola。
- Uncharted Labs2023由前 Google DeepMind 研究员创立的初创公司,开发 Udio 音乐生成器。
最后更新 2026-09-24