AI音频
-
ACE-Step ACE-Step
ACE Studio 与 StepFun 联合开源的音乐生成基础模型,支持高效生成与歌词编辑
-
Gemini 3.1 Flash TTS Google
Google推出的新一代文本转语音模型,支持70+语言和音频标签导演级控制
-
Uberduck Uberduck
以语音克隆和 AI 说唱为特色的创意语音合成平台,支持角色声音与音乐生成
-
Abogen Abogen
开源电子书与文档转音频工具,支持同步字幕与多语音控制
-
FunASR Tongyi Lab
阿里通义实验室开源的工业级语音识别工具包,50+语言170x实时率、私有化部署
-
Typecast Typecast
710+ AI语音角色 + SSFM 语音合成模型——最有表现力的AI语音平台
-
3D-Speaker
ModelScope 开源的多模态声纹识别与说话人分离工具包
-
Friend AI Friend
AI 可穿戴智能挂件,全天候记录与陪伴的数字意识设备
-
Tortoise TTS TortoiseTTS
高质量开源文本转语音模型,以自然度与语音克隆能力著称的 TTS 质量标杆
-
Flow Music Flow Music
Google Labs 推出的 AI 音乐创作平台,用对话生成最长 3 分钟的完整歌曲
-
Tonal AI Tonal
AI音频处理工具,聚焦音调校正与音频后期优化
-
Fish Audio Fish
主打情感表现力的文本转语音与语音克隆平台,背后有开源 Fish-Speech 模型











