AI音频
-
Fun-AudioGen-VD Alibaba Tongyi Lab
阿里通义实验室推出的音色设计模型,支持自然语言描述生成音色、情绪与场景化音频。
-
Typecast Typecast
710+ AI语音角色 + SSFM 语音合成模型——最有表现力的AI语音平台
-
Tortoise TTS TortoiseTTS
高质量开源文本转语音模型,以自然度与语音克隆能力著称的 TTS 质量标杆
-
Fun-ASR1.5 阿里通义
阿里通义推出的端到端语音识别模型,单模型支持30种语言及七大方言
-
Fun-ASR-Realtime Alibaba Cloud
阿里千问推出的流式实时语音识别大模型,支持16种方言和30种语言实时识别
-
Superwhisper Superwhisper
面向 macOS、Windows 与 iOS 的 AI 语音输入工具,支持离线与云端转写
-
Fun Asr Fun-ASR
通义实验室开源的端到端语音识别大模型,支持中文方言与31种语言
-
Suno V5.5 Suno
把 AI 音乐从一句提示词升级到可编辑、可分轨、可商用的浏览器工作站
-
Fish Audio Fish
主打情感表现力的文本转语音与语音克隆平台,背后有开源 Fish-Speech 模型
-
Suno AI Suno
AI 歌曲生成平台,从歌词到演唱的全流程 AI 音乐创作
-
Eleven Music ElevenLabs
ElevenLabs 的 AI 音乐生成平台,兼顾创作者工作台、商业授权市场和可嵌入式 Music API
-
Stable Audio Stable Audio
Stability AI 旗下 AI 音乐生成工具,文本/音频输入生成最长 6 分钟立体声音乐与音效











