AIオーディオ
-
アボゲン Abogen
同期字幕とマルチ音声制御をサポートするオープンソースの電子書籍およびドキュメント変換ツール
-
イレブンラボ ElevenLabs
イレブンラボは、音声生成、音声エージェント、文字起こし、音楽生成をカバーする主要な AI オーディオ プラットフォームであり、完全な API 機能を提供します。
-
ACE-ステップ 1.5 ACE-Step
オープンソースの音楽基本モデル、コンシューマーグレードのグラフィックカードも実行可能
-
フローミュージック Flow Music
Google Labs が立ち上げた AI 音楽作成プラットフォームは対話を使用して最大 3 分の完全な曲を生成します
-
AIミュージックジェネレーター(AIソングメーカー) AI Song Maker
テキストを入力すると、AI による作曲、歌詞、カバーがすべて 1 つのパッケージにまとめられた完全な曲が生成されます
-
Fun-ASR-リアルタイム Alibaba Cloud
Alibaba Qianwen が発表した大規模なストリーミング リアルタイム音声認識モデルは、16 の方言と 30 の言語のリアルタイム認識をサポートしています。
-
Fun-CosyVoice 3.5 FunAudioLLM
Alibaba Tongyi Laboratory の FunAudioLLM チームが立ち上げた多言語音声生成モデルは、FreeStyle 自然言語コマンド制御とゼロサンプル音声クローン作成をサポートしています。
-
視点 Aispect
生のスピーチをリアルタイムで視覚的な画像に変換し、抽象的なスピーチを共有可能な視覚的表現にします。
-
アセンブリAI AssemblyAI
API を核とした音声インテリジェンス プラットフォームで、文字起こしの精度とプログラム可能な音声機能を重視しています。
-
Gensfx Gensfx
無料の AI 効果音ジェネレーター、ワンクリックでテキストを高品質の効果音に変換します
-
オーディオSD Audio Sds
Audio Sds は AI 音声合成と音声処理 API を提供し、音声クローンと多言語 TTS をサポートします。
-
ハルモナイ Harmonai
安定性 AI オープンソース AI 音楽生成プラットフォーム









