KI-Audio
-
Spaß-ASR-Echtzeit Alibaba Cloud
Ein großes Streaming-Echtzeit-Spracherkennungsmodell, das von Alibaba Qianwen eingeführt wurde, unterstützt die Echtzeiterkennung von 16 Dialekten und 30 Sprachen.
-
Fun-CosyVoice 3.5 FunAudioLLM
Das vom FunAudioLLM-Team des Alibaba Tongyi Laboratory eingeführte mehrsprachige Sprachgenerierungsmodell unterstützt die FreeStyle-Befehlssteuerung in natürlicher Sprache und das Sprachklonen ohne Stichproben.
-
3D-Lautsprecher
ModelScope ist ein Open-Source-Toolkit zur multimodalen Stimmabdruckerkennung und Sprechertrennung.
-
Gensfx Gensfx
Kostenloser AI-Soundeffektgenerator, wandeln Sie Text mit einem Klick in hochwertige Soundeffekte um
-
ACE-Schritt 1.5 ACE-Step
Open-Source-Musik-Basismodell, auch Consumer-Grafikkarten können ausgeführt werden
-
AI Music Generator (AI Song Maker) AI Song Maker
Geben Sie Text ein, um einen vollständigen Song zu erstellen, mit KI-Komposition, Texten und Covern in einem Paket
-
Ziel Aispect
Wandeln Sie Live-Gespräche in Echtzeit in visuelle Bilder um und verleihen Sie abstrakten Reden einen gemeinsam nutzbaren visuellen Ausdruck
-
Audiify AI Audify AI
Hochwertige TTS-Tools kostenlos mit OpenAI-Schlüsseln, kein Abonnement, keine Überraschungen
-
Beatofen Beatoven
KI generiert urheberrechtsfreie Hintergrundmusik, um exklusive Soundtracks für Videos und Podcasts anzupassen
-
Coqui Coqui
Coqui legt den Schwerpunkt auf den ausführbaren Aufgabenablauf und legt Wert auf eine stabile Bereitstellung und Effizienzsteigerung.
-
Ekhos KI
KI-Plattform für Sprachsynthese und Audioinhaltserstellung
-
Fisch-Audio Fish
Eine Text-to-Speech- und Sprachklonungsplattform, die sich auf emotionale Ausdruckskraft konzentriert und auf dem Open-Source-Fish-Speech-Modell basiert











