AI ఆడియో
-
एक्ट्रेट संगीत ecrett
रचनाकारों के लिए एआई रॉयल्टी-मुक्त साउंडट्रैक जेनरेशन टूल, दृश्य, मूड और शैली के अनुसार व्यावसायिक रूप से उपलब्ध संगीत को तुरंत तैयार करता है
-
3D-स्पीकर
मॉडलस्कोप एक ओपन सोर्स मल्टी-मॉडल वॉयसप्रिंट रिकग्निशन और स्पीकर सेपरेशन टूलकिट है।
-
ग्यारह संगीत ElevenLabs
इलेवनलैब्स का एआई म्यूजिक जेनरेशन प्लेटफॉर्म एक क्रिएटर वर्कबेंच, कमर्शियल लाइसेंसिंग मार्केटप्लेस और एम्बेडेबल म्यूजिक एपीआई को जोड़ता है।
-
ऐस-कदम ACE-Step
एसीई स्टूडियो और स्टेपफन ने संयुक्त रूप से कुशल पीढ़ी और गीत संपादन का समर्थन करने के लिए संगीत पीढ़ी के बुनियादी मॉडल को ओपन सोर्स किया है।
-
मछली ऑडियो Fish
एक टेक्स्ट-टू-स्पीच और स्पीच क्लोनिंग प्लेटफ़ॉर्म जो भावनात्मक अभिव्यक्ति पर ध्यान केंद्रित करता है, इसके पीछे ओपन सोर्स फिश-स्पीच मॉडल है।
-
एयरो-1-ऑडियो Aero-1-Audio
केवल 150 मिलियन मापदंडों वाला एक हल्का ऑडियो मॉडल, 15 मिनट की निरंतर ऑडियो प्रोसेसिंग का समर्थन करता है
-
मज़ा अस्र Fun-ASR
टोंगी लैब का ओपन सोर्स एंड-टू-एंड स्पीच रिकग्निशन मॉडल चीनी बोलियों और 31 भाषाओं का समर्थन करता है।
-
एक साक्षात्कार AInterview
आप अतिथि हैं और एआई मेजबान है, जो कुछ ही मिनटों में पॉडकास्ट साक्षात्कार तैयार करता है
-
फन-ऑडियोजेन-वीडी Alibaba Tongyi Lab
अलीबाबा टोंगी लैब द्वारा लॉन्च किया गया टिम्बर डिज़ाइन मॉडल समय, भावना और दृश्य-आधारित ऑडियो उत्पन्न करने के लिए प्राकृतिक भाषा विवरण का समर्थन करता है।
-
जेमिनी 3.1 फ़्लैश टीटीएस Google
Google द्वारा लॉन्च किया गया अगली पीढ़ी का टेक्स्ट-टू-स्पीच मॉडल 70+ भाषाओं और ऑडियो टैग निर्देशक-स्तरीय नियंत्रण का समर्थन करता है
-
असेंबलीएआई एपीआई AssemblyAI
डेवलपर्स के लिए एक वॉयस एआई एपीआई प्लेटफॉर्म, ट्रांसक्रिप्शन, समझ से लेकर वॉयस एजेंट तक एक पूर्ण-लिंक बुनियादी ढांचा प्रदान करता है
-
ऑडियो फ्लेमिंगो नेक्स्ट AF Next
लंबी ऑडियो समझ के लिए एक खुला स्रोत ऑडियो भाषा मॉडल जो भाषण, संगीत और परिवेशीय ध्वनियों को तर्क ढांचे के एक सेट में एकीकृत करता है











