AI ఆడియో
-
ग्यारह संगीत ElevenLabs
इलेवनलैब्स का एआई म्यूजिक जेनरेशन प्लेटफॉर्म एक क्रिएटर वर्कबेंच, कमर्शियल लाइसेंसिंग मार्केटप्लेस और एम्बेडेबल म्यूजिक एपीआई को जोड़ता है।
-
3D-स्पीकर
मॉडलस्कोप एक ओपन सोर्स मल्टी-मॉडल वॉयसप्रिंट रिकग्निशन और स्पीकर सेपरेशन टूलकिट है।
-
ऐस-कदम ACE-Step
एसीई स्टूडियो और स्टेपफन ने संयुक्त रूप से कुशल पीढ़ी और गीत संपादन का समर्थन करने के लिए संगीत पीढ़ी के बुनियादी मॉडल को ओपन सोर्स किया है।
-
मछली ऑडियो Fish
एक टेक्स्ट-टू-स्पीच और स्पीच क्लोनिंग प्लेटफ़ॉर्म जो भावनात्मक अभिव्यक्ति पर ध्यान केंद्रित करता है, इसके पीछे ओपन सोर्स फिश-स्पीच मॉडल है।
-
एयरो-1-ऑडियो Aero-1-Audio
केवल 150 मिलियन मापदंडों वाला एक हल्का ऑडियो मॉडल, 15 मिनट की निरंतर ऑडियो प्रोसेसिंग का समर्थन करता है
-
मज़ा अस्र Fun-ASR
टोंगी लैब का ओपन सोर्स एंड-टू-एंड स्पीच रिकग्निशन मॉडल चीनी बोलियों और 31 भाषाओं का समर्थन करता है।
-
फन-ऑडियोजेन-वीडी Alibaba Tongyi Lab
अलीबाबा टोंगी लैब द्वारा लॉन्च किया गया टिम्बर डिज़ाइन मॉडल समय, भावना और दृश्य-आधारित ऑडियो उत्पन्न करने के लिए प्राकृतिक भाषा विवरण का समर्थन करता है।
-
एक साक्षात्कार AInterview
आप अतिथि हैं और एआई मेजबान है, जो कुछ ही मिनटों में पॉडकास्ट साक्षात्कार तैयार करता है
-
असेंबलीएआई एपीआई AssemblyAI
डेवलपर्स के लिए एक वॉयस एआई एपीआई प्लेटफॉर्म, ट्रांसक्रिप्शन, समझ से लेकर वॉयस एजेंट तक एक पूर्ण-लिंक बुनियादी ढांचा प्रदान करता है
-
जेमिनी 3.1 फ़्लैश टीटीएस Google
Google द्वारा लॉन्च किया गया अगली पीढ़ी का टेक्स्ट-टू-स्पीच मॉडल 70+ भाषाओं और ऑडियो टैग निर्देशक-स्तरीय नियंत्रण का समर्थन करता है
-
स्पंज संगीत 海绵音乐
बाइटडांस का निःशुल्क एआई संगीत निर्माण मंच एक वाक्य में गाने योग्य गाने तैयार करता है
-
ऑडियो फ्लेमिंगो नेक्स्ट AF Next
लंबी ऑडियो समझ के लिए एक खुला स्रोत ऑडियो भाषा मॉडल जो भाषण, संगीत और परिवेशीय ध्वनियों को तर्क ढांचे के एक सेट में एकीकृत करता है











