AI ఆడియో
-
Gemini 3.1 플래시 TTS Google
Google이 출시한 차세대 TTS(텍스트 음성 변환) 모델은 70개 이상의 언어 및 오디오 태그 디렉터 수준 제어를 지원합니다.
-
하모나이 Harmonai
안정성 AI 오픈소스 AI 음악 생성 플랫폼
-
ACE-스텝 ACE-Step
ACE Studio와 StepFun은 효율적인 생성 및 가사 편집을 지원하기 위해 음악 생성의 기본 모델을 공동으로 오픈 소스합니다.
-
에어로-1-오디오 Aero-1-Audio
1억 5천만 개의 매개변수만으로 15분간 연속 오디오 처리를 지원하는 경량 오디오 모델
-
A인터뷰 AInterview
당신은 손님이고 AI는 호스트이며 몇 분 안에 팟캐스트 인터뷰를 생성합니다.
-
AssemblyAI AssemblyAI
API를 핵심으로 하는 음성 인텔리전스 플랫폼으로 전사 정확성과 프로그래밍 가능한 음성 기능을 강조합니다.
-
오디오 SD Audio Sds
Audio Sds는 AI 음성 합성 및 오디오 처리 API를 제공하여 음성 복제 및 다국어 TTS를 지원합니다.
-
클린보이스 AI Cleanvoice
팟캐스팅 및 인터뷰 시나리오를 위한 AI 오디오 후처리 도구인 실제 가치는 단순히 텍스트를 복사하는 대신 관용어, 일시 중지 및 소음을 일괄 정리하는 것입니다.
-
설명 오버더빙
AI 음성 복제 및 더빙 도구, 음성으로 무엇이든 말하세요
-
일레븐 음악 ElevenLabs
ElevenLabs의 AI 음악 생성 플랫폼은 제작자 작업대, 상용 라이선스 마켓플레이스 및 내장형 Music API를 결합합니다.
-
재미-ASR-실시간 Alibaba Cloud
Alibaba Qianwen이 출시한 대규모 스트리밍 실시간 음성 인식 모델은 16개 방언과 30개 언어의 실시간 인식을 지원합니다.
-
펀코시보이스 3.5 FunAudioLLM
Alibaba Tongyi Laboratory의 FunAudioLLM 팀이 출시한 다국어 음성 생성 모델은 FreeStyle 자연어 명령 제어 및 제로 샘플 음성 복제를 지원합니다.










