AI ఆడియో
-
에어로-1-오디오 Aero-1-Audio
1억 5천만 개의 매개변수만으로 15분간 연속 오디오 처리를 지원하는 경량 오디오 모델
-
재미있는 Asr Fun-ASR
Tongyi Lab의 오픈 소스 엔드 투 엔드 음성 인식 모델은 중국어 방언과 31개 언어를 지원합니다.
-
A인터뷰 AInterview
당신은 손님이고 AI는 호스트이며 몇 분 안에 팟캐스트 인터뷰를 생성합니다.
-
Fun-AudioGen-VD Alibaba Tongyi Lab
Alibaba Tongyi Lab에서 출시한 음색 디자인 모델은 자연어 설명을 지원하여 음색, 감정 및 장면 기반 오디오를 생성합니다.
-
Gemini 3.1 플래시 TTS Google
Google이 출시한 차세대 TTS(텍스트 음성 변환) 모델은 70개 이상의 언어 및 오디오 태그 디렉터 수준 제어를 지원합니다.
-
AssemblyAI API AssemblyAI
전사, 이해, 음성 에이전트까지 풀링크 인프라를 제공하는 개발자를 위한 음성 AI API 플랫폼
-
오디오 플라밍고 다음 AF Next
음성, 음악 및 주변 소리를 일련의 추론 프레임워크로 통합하는 장기간 오디오 이해를 위한 오픈 소스 오디오 언어 모델
-
스펀지 음악 海绵音乐
ByteDance의 무료 AI 음악 제작 플랫폼은 한 문장으로 노래할 수 있는 노래를 생성합니다.
-
비토벤 Beatoven
AI는 저작권 없는 배경 음악을 생성하여 비디오 및 팟캐스트용 독점 사운드트랙을 맞춤 설정합니다.
-
캐스트매직 Castmagic
오디오를 쇼 노트, 소셜 미디어 게시물, 타임스탬프 및 요약으로 자동 변환하는 AI 기반 팟캐스트 콘텐츠 재사용 엔진
-
코키 Coqui
Coqui는 실행 가능한 작업 흐름을 핵심으로 삼고 안정적인 전달과 효율성 향상을 강조합니다.
-
설명 오버더빙
AI 음성 복제 및 더빙 도구, 음성으로 무엇이든 말하세요











