AI ఆడియో
-
FunASR Tongyi Lab
Alibaba Tongyi Lab의 오픈 소스 산업 등급 음성 인식 툴킷, 50개 이상의 언어로 170배의 실시간 속도, 민영화된 배포
-
아보겐 Abogen
동기화된 자막과 다중 음성 제어를 지원하는 오픈 소스 전자책 및 문서 변환 도구
-
Adobe 팟캐스트 Adobe
Adobe AI 오디오 도구는 한 번의 클릭으로 일반 녹음을 스튜디오급 음질로 업그레이드합니다.
-
AI 발신자.IO AICaller
초현실적인 AI 음성을 사용해 자동으로 전화를 걸며, 고객 확보부터 재방문까지 전 과정을 포괄합니다.
-
아이바 AIVA
AI 오케스트라 악보 생성 플랫폼은 250개 이상의 스타일과 상업용 저작권 구매를 지원합니다.
-
오디오 플라밍고 다음 AF Next
음성, 음악 및 주변 소리를 일련의 추론 프레임워크로 통합하는 장기간 오디오 이해를 위한 오픈 소스 오디오 언어 모델
-
부미 Boomy
누구나 몇 초 만에 독창적인 음악을 만들 수 있는 AI 플랫폼
-
커스텀팟.IO CustomPod.io
CustomPod.io는 실행 가능한 작업 흐름을 핵심으로 삼고 안정적인 전달과 효율성 향상을 강조합니다.
-
일레븐랩스 ElevenLabs
생성 및 고객 서비스 시나리오를 위한 풀스택 AI 음성 및 대화 플랫폼
-
재미있는 Asr Fun-ASR
Tongyi Lab의 오픈 소스 엔드 투 엔드 음성 인식 모델은 중국어 방언과 31개 언어를 지원합니다.
-
Fun-AudioGen-VD Alibaba Tongyi Lab
Alibaba Tongyi Lab에서 출시한 음색 디자인 모델은 자연어 설명을 지원하여 음색, 감정 및 장면 기반 오디오를 생성합니다.
-
Gemini 3.1 플래시 TTS Google
Google이 출시한 차세대 TTS(텍스트 음성 변환) 모델은 70개 이상의 언어 및 오디오 태그 디렉터 수준 제어를 지원합니다.










