스타트업 뉴스AI타임스2026년 7월 21일
알리바바, 16개 언어 지원 ‘큐원-오디오-3.0-TTS’ 공개… "스피치 아레나 1위"
알리바바가 실시간 대화형 AI와 콘텐츠 제작 시장을 동시에 겨냥한 차세대 텍스트 음성 변환(TTS) 모델을 공개했다. 알리바바는 20일(현지시간) 실시간 대화와 고품질 음성 생성을 모두 지원하는 ‘큐원-오디오-3.0-TTS(Qwen-Audio-3.0-TTS)’를 공개했다.실시간 응답에 최적화된 ‘플래시(Flash)’와 음질 중심의 ‘플러스(Plus)’ 두 가지 모델을 동시에 선보였다. 특히, 플러스 모델은 독립 벤치마크인 아티피셜 애널리시스 TTS 리더보드에서 1위를 차지하며 성능을 입증했다.이번 모델은 다운로드 형태의 오픈 웨이트