스타트업 뉴스AI타임스2026년 9월 2일
메타, 실시간 음성 '뮤즈 보이스 트랜스크라이브' 공개...단어 오류율 1위
메타가 실시간 음성 인식과 화자 분리, 발화 종료 감지를 하나의 모델에서 처리할 수 있는 새로운 음성 AI 모델을 공개했다. 단어 오류율 3.1%를 기록하며 스트리밍 음성 인식 벤치마크 1위에 오른 것은 물론, 80밀리초(ms) 단위로 속도와 정확도를 스스로 조절하는 기술을 갖췄다.메타는 1일(현지시간) 실시간 음성 인식 모델 ‘뮤즈 보이스 트랜스크라이브(Muse Voice Transcribe)’를 출시했다.메타 슈퍼인텔리전스 랩스(MSL)가 개발한 첫 실시간 오디오 인식 모델로, 실시간 스트리밍 자동음성인식(ASR)을 기반으로