스타트업 뉴스AI타임스2026년 9월 2일

메타, 실시간 음성 '뮤즈 보이스 트랜스크라이브' 공개...단어 오류율 1위

메타가 실시간 음성 인식과 화자 분리, 발화 종료 감지를 하나의 모델에서 처리할 수 있는 새로운 음성 AI 모델을 공개했다. 단어 오류율 3.1%를 기록하며 스트리밍 음성 인식 벤치마크 1위에 오른 것은 물론, 80밀리초(ms) 단위로 속도와 정확도를 스스로 조절하는 기술을 갖췄다.메타는 1일(현지시간) 실시간 음성 인식 모델 ‘뮤즈 보이스 트랜스크라이브(Muse Voice Transcribe)’​를 출시했다.메타 슈퍼인텔리전스 랩스(MSL)가 개발한 첫 실시간 오디오 인식 모델로, 실시간 스트리밍 자동음성인식(ASR)을 기반으로
공공조달·정부지원사업 실무에 필요한 제안서 템플릿과 최신 공고는 문서 스토어 공고에서 확인하세요.