산업
메타, 실시간 음성 '뮤즈 보이스 트랜스크라이브' 공개...단어 오류율 1위
메타가 실시간 음성 인식과 화자 분리, 발화 종료 감지를 하나의 모델에서 처리할 수 있는 새로운 음성 AI 모델을 공개했다. 단어 오류율 3.1%를 기록하며 스트리밍 음성 인식 벤치마크 1위에 오른 것은 물론, 80밀리초ms 단위로 속도와 정확도를 스스로 조절하는 기술을 갖췄다.메타는 1일현지시간 실시간 음성 인식 모델 ‘뮤즈 보이스 트랜스크라이브Muse Voice Transcribe’를 출시했다.메타 슈퍼인텔리전스 랩스MSL가 개발한 첫 실시간 오디오 인식 모델로, 실시간 스트리밍 자동음성인식ASR을 기반으로
이 콘텐츠는 AI타임스 원본 기사의 요약입니다. 전문은 원본 사이트에서 확인해주세요.
원문 기사 보기 →