跳到正文
原文
Mark Zuckerberg· @finkd · X·· 2026-09-02AI 评分48
AI 导读

Mark Zuckerberg 宣布 Muse Voice Transcribe 于当日推出,是 MSL 的首个实时音频感知模型。该模型在流式语音转文字上达到 SOTA,并在单一模型内原生支持说话人分离(speaker diarization)和端点检测(endpointing)。

整理与数据来源:AIHOT

来源:Mark Zuckerberg · x.com