The Decoder:AI News(RSS)· Jonathan Kemper·· 2026-09-06AI 评分71
Meta 发布实时音频模型 Muse Voice Transcribe,主打语音转写与说话人分离
Meta's new real-time audio model is the foundation for AI assistants that never stop listening
AI 导读
Meta Superintelligence Labs 发布首个实时音频感知模型 Muse Voice Transcribe,将音频切分为 80 毫秒块,通过强化学习为每个词动态调整等待时间,并内置说话人区分(可同时区分 20 人以上)和句界检测。
整理与数据来源:AIHOT
来源:The Decoder:AI News(RSS) · the-decoder.com