Muse Voice Transcribe is MSL's first real-time audio perception model -- rolling out today. SOTA in …
💡 灵机 AI 深度洞见与核心提炼
Mark Zuckerberg 宣布 Muse Voice Transcribe 于当日推出,是 MSL 的首个实时音频感知模型。该模型在流式语音转文字上达到 SOTA,并在单一模型内原生支持说话人分离(speaker diarization)和端点检测(endpointing)。
信源媒体:X:Mark Zuckerberg (@finkd)
访问出处网页 ↗