Meta Superintelligence Labs 发布 Muse Voice Transcribe:一个实时模型同时完成流式 ASR、说话人分离和端点检测

💡 灵机 AI 深度洞见与核心提炼
Meta Superintelligence Labs 发布首个实时音频感知模型 Muse Voice Transcribe,将流式 ASR、20+ 说话人的说话人分离和端点检测合并为一个自回归模型,无需后处理。
信源媒体:MarkTechPost(RSS)
访问出处网页 ↗