Audio8 ASR Infinite 流式语音识别模型发布
💡 灵机 AI 深度洞见与核心提炼
Audio8 ASR Infinite 是一款原生流式语音识别模型,每秒解码 12.5 次,通过滚动 KV Cache 在 24/7 持续运行下保持内存与延迟恒定。模型每个时钟步输出一个文本 token(12.5/8.3/6.25 次决策/秒),平衡感知粒度与资源开销。HuggingChat 的 ML intern 已搭建 Gradio 工作流供试用。
信源媒体:X:AK (@_akhaliq)
访问出处网页 ↗