在本地运行 Qwen3.8 27B:来自我的 Mac Studio 的实际数据

💡 灵机 AI 深度洞见与核心提炼
Qwen3.8 27B(27.3B 参数,混合注意力架构,262,144 token 上下文窗口,Apache 2.0 开源)在 Mac Studio M3 Ultra 上经 Ollama 以 Q4_K_M 量化(17GB)生成速度约 14 tokens/s。
信源媒体:Hacker News 热门(buzzing.cc 中文翻译)
访问出处网页 ↗