在 M4 Pro Mac mini 上搭建本地 LLM 环境的完整方案

💡 灵机 AI 深度洞见与核心提炼
作者分享在 48GB 内存 M4 Pro Mac mini 上运行本地 LLM 的完整方案,主模型为 Qwen3.6-35B-A3B-OptiQ-4bit(约占用 20GB 内存),轻量模型为 Gemma-4-E4B,推理服务用 oMLX,通过 Tailscale 让 iPhone、MacBook 共用同一后端,并接入 Hermes、Pi、Apollo 和 Raycast。
信源媒体:Hacker News 热门(buzzing.cc 中文翻译)
访问出处网页 ↗