这周 Reddit 上一位开发者贴出的数字很硬:128GB 统一内存的 MacBook Pro M5 Max,通过雷电 5 外接盒(Razer Core X V2)接上一块 AMD Radeon AI PRO R9700,已经能在 macOS 上本地跑 Qwen3.6-3.8 系列大模型(含 MoE,即混合专家架构,参数按需激活以提速;以及 MTP,多 Token 并行预测)。我们注意到,这不是一个产品发布,而是一名开源开发者单干的结果——他把 Linux 版的 amdgpu 驱动移植到了 macOS。
这是什么
简单说,过去苹果 Mac 用户做本地大模型推理,几乎只能在 Apple Silicon 自己的 GPU 上跑(用 llama.cpp / MLX 等社区工具)。如果想用 AMD 或 Nvidia 的独显,要么换 Windows/Linux 工作站,要么等苹果官方支持——而苹果至今没给过官方支持。这次的 LemonSeed-Engine(LSE)引擎 + 移植驱动,换了第三条路:用雷电 5/USB4 外接 AMD 显卡,在 macOS 上当加速器用。
对开发者而言,这意味着 M5 Max 的 128GB 统一内存可以同时作为 CPU/GPU 内存,配合外接 AMD GPU 做推理——本地跑 70B 量级模型的可能性,第一次从「理论可行」变成「动手可试」。
行业怎么看
乐观声音认为这是「苹果本地 AI 生态的破冰」,长期被封闭硬件挤出的小模型玩家可能回流;Lemonade SDK 组织在 GitHub 已经拿到一些关注度。
但我们必须指出反向风险:其一,这只是个人项目,没有苹果官方背书,签名、稳定性、企业级支持全无;其二,雷电 5 外接方案带宽(约 80Gbps)远低于 PCIe 内置,推理速度肯定打折扣;其三,Apple Silicon 自身的 Metal 加速器迭代很快(M5 Max GPU 已经不弱),苹果未必有动力放开第三方 GPU 接入。一旦 Apple 自家 GPU 跟上,这套方案的护城河可能直接消失。
对普通人的影响
对企业 IT:过去部署「本地大模型」几乎等于配 Nvidia 工作站;现在多了一种「Mac 工作站 + AMD 雷电盒」的混合架构思路,但仍属实验阶段,不建议直接上生产环境。
对个人职场:短期影响不大。如果你办公用的就是 Mac,未来一两年内可能多一种「不联网、不传数据」跑 AI 助手的硬件选项,但外接盒加显卡的折腾成本(通常 1.5 万元起)并不低。
对消费市场:短期不会出现消费级「Mac 接 AMD 显卡」产品上市,但它释放的信号更值得关注——苹果对硬件的封闭正在被开发者用工程力一点点撬开。