返回首页
mlx-dspark
找到 2 篇关于此标签的文章
QwenApple Silicon
苹果电脑跑 Qwen 27B 提速 3 倍 — 本地大模型进入可用区间
开源项目 mlx-dspark 把 DeepSeek 的"投机解码"移植到苹果芯片,让 Qwen 27B 模型在 M 系列 Mac 上提速至 3 倍且无质量损失。本地跑大模型第一次接近"可商用"水平,对中小企业和受监管行业的吸引力是真实的。
Aug 152 分钟
MetaMuse Glimmer
Meta 30B 模型在 Mac 上提速 3 倍 — 开源社区让本地大模型开始能用
开发者 A-Rahim 用推测解码让 Meta 新出的 Muse Glimmer 30B 在 M4 Pro 上提速最高 3.3 倍,输出与原版完全一致。这事为什么值得关心:本地跑大模型开始从极客玩具变成普通人也能上手的工具。
Aug 122 分钟