找到 1 篇关于此标签的文章
一位开发者在 96GB Mac Studio 上,把 Qwen3.5 122B 的三路会话做到了大部分提示词不用重算。值得关心的不只是“本地也能跑大模型”,而是本地部署的竞争点正从参数规模转向缓存、调度和总成本。