找到 1 篇关于此标签的文章
一则 Reddit 讨论把 GLM5.2 的现实问题摆上台面:460GB 的超大检查点文件,让性能不只取决于模型能力,更取决于显卡、内存和推理栈。值得关心的是,大模型竞争正在从“谁更聪明”转向“谁更跑得动”。