找到 1 篇关于此标签的文章
一支团队把 Qwen3-27B 模型压缩到原来的 35%,但 GPQA-Diamond 跑分只掉 0.5 个百分点。这意味着大模型部署所需的显存和成本可能大幅下降,是企业 AI 落地最值得关心的技术拐点。