找到 1 篇关于此标签的文章
本周 Reddit 本地大模型社区有人放出基于 Qwen 的 27B 变体:单 token 速度下降,但综合任务质量提升。这是'让模型多花时间推理'的路线首次明确下沉到开源中等规模。