返回首页
模型选型
找到 3 篇关于此标签的文章
LocalLLaMA基准测试
AI 跑分竞赛正在失控 — 社区开发者集体质疑榜单还能信几分
本周 LocalLLaMA 社区一篇高赞帖引发讨论:AI 行业每年发布数百个新基准测试,模型真实能力与榜单分数已明显脱节。值得关心的是,企业采购和个人选工具时越来越依赖的「跑分」,可能正在变成营销工具而非能力证明。
Aug 212 分钟
QwenCoder-Next
Qwen3.6-27B 与 Coder-Next 实测打平 — 选模型不看跑分看场景
一位开发者用 20 小时实测发现,Qwen3.6-27B 与 MoE 架构的 Coder-Next 整体胜率持平,但在不同任务上表现天差地别。更意外的是:关闭「思考模式」反而更稳定。传统跑分正在失灵,场景选型才是关键。
May 32 分钟
Qwen3Gemma4
Qwen 3 还是 Gemma 4?本地 部署玩家正在用实测替 代官方跑分——小模型选型 进入「场景优先」时代
Reddit 上一 个关于「聊天与问答场景下 Qwen 3 35B 和 Gemma 4 26B 哪个更好」的提问,引发大量本地部署用 户讨论。这件事本身不大,但背后的信号 值得关注:越来越多人开始绕开 官方基准测试,用自己的实际使用场景做 选型依据,小模型市场的竞争逻辑正在 悄悄换轨。
Apr 192 分钟