返回首页
Qwen3.8
找到 4 篇关于此标签的文章
Qwen3.8Muse-Glimmer
Qwen3.8 跑 30 小时还翻车,小模型三小时搞定 — 架构巧比参数大更重要
一名 r/LocalLLaMA 用户测试发现,Qwen3.8 高投入模式跑完一套基准要 30 小时、还挂了 16 题;Muse Glimmer 三小时搞定,隐式知识得分反而更高。架构巧思开始比参数堆叠更重要,做本地部署和 AI 选型的人值得记一笔。
3d ago2 分钟
阿里Qwen3.8
阿里把 Opus 级模型塞进 24GB 显卡,开源本地大模型真正可用了
Qwen3.8-27B 开放下载 48 小时冲上 Hugging Face 趋势榜第一,Cline 开发者 4 天内把它选成本地首选。本周最值得关心的是:开源大模型第一次在性能、硬件门槛、速度上同时摸到「真能用」的临界点。
Aug 222 分钟
Qwen3.8Qwen3.6
Qwen3.8 27B 在 12GB 显存上跑不顺:MoE 才是正解
一个 Reddit 实测在 12GB 显存笔记本上跑 Qwen3.8 27B,结果 2-bit 版错题、3-bit 版卡顿,老一代 Qwen3.6 MoE 反而又快又对。
Aug 162 分钟
Qwen3.8阿里
Qwen3.8 27B 实测:开最高推理档位,多花 7 倍时间只多 10% 质量
阿里千问新模型支持三档推理强度(让模型'多想一步'的程度)。实测显示:最高档耗时是最低档 6.4 倍,但视觉评分只多 10%。AI 的边际收益递减,已经肉眼可见。
Aug 162 分钟