返回首页
Alibaba
找到 3 篇关于此标签的文章
QwenAlibaba
阿里 Qwen 跑通两张 RTX 3060 — 但默认配置慢 7 倍
Reddit 用户晒出:阿里 Qwen3 125B 量化版在两张 RTX 3060 玩家显卡上跑到 400 t/s。但他最初只跑出 36 t/s——11 倍差距,全卡在一个默认配置陷阱。本地大模型从'跑起来'到'跑得好',中间还差一段工程活。
1d ago2 分钟
QwenUnsloth
Reddit 用户催更阿里 35B 模型压缩 — 开源 AI 算力门槛又悄悄降了一档
一条 Reddit 请求呼吁把阿里 Qwen 35B 模型用新一代压缩方案重新量化。背后是开源 AI 算力效率持续突破,本地部署成本正在结构性下降。
2d ago2 分钟
AlibabaQwen
Qwen 新版 27B 跑分逼近 70B — 小模型路线的牌这次打出来了
阿里 Qwen 团队本周在 Artificial Analysis 第三方榜单上放出 27B 模型跑分,综合成绩逼近自家上一代 70B 级。这意味着「模型越大越强」的旧叙事正在松动,对企业自部署成本和个人开发者都是值得重新算账的变量。
Aug 172 分钟