返回首页
NVIDIA Blackwell
找到 2 篇关于此标签的文章
QwenNVIDIA Blackwell
Qwen3 模型瘦身 65% 跑分几乎不跌 — 大模型部署成本战升级
一支团队把 Qwen3-27B 模型压缩到原来的 35%,但 GPQA-Diamond 跑分只掉 0.5 个百分点。这意味着大模型部署所需的显存和成本可能大幅下降,是企业 AI 落地最值得关心的技术拐点。
3d ago2 分钟
Deepseekllama.cpp
想本地跑 Deepseek 的人卡了三天 — 「本地大模型」不是装个软件那么简单
一位硬件发烧友用 48GB + 24GB 两块显卡想本地跑 Deepseek,折腾三天才发现:加第二张卡反而比单卡更慢。本地大模型不是装个软件那么简单。
Aug 222 分钟