返回首页
RTX 3060
找到 3 篇关于此标签的文章
QwenAlibaba
阿里 Qwen 跑通两张 RTX 3060 — 但默认配置慢 7 倍
Reddit 用户晒出:阿里 Qwen3 125B 量化版在两张 RTX 3060 玩家显卡上跑到 400 t/s。但他最初只跑出 36 t/s——11 倍差距,全卡在一个默认配置陷阱。本地大模型从'跑起来'到'跑得好',中间还差一段工程活。
1d ago2 分钟
LocalLLaMARTX 3060
消费级显卡跑大模型个人部署 AI 离企业可用还差多远
一位开发者用 6 张 RTX 3060 和 Intel Arc B60 显卡,在自家跑起了大语言模型,把经验写成 4 篇实战。我们看到,这是个人玩家领域的进展,但商业部署的稳定性与成本结构,仍是另一回事。
3d ago2 分钟
DeepSeekRTX 3060
4 张消费显卡跑通 144GB 大模型 — 本地 AI 部署的成本拐点正在到来
一位开发者用 4 块 RTX 3060(共 48GB 显存)+ 普通工作站,跑通了 144GB 的 DeepSeek-V4-Flash 量化版,提示处理约 100 token/s。值得关心的是:本地大模型不再必须堆 A100/H100,企业级私有 AI 的硬件门槛可能比预想低一截。
Aug 182 分钟