返回首页
RTX 5080
找到 4 篇关于此标签的文章
QwenRTX 5080
RTX 5080 跑 Qwen 大模型只有 6 字/秒 — 本地部署 AI 的家用门槛还有多高
有人在 Reddit 用 RTX 5080 + 64GB 内存跑 Qwen 量化模型,每秒只生成约 6 个汉字。这件事值得关心:想「让 AI 跑在自己电脑上」,对硬件和调参能力的要求仍远超普通用户。
4h ago2 分钟
QwenRTX 5080
RTX 5080 两分钟跑完 30B 大模型,本地 AI 开始追上云端
一张万元级消费显卡,跑出接近云端大模型的输出,速度比云端快 15 倍。本地部署的 AI 不再是极客玩具,正在变成企业的现实选项。金融、医疗等数据敏感行业,值得重新算一次账。
Aug 142 分钟
通义千问Muse Glimmer
350 亿参数 AI 跑进万元游戏显卡 — 本地大模型今年能用了,但要会选
一位 Reddit 玩家把阿里通义 35B 和美国小众模型 Muse Glimmer 30B 塞进万元 RTX 5080 显卡对比。结果:本地跑大模型今年真正可行,但"靠谱"和"有创造力"之间必须做取舍。对想自建 AI 的企业有现实意义。
Aug 132 分钟
NVIDIARTX 5080
RTX 5080 跑本地编程模型引热议 — 消费级显卡开始抢云端 AI 的活
r/LocalLLaMA 社区热议 RTX 5080+64GB RAM 跑量化编程模型的最佳方案。开发者认真考虑把 AI 编程助手从云端搬回家,消费级硬件正成为 AI 编程的新基础设施,值得非技术背景的管理者关注。
May 22 分钟