返回首页

RTX 4090

找到 5 篇关于此标签的文章

GepardCoval

单张 RTX 4090 跑赢所有付费 TTS — 声音 AI 正在复制 Llama 时刻

一个开源团队用消费级显卡上的 TTS 模型,在第三方测评中延迟跑赢 24 个付费 API。这是声音领域的'Llama 时刻',意味着语音合成成本可能再次断崖式下降,所有用 AI 配音、做有声内容的公司都该重新算账。

3d ago2 分钟
Qwen通义千问

27B 模型在 4090 上 3 小时做出 Minecraft 克隆 — 本地 AI 能力逼近闭源旗舰

一位海外开发者用本地部署的 27B 参数开源模型(通义千问系列、Q4 量化版),在 RTX 4090 显卡上耗时约 3 小时、电费不到 1 美元,AI 自动完成了代码、音频、贴图和 3D 模型四类资产,最终得到一个可运行的 Minecraft 克隆版游戏。开源大模型的本地能力正快速逼近此前只有顶级闭

3d ago2 分钟
Qwen3llama.cpp

笔记本+显卡盒子拼出 40GB 显存,本地跑 Qwen3 27B 速度涨七成

一位 Reddit 用户用笔电外接显卡盒+雷bolt 4 拼出 40GB 显存跑 Qwen3 27B,生成速度从 16 提升到 27 token/秒,涨幅约七成。这条小众实践提示我们,本地部署成本曲线仍在下行,云端不再是唯一答案。

Aug 202 分钟
Qwen阿里通义千问

阿里 Qwen3.8-27B 双 4090 跑通 128K,本地部署大模型成本降到十万级

阿里通义千问最新开源的 Qwen3.8-27B,被开发者用两块 RTX 4090 跑通 128K 上下文。原生 256K 上下文、FP8 量化约 29GB,硬件成本十几万元。本地部署'接近 GPT 级别'模型从云厂商特权走向中小企业采购清单。

Aug 182 分钟
QwenRTX 4090

单张 RTX 4090 跑通 27B 大模型 — 本地 AI 硬件成本曲线悄悄跌穿

Reddit 本周技术社区的实测帖:开发者把 27B 参数的通义千问塞进单张消费级显卡 RTX 4090,上下文做到 25-35 万 token。本地部署大模型的硬件门槛,正在悄悄跌穿中小企业的心理预期。

Aug 162 分钟