返回首页

ROCm

找到 7 篇关于此标签的文章

UbuntuAMD

Ubuntu 26.04 加 AMD ROCm 10.0:本地 AI 又进一步,但 NVIDIA 还稳

Ubuntu 26.04 LTS 配合 Linux 内核 7.0 和 AMD ROCm 10.0 同步登场,在 Reddit 本地 AI 玩家圈引发一轮实测讨论。这是 AMD 撬动 NVIDIA 算力定价权的最新信号,但真实瓶颈不在系统层。

16h ago2 分钟
AMDROCm

AMD 把 ROCm 版本从 7 跳到 10 — 一个月一更,这是抢市场节奏

ROCm 是 AMD 抗衡英伟达 CUDA 的开源计算平台。版本从 7.14 直接跳到 10.0,发布间隔仅一个月。这件事值得关注:AI 算力垄断格局可能出现松动。

1d ago2 分钟
AMDLlama.cpp

AMD 显卡跑本地大模型快 50%,但目前还有使用门槛

Llama.cpp 升级到 ROCm 7.14 后,AMD Radeon 780M 集成显卡跑稠密模型比 Vulkan 路径快约 50%。AMD 第一次有了对普通用户真正可用的本地 AI 方案,但仍限于一类模型且需手动编译。

Aug 172 分钟
AMDNVIDIA

攒一台 48GB 显存家用 AI 服务器,AMD 比英伟达便宜 650 美元 — 但生态账没那么简单

海外玩家在认真盘算:花 1.5 万人民币买三张 AMD 消费级显卡搭本地大模型推理机,比英伟达方案省三分之一。但省下的钱能不能换来等价的体验,要看 ROCm 这套软件生态是否争气。

Aug 82 分钟
NVIDIACUDA

CUDA 仍能收溢价,不是因为模型不会写代码,而是生态太难补

Reddit 上一个直白提问点中了 AI 硬件竞争的关键:大模型已经很会写代码,但 AMD 的 ROCm、英特尔的软件栈仍追不上 CUDA。值得我们关心的是,算力市场的壁垒越来越不只是芯片性能,而是“能不能稳定跑起来”的整套软件生态。

Jun 252 分钟
MiMo-2.5llama.cpp

两台 128GB 小主机跑起 MiMo-2.5,本地大模型正在逼近企业可用线

一位开发者用两台 128GB 机器和消费级显卡跑起 MiMo-2.5,并给出 356 tokens/s 预填充、15 tokens/s 生成速度。我们注意到,这不是“玩家炫技”那么简单,而是本地部署大模型正从实验阶段走向部分企业可用阶段。

Jun 212 分钟
Qwen3.5LocalAI

Qwen 3.5 35B 基准测试:AMD Strix Halo 上的 Vulkan 与 ROCm 对决

在 AMD Ryzen AI MAX+ 395 上,Vulkan 在令牌生成方面胜出(约 57.5 t/s),而 ROCm 在提示处理方面领先(约 1052 t/s)。

Apr 82 分钟