返回首页

AMD

找到 28 篇关于此标签的文章

Qwen阿里通义

社区版 Qwen3.8 量化模型省 30GB 空间 — 本地跑大模型的门槛又降了

社区开发者 agentionai 发布 Qwen3.8-Flash-Next 的定制量化版本,比主流版本小 20-30GB 而质量相当。本地运行大模型的硬件门槛进一步下移,但目前仍是极客圈的事。

6h ago2 分钟
UbuntuAMD

Ubuntu 26.04 加 AMD ROCm 10.0:本地 AI 又进一步,但 NVIDIA 还稳

Ubuntu 26.04 LTS 配合 Linux 内核 7.0 和 AMD ROCm 10.0 同步登场,在 Reddit 本地 AI 玩家圈引发一轮实测讨论。这是 AMD 撬动 NVIDIA 算力定价权的最新信号,但真实瓶颈不在系统层。

16h ago2 分钟
AMDROCm

AMD 把 ROCm 版本从 7 跳到 10 — 一个月一更,这是抢市场节奏

ROCm 是 AMD 抗衡英伟达 CUDA 的开源计算平台。版本从 7.14 直接跳到 10.0,发布间隔仅一个月。这件事值得关注:AI 算力垄断格局可能出现松动。

1d ago2 分钟
curvedinfAMD

6500 美元旧显卡跑出顶级 AI 速度 — 个体开发者改写企业推理的成本公式

GitHub 用户 curvedinf 用 6500 美元的二手 AMD MI100 显卡,把 Qwen3 27B 模型推理速度从 15 token/s 拉到 972 token/s,约 65 倍提升。值得关心的不是某个开源分支,而是企业部署 AI 的硬件门槛正在被个人项目悄悄压低。

3d ago2 分钟
LemonadeAMD

Lemonade SDK 让本地跑大模型像装 App — 15 种 AI 引擎已统一调度

由 AMD 员工牵头的开源项目 Lemonade 把 15 种 AI 模型引擎藏到同一入口背后,覆盖英伟达/AMD/苹果/高通四类硬件。本地部署大模型正从极客玩具走向可用工具,对数据敏感型中国企业尤其值得关注。

3d ago2 分钟
AMDFramework

3.5万组装机本地跑通Qwen 122B,速度翻倍 — 私有AI部署门槛降到一台PC

一位 Reddit 玩家用 3.5 万元攒出一台本地 AI 工作站(Framework Strix Halo 主板 + AMD R9700 显卡),跑通 Qwen 122B 模型速度翻倍。值得关心的不是硬件本身,而是私有部署大模型第一次有了工作站级别的性价比方案。

3d ago2 分钟
Qwen3AMD

Qwen 27B 长文本速度缩水近三分之二 — 本地玩家不信官方跑分

本周 Reddit 本地 AI 社区用户发帖,准备用 AMD R9700 跑阿里 Qwen3 系列 27B 模型,结果发现官方公布的 51.8 tokens/秒是理想条件下的数字。真正的长文本场景下,速度从 75 跌到 26。值得关心的是:本地部署 AI 大模型正从能不能跑,进入跑得稳不稳的阶段。

6d ago2 分钟
GMKtecAMD

GMKtec 在 IFA 柏林亮出新硬件 — 本地跑大模型进入「工作站级别」

GMKtec 将于 2026 年 IFA 柏林展推出搭载 AMD Ryzen AI Max+ PRO 395 的迷你主机。这是本地大模型(不连云、靠自家电脑跑 AI)从极客玩具走向专业设备的信号,但价格和软件生态仍是悬念。

6d ago2 分钟
llama.cppAMD

用退役服务器跑大模型 — 有人让老 AMD 显卡变成 AI 推理机

Reddit 用户 milpster 联合 GLM 发布了一个针对 AMD GFX906 老架构显卡优化的 llama.cpp 推理分支,Mi50、Mi60、Radeon VII 这些早退役的数据中心 GPU 因此可以本地跑大模型。AI 推理的硬件门槛正在被开源社区悄悄砸到二手市场级别。

Aug 222 分钟
QwenAMD

消费级显卡跑 27B 到 153 tok/s — 本地 AI 的成本拐点正在到来

r/LocalLLaMA 上一位开发者用 159 次实验证明:消费级硬件跑阿里 Qwen3.8-27B,在 HumanEval 上击败双 3090 云服务器。最值得注意的发现是,仅换对话模板就提速 44%——很多"AI 慢"是用错了提示方式。

Aug 212 分钟
NVIDIAAMD

二手 P40 和 MI50 还能跑本地大模型 — 但这条路越走越窄

本地 AI 玩家的小算盘:150 美元捡一块二手数据中心显卡跑大模型。这条路在 2025 年还通不通?值得关心的是,企业和个人玩本地大模型的真实门槛,正在被硬件市场悄悄改写。

Aug 192 分钟
DeepSeekAMD

DeepSeek V4 在家用小主机跑到 22-28 字/秒,本地大模型这事可能真要开始能用了

一位技术爱好者这周在 AMD 迷你主机上跑通了 DeepSeek V4 Flash,速度达到日常办公可用级别。我们关注到,国产开源大模型正从『参数大』过渡到『本地真能跑』,但硬件价格和运维门槛仍把大多数人挡在门外。

Aug 182 分钟
LocalLLaMA英伟达

二手 AI 硬件一周涨 8% — 算力紧张开始烧到个人买家

澳洲 eBay 上有人目睹 AI 计算硬件一周内涨价 8%。这不是孤例 — 个人买家被算力稀缺卡脖子,意味着高端算力的供需失衡已从企业层传导到消费层。

Aug 182 分钟
Qwen通义千问

100 美元硬件跑通阿里 270 亿参数模型 — 本地 AI 的廉价拐点到了

本周 Reddit 上一位极客用 100 美元二手硬件跑通了阿里通义千问 270 亿参数大模型。值得关心的是——大模型本地化部署的成本门槛正在塌方,云端 AI 服务的定价权可能因此松动。

Aug 172 分钟
Qwen阿里

Qwen 27B笔记本实测19 tok/s — 开源大模型终于能本地干活

Reddit用户测试阿里开源的Qwen 27B量化版,在128GB统一内存的ROG笔记本上达到19 tok/s生成速度,并用Agent工具自主开发出一个HTML飞行模拟器。这说明本地大模型已从'能跑'进入'够用'阶段。

Aug 172 分钟
AMDLlama.cpp

AMD 显卡跑本地大模型快 50%,但目前还有使用门槛

Llama.cpp 升级到 ROCm 7.14 后,AMD Radeon 780M 集成显卡跑稠密模型比 Vulkan 路径快约 50%。AMD 第一次有了对普通用户真正可用的本地 AI 方案,但仍限于一类模型且需手动编译。

Aug 172 分钟
NVIDIAAMD

欧洲显卡一个月涨 19%,AI 算力紧缺开始向下外溢

一个追踪 9 个欧洲国家 25 家店铺的硬件比价工具 PriceSquirrel,用固定篮子数据算出:消费级显卡均价一个月涨 19.2%,且连涨三周。表面上是 PC 玩家喊贵,背后是 AI 算力需求正在向消费硬件外溢。

Aug 152 分钟
QwenAMD

本地大模型终于「能跑」了 — 但离你上班用的电脑,还隔着三道坎

阿里即将发布千问 Qwen 3.8,架构沿用 3.6 并支持 MTP(多 token 同时预测)加速。结合 AMD Strix Halo 与苹果 M4/M5 的统一内存架构,爱好者在 2000 美元级笔记本上跑 70B 模型成为可能。但「能跑」和「上班能用」之间,仍隔着价格、显存和软件适配。

Aug 142 分钟
IntelAMD

Intel 新处理器内存带宽翻倍到 512GB/s — 本地跑大模型的硬件门槛正在消失

Intel 下一代处理器 Razor Lake AX 曝光,内存带宽接近 512 GB/s,几乎是现役旗舰 Strix Halo 的两倍。2027 年起,消费级设备本地运行大模型的硬件瓶颈可能被彻底打破,企业 IT 和硬件采购决策者值得提前留意。

Aug 132 分钟
QwenAMD

两千块的 Radeon 7600 跑通 350 亿参数大模型 — 本地 AI 硬件门槛比你想的低得多

有用户用一块约两千元的 AMD Radeon 7600 显卡,把 Qwen 一款 350 亿参数的 MoE 大模型跑到了 21 token/s。这背后是本地推理的硬件门槛在快速下移 — 对注重数据合规的企业 IT 部门,值得重新评估。

Aug 132 分钟
AMDNVIDIA

攒一台 48GB 显存家用 AI 服务器,AMD 比英伟达便宜 650 美元 — 但生态账没那么简单

海外玩家在认真盘算:花 1.5 万人民币买三张 AMD 消费级显卡搭本地大模型推理机,比英伟达方案省三分之一。但省下的钱能不能换来等价的体验,要看 ROCm 这套软件生态是否争气。

Aug 82 分钟
AMDMI25

AMD 新显卡 100 欧跑大模型能行吗 — 一笔划算的本地 AI 入门账

AMD MI25 二手卡 80-100 欧就能拿下,显存够大但推理速度接近十年前的中端显卡。本地跑大模型到底值不值,我们帮你算了一笔账。

Aug 82 分钟
QwenAMD

Qwen3.5 在 AMD 显卡上跑得飞快,在英伟达上反而变慢 — 一个还没人搞懂的怪现象

同一个 Qwen3.5-9B 模型,用 NVIDIA 显卡跑 CUDA 比正常慢 32%,换 AMD 显卡跑 Vulkan 却快 77%-128%。原因疑似 GPU 厂商底层差异,目前只有一份报告,未经独立复现,但跑本地大模型的开发者值得留意。

Aug 82 分钟
AMDStrix_Halo

AMD 新芯片传 192GB 内存 — 本地跑大模型的硬件瓶颈正在松动

AMD 下一代 Strix Halo 传闻将支持 192GB 统一内存,单机即可跑通 122B 参数大模型。内存而非算力,正成为本地部署AI的真正卡点,这个瓶颈一旦松动,企业私有化部署的成本逻辑将重算。

May 42 分钟
AMDHalo Box

AMD 秀出 128GB 本地 AI 主机原型 — 瞄准苹果 Mac 在大模型推理市场的蛋糕

AMD 曝光 Halo Box 原型机(Ryzen 395 + 128GB),首次让 x86 平台具备与苹果 Mac Studio 同级的本地大模型加载能力。值得我们关心的是:本地 AI 推理的硬件格局可能要变。

Apr 302 分钟
AMDRyzen AI 395

AMD 自研 AI 迷你主机 6 月上市 — 芯片公司亲自下场做整机,信号不简单

AMD 在 AI Dev Day 宣布 6 月推出自研 Ryzen AI 395 迷你主机,可能由联想代工。芯片公司从卖零件转向卖整机,意味着本地 AI 推理市场正从概念走向产品化。

Apr 302 分钟
AMDL M Studio

一个 Reddit 帖子揭示的真相:本地跑 AI 大模型,硬件门槛比厂商说的要高得多

一位用户发现自己 24GB 内存的 AMD 迷你电脑只能给 AI 模型分配 8GB 显存,想扩到 16GB 却无从下手。这个看似普通的技术求助,折射出一个被低估的现实:「在家跑 AI」的硬件门槛,远比营销话术描述得复杂。

Apr 202 分钟
Claude CodeAnthropic

AMD 审计报告:Claude Code 在高负载下推理深度下降 67%

AMD AI 高级总监向 Anthropic 提交审计报告,基 于 6852 个会话的量化数据,记 录了 Claude Code 在高负载下系统性性能退化,推 理深度下降 67%,API 调用量暴增 80 倍。

Apr 132 分钟