返回首页
本地训练
找到 2 篇关于此标签的文章
DDR5RTX PRO 6000
装 AI 工作站别只追新平台 — Reddit 实测老平台加卡反而多 50% 算力
一位 Reddit 用户在 Vast.ai 租机实测对比新旧两代硬件平台跑大模型预训练:新一代只快 15-20%,但省下的内存预算能多塞一张显卡,整体算力反而高 50%。这戳破了 AI 工作站'买新不买旧'的直觉,值得中小企业财务决策者和自建团队看看。
10月2日2 分钟
AMD本地训练
一个人两周用游戏掌机训出 14 个大模型 — 算力去 NVIDIA 的早期信号
一名独立开发者用 Rust 和 Vulkan 在一台游戏掌机上两周做出大模型训练框架,支持 14 种主流开源架构完整训练和 LoRA 微调,误差上限 2e-7、最差观察值 1.19e-7。值得关心的是:AI 训练正在悄悄脱离 NVIDIA 和云厂商的垄断。
9月30日2 分钟