返回首页
AI 推理
找到 3 篇关于此标签的文章
Qwen本地大模型
本地 AI 越来越聪明,但越来越慢 — 开发者开始用「时间预算」挑模型
本地大模型越变越聪明,用户却发现「聪明不等于能用」:跑分高的模型思考链太长,不如跑分低但出活快的模型。本周 Reddit 上有用户点名 Qwen3-32B,呼吁建立「限时榜单」。这是 AI 评估从「准不准」转向「一小时能干多少活」的信号,值得所有打算部署 AI 的企业重新算账。
2d ago2 分钟
NydusJuiceFS
AI 冷启动从 116 秒压到 1.4 秒 — 算力账单的隐形转折点
AI 推理集群扩容时,节点平均要等 116 秒才能开始接活。Nydus + JuiceFS 方案把这个时间压到 1.4 秒,还顺带把模型权重接到同一套存储上。对企业 IT 来说,AI 服务的成本结构和弹性能力正在悄悄发生变化。
Aug 192 分钟
MiniMax华硕 Spark
两张华硕 Spark 显卡跑大模型只慢一点 — AI 推理不再是昂贵硬件的专属
开发者实测发现,售价仅三分之一、功耗仅四分之一的华硕 Spark 集群跑大模型,速度只比两万美元的 RTX 6000 慢不到 5 倍。这表明 AI 推理的性价比拐点已至,但高并发场景仍是廉价硬件的软肋。
May 22 分钟