返回首页

GPU

找到 14 篇关于此标签的文章

AMDROCm

AMD 把 ROCm 版本从 7 跳到 10 — 一个月一更,这是抢市场节奏

ROCm 是 AMD 抗衡英伟达 CUDA 的开源计算平台。版本从 7.14 直接跳到 10.0,发布间隔仅一个月。这件事值得关注:AI 算力垄断格局可能出现松动。

1d ago2 分钟
NVIDIASpectrum-X

GPU 堆到几十万张后,瓶颈变成了网线 — NVIDIA 想重做这件事

NVIDIA 发布 Spectrum-X 专用网络平台,瞄准 AI 大模型训练的连接瓶颈。当模型规模膨胀到几十万张 GPU 协同,传统以太网被推到临界点。这不只是技术升级,是 AI 基础设施话语权的重新划分。

5d ago2 分钟
WebGPU浏览器

浏览器可直接调度GPU了 — WebGPU正在为网页端AI跑通底层链路

WebGPU是新一代浏览器标准,让网页JS可以直接调度本地GPU的并行计算能力。主流浏览器近两年陆续落地支持,这为浏览器内置AI推理等重负载场景打通了底层通路。

6d ago2 分钟
LocalLLaMARTX 3090

在家跑大模型卡在机箱尺寸上 — 本地 AI 离「开箱即用」还远

本周 Reddit 一则装机求助引发讨论:玩家想把 3090+3070 双卡塞进 B450 主板跑本地大模型,被卡槽间距挡住。背后是消费级本地 AI 部署的真实门槛。

Aug 222 分钟
NVIDIA量化交易

NVIDIA 把资产聚类塞进 GPU — 量化基金的算力军备赛还在继续

NVIDIA 本周发布 AdaptGrow 工具,把金融产品按行为相似度分组这件事从 CPU 搬到 GPU。我们关心的是:当所有人盯着大模型时,金融基础设施的算力竞赛并未降温。

Aug 212 分钟
NVIDIACUDA

英伟达把自家 GPU 文档做成 AI 可调用的标准模块 — 大模型拼'能干活'的时代来了

英伟达这周上线官方托管的 CUDA MCP,让 AI 助手能直接搜最新 GPU 编程文档、写优化代码、分析性能。值得关心的是:MCP 这种'AI 调外部工具'的统一协议被头部厂商接受,未来大模型拼的不只是聪明,而是能不能真的接入真实世界的资源。

Aug 202 分钟
DeepSeekNVIDIA

DeepSeek 在 16 张消费级显卡上跑通了 — 本地部署前沿大模型的门槛塌了

海外技术社区本周出现一份详细方案:用 16 张 RTX 5060 Ti 拼出机器本地运行 DeepSeek 模型,成本只有专业卡的六成。我们关心的不是 DIY 项目本身,而是它代表的方向——大模型私有化部署的硬件门槛正在快速下移。

Aug 202 分钟
NVIDIAUMAP

NVIDIA 把科研级数据分析提速几十倍 — 多卡背后是更深的企业算力账

NVIDIA 这周把 UMAP(一种把高维数据压到二维平面、用于可视化和特征提取的数学方法)搬上多 GPU 并行框架,速度提升几十倍。对企业来说,这意味着以前跑不动的数据分析任务现在能跑了 — 但代价是对英伟达的算力绑定又深了一层。

Aug 182 分钟
LocalLLaMA英伟达

二手 AI 硬件一周涨 8% — 算力紧张开始烧到个人买家

澳洲 eBay 上有人目睹 AI 计算硬件一周内涨价 8%。这不是孤例 — 个人买家被算力稀缺卡脖子,意味着高端算力的供需失衡已从企业层传导到消费层。

Aug 182 分钟
Dharma-AIGPU

同一集群仅改调度顺序多挤出 33% 利用率 — 但别急着欢呼

Hugging Face 博客上一篇来自 Dharma-AI 的技术分享抛出一个反直觉数字:同一组 GPU,什么硬件都没换,只调整任务调度顺序,集群利用率就提升了 33 个百分点。这事值得关心,因为它意味着 AI 算力荒的另一面,可能是大量闲置。

Aug 172 分钟
NVIDIADynamo 1.0

AI 推理账本重写:NVIDIA Dynamo 1.0 押注 Agent 时代

我们注意到 NVIDIA 把 Dynamo 推理平台推到 1.0 正式版——表面是技术升级,背后是 AI 算力计费方式的转向:从'GPU 小时'走向'Agent 任务'。

Aug 172 分钟
NVIDIA英伟达

英伟达真正值钱的不是更快的芯片 — 是二十年没人敢换的那套软件

英伟达从 1993 年加州一家快餐店诞生的显卡公司,成长为市值万亿的 AI 算力霸主。这条路靠的不是芯片更快,而是 2006 年开始铺、二十年没人敢换的软件生态。理解它,是看懂 AI 算力为什么这么贵的前提。

Aug 142 分钟
英伟达RTX 5090

5090 之后再等五到十年,GPU 三倍性能才到 — 但功耗可能先撑不住

Reddit 网友算了笔账:2009 到 2025 年英伟达消费级 GPU 每代性能平均涨 50%。按此推算,要做出 RTX 5090 三倍性能的下一代 GPU,最早 2029 年,最晚 2038 年。同时功耗也在涨。

Aug 132 分钟
YCGPU

GPU 跑 Agent 利用率仅三四成 — 专用推理芯片的窗口正在打开

YC 指出当前 GPU 跑 Agent 工作流利用率仅 30-40%,根因是芯片架构与 Agent 循环分支模式错配。专用推理芯片的创业机会由此而生,但生态锁定与需求演化仍是硬风险。

May 52 分钟