返回首页
PyTorch
找到 5 篇关于此标签的文章
斯坦福CS336
斯坦福一份优化器作业走红,说明大模型竞争已回到训练基本功
一篇围绕斯坦福 CS336 的 AdamW 优化器教学文章在中文社区传播,内容并不新,但信号很明确:当大模型参数、应用故事越来越同质化,训练环节里的“基本功”重新成为行业分水岭,值得从业者和管理者认真补课。
Jun 212 分钟
GPTQLocalLLaMA
4 比特量化没把模型“压坏”,关键不在压缩而在补偿计算
一篇 Reddit 技术帖把 GPTQ 量化的核心讲清了:4 比特压缩之所以还能保住模型能力,不是因为损失小,而是因为系统会在量化一个权重后,按相关性补偿其他权重。这值得关心,因为本地部署大模型的成本竞争,越来越取决于这类“省显存但不明显降智”的工程细节。
Jun 152 分钟
PyTorch英伟达
PyTorch 占据八成开发者桌面 — 大模型淘金热里,卖铲子的依然是英伟达
PyTorch 已成 AI 开发事实标准,但软件层的统一反而凸显了硬件层 CUDA 的垄断门槛。大模型竞争的瓶颈,正从框架之争退回到显卡算力与配环境上。
May 32 分钟
PyTorchFSDP
从 零实现分布式训练的 PyTorch 教学项目:DP、FSDP、TP、FSDP+TP 与 PP 全覆盖
一个开源教学 仓库用原生 PyTorch 显式实现了五种主流分布式训练并 行策略,绕开高层框架封装,让通信 原语一览无余。
Apr 122 分钟
NVIDIAAITune
NVIDIA 开源 AITune:自动为 PyTorch 模型选择最快推理后端
NVIDIA 开源推理优化工具 AITune,可自动对多个推理后端进行基准测试,并为 PyTorch 模型选出最优配置,显著降低工程团队的手动调优成本。
Apr 122 分钟