返回首页
Nemotron
找到 4 篇关于此标签的文章
Hugging FaceGGUF
Hugging Face 审计结果:14% 的开源 AI 模型文件名实不符
一位独立开发者审计了 Hugging Face 上 25 个仓库的 443 份 GGUF 量化模型文件,发现 64 份——约 14%——的文件名与实际精度不符。本地跑 AI 的玩家需要重新审视自己的模型清单。
1d ago2 分钟
NVIDIAAWS
NVIDIA 在 AWS 推 Agent 专用小模型 — 大模型不必每步都上
NVIDIA 这周把专为 Agent 高频小任务设计的小模型放上 AWS 一键部署平台,主打单卡可跑、开源可改。信号很明确:Agent 落地正从「大模型包打天下」走向分层路由。这对企业 IT 采购和 AI 工具使用者都有现实影响。
Aug 172 分钟
NVIDIANemotron
NVIDIA 把大模型从 66GB 压到 22GB 还快 4 倍 — 推理成本的故事正在改写
NVIDIA 的开源大模型 Nemotron 3.5 Lightning 推出 NVFP4 压缩版:体积从 66GB 缩到 22GB,速度最高提升 4 倍,精度声称无损。这件事值得关心——它直接改写 AI 推理的成本结构,企业自建 AI 的门槛被实质性拉低。
Aug 172 分钟
llama.cppGLM-4.7
单张 RTX 4090 上最佳本地代理编码 LLM
一位 RTX 4090 用户通过 llama.cpp 及 Google turbo 量化方法,对 GLM-4.7、Nemotron-30B 和 Qwen3-Coder 进行本地代理编码基准测试。
Apr 62 分钟