NVIDIA 把语音模型调成沙特方言通 — 巨头开始啃方言硬骨头
NVIDIA 这周悄悄发了一篇技术博客:把 Nemotron 语音识别模型做了沙特方言微调,单这一点上识别率从基准模型的不到 50% 拉到 80% 以上。事不大,信号明确 — 大模型的较量已经从「谁的中文/英文好」转向「谁能在真实生活场景里不翻车」。
相关推荐
基于 #NVIDIA 推荐
NVIDIANemotron
NVIDIA 开源多人会议识别 — 会议纪要自动化终于能用了
NVIDIA 在 Hugging Face 开源 Nemotron 3 说话人识别模型,主打实时、多人场景。值得关心的是:会议转录过去几年一直卡在"分不清谁说的",开源能否打破这一僵局。
9月23日·huggingface.co
NVIDIANeMo Relay
AI Agent 答对题却悄悄多花一倍钱 — NVIDIA 想让企业看清它怎么跑的
过去企业只看 AI 最终答案对不对。NVIDIA 在 9 月底发布的 NeMo Relay 教程教团队看 Agent 工具调用的全过程:什么时候调的、调了几次、有没有偷偷重试。这是 AI 项目从 demo 走向生产时最容易被忽视的成本黑洞。
10月1日·juejin.cn
NVIDIAHSTU
NVIDIA 让 AI 推荐快 5.93 倍 — 但这个数字需要 100% 缓存命中才成立
NVIDIA 发布 HSTU 推荐系统端到端部署方案,官方基准显示最高 5.93 倍加速。但「最高」和「100% 命中」必须绑在一起读——真实业务命中率往往只有一半。峰值数字不能直接拿来立项。
10月1日·juejin.cn
NVIDIAMeta
推荐算法开始抄大模型的作业 — NVIDIA 与 Meta 把 HSTU 推理做成开箱即用的产品
推荐系统的底层逻辑正在改变 — 从过去的检索、排序、预测流水线,变成对用户行为序列的统一建模。NVIDIA 与 Meta 本周联手,把后者 2024 年提出的 HSTU 架构推理做成了开箱即用的部署方案。这意味着电商、短视频的算法分发逻辑,可能很快进入'类大模型'时代。
9月30日·developer.nvidia.com
NVIDIAcuObject
NVIDIA 让 GPU 直接读硬盘 — AI 瓶颈正从算力转向数据读取
NVIDIA 这周发布 cuObject 和 SCADA Server SDK,让 GPU 绕过 CPU、直接读取硬盘和对象存储。表面是给工程师的开发工具,背后指向一个判断:AI 行业的瓶颈正从'能不能算'转向'能不能又快又便宜地读到数据'。这事值得关心,因为它直接决定未来 AI 服务的成本曲线。
9月30日·developer.nvidia.com
AMDNVIDIA
本地跑 AI 仍是奢侈游戏:Reddit 用户攒 64GB 双卡拖两年
一位硬件爱好者犹豫两年终于下单:买 2 张 AMD 显卡组成 64GB 双卡机,本地跑开源大模型看似数据自由,实际账单远超想象。
9月30日·www.reddit.com