阿里云把 AI 助手塞进数据仓库 — 企业最贵的救火活开始被外包
这周阿里云给 MaxCompute(其 PB 级数据仓库平台)上线了一个叫 MaxAgent 的 AI 助手,把日常运维和数据分析打包成一句话能问的事。在企业里,"慢作业排查""月底账单对不上""权限巡检"这类琐碎活最吃人——现在云厂商开始用 Agent(能自主规划并执行的 AI 程序)批量接手。
相关推荐
基于 #阿里云 推荐
QwenGLM
阿里和智谱同时押注小模型 — 本地 AI 圈开始陷入选择困难
阿里 Qwen Flash 和智谱 GLM Flash 几乎同时推出,让本地部署用户陷入"留一个还是都要"的纠结。这背后是中国开源大模型从"卷参数"转向"卷同档位"的信号。
8月29日·www.reddit.com
Qwen本地大模型
本地跑 AI 写代码火了 — 但多数公司的显卡还跑不动
本周 Reddit 程序员社区一篇求助帖被反复讨论:作者想用公司闲置的 RTX A4500 工作站(20GB 显存 + 256GB 内存)跑本地大模型写代码,纠结选 Qwen 3 27B 量化版还是更大模型。这不是个例,过去半年本地跑模型写代码正从极客玩具变成部分开发者和中小公司的真实选项。
8月30日·www.reddit.com
NVIDIABlackwell
NVIDIA 顶级显卡上架澳洲折扣超市 — 算力白菜化可能真发生了
本周 Reddit 用户发现,NVIDIA RTX PRO 6000 Blackwell(企业级 AI 显卡,96GB×8)出现在澳大利亚连锁折扣超市 Big W 的预购页。值得关心的是:如果这条零售路径真的走通,算力价格曲线的下沉速度,可能被市场低估。
8月29日·www.reddit.com
DeepSeekGLM
GLM 两张显卡跑赢 DeepSeek — 国产开源不再「将就」
Reddit 用户用两台 NVIDIA DGX Spark(约六万元一台)对比智谱 GLM-5.3 Flash 与 DeepSeek V4 Flash:写代码测试 GLM 97%,DeepSeek 94.5%,但 GLM 慢三成、上下文也短。开源小模型开始有真正的取舍。
8月30日·www.reddit.com
NVIDIANemotron
大模型号称能跑 16GB 显卡?一个人挖出'假压缩',现成工具都用不了
NVIDIA Nemotron 一直宣传能在 16GB 显卡上跑,本地 AI 圈等了几个月没人做到。一个开发者深扒 443 个文件,发现不是模型不行,是压缩工具的 bug。他做了补丁,代价是 LM Studio 这些现成客户端都用不了。
8月30日·www.reddit.com
腾讯Hy4
腾讯一个半月把模型从 295B 堆到 770B — 中国大厂用开源抢时间
腾讯发布 Hy4 开源预览版:770B 总参数、49B 激活、1M 上下文、只支持文本。一个半月内从 295B 做到 770B,中国大厂的开源节奏值得关注——但 49B 激活才决定真实算力成本。
8月30日·simonwillison.net