阿里这周把 Qwen3-Max 旗舰版本(2.4 万亿参数)的权重全部公开,配合 NVIDIA 最新 GB300 显卡就能跑。值得关心的是——这是目前公开可下载的最大模型之一,性能号称接近闭源前沿;中国公司第一次有了「不绑定 OpenAI 或 Anthropic 也能拿到近顶级 AI」的现实选项。

这是什么

Qwen3-Max 是阿里通义千问系列的最新旗舰。这次开源的是 2.4 万亿参数版本(2.4T-A95B),每次推理只激活其中 950 亿参数——这种「按需调用专家」的设计叫 MoE(混合专家),总参数虽大但单次成本可控。

几个关键点:

  • 混合注意力机制:结合全注意力(精度高)和线性注意力(长文本便宜),号称 100 万 token 上下文也能压住成本
  • 可配置推理:用户能切换「深度思考」和「快速回答」模式,按任务省钱或省时
  • 部署门槛:需要 NVIDIA GB300 NVL72 这种数据中心级硬件,单机房投入千万级起步

行业怎么看

正面声音主要来自阿里云客户和国内 AI 社区:开源让金融、政务、能源这些「数据不能出门」的强监管行业第一次有了自建大模型的可能。NVIDIA 显然乐见——多一个旗舰模型适配自家硬件,就多一批订单。

但质疑同样不少:

  • 真正的「开源」对绝大多数公司是假的——2.4T 模型没有几亿元硬件预算根本跑不起来
  • 阿里同时卖 API、卖算力、卖咨询服务,开放权重和商业利益存在张力,社区长期维护存疑
  • 模型大不等于全场景强,企业仍需大量微调和工程优化,部署后效果可能打折
  • 海外分析师更冷静:开源追平闭源主要靠参数堆叠,在对齐、安全、工具调用等工程细节上仍有差距

对普通人的影响

对企业 IT:金融、政务等强监管行业可以开始认真评估「自建大模型」的成本结构,不再被迫只走付费 API 一条路。

对个人职场:你日常用 ChatGPT 或 Claude 短期不会有变化;但如果公司底层换成 Qwen3-Max,对话体验的「静默升级」可能一两个月内发生在你的钉钉、企业知识库里。

对消费市场:钉钉、淘宝、高德等阿里系产品的 AI 助手质量大概率在年内有可见跃升——背后跑的就是这套新模型。