代号 Ox Alpha 在 Reddit 本地模型圈出现,自称来自 Z.ai(智谱)的下一代 GLM,号称支持 1M token(token 是大模型处理文字的最小单位,1M 大约相当于 70 万中文字)的上下文窗口——如果属实,意味着国内大模型公司正在百万上下文这条线上与 Anthropic、Google 正式对标。
这是什么
本周 Reddit 的 LocalLLaMA(本地跑开源模型的爱好者社区)出现一个叫 Ox Alpha 的匿名模型。它在自我介绍里写「我是 GLM,由 Z.ai 开发的语言模型」,对外宣称能力包括:1M token 上下文窗口、文本/图像/视频三种输入格式,主打「高效编程、长链路 Agent(让 AI 自动完成多步任务的智能体)任务、生产可用」。
目前没有 Z.ai 官方确认,模型也没有公开发布渠道,属于典型的「stealth 灰测」——厂商匿名放出,搜集早期反馈再决定是否正式发布。
行业怎么看
支持者认为这是 Z.ai(智谱)正在为下一代 GLM 预热的信号。1M 上下文是 Anthropic Claude 和 Google Gemini 早就亮过的数字,国内厂商现在跟进,说明「长上下文」已经从 PPT 概念走到工程交付。
反对意见同样值得听。Reddit 帖子里有人质疑这其实是「权重冒名」——故意把模型训练得自称是别家产品,用来测社区反应或蹭热度;也可能是某团队借 GLM 名头测自家产品。更重要的是,1M 上下文窗口的实际可用性是行业老问题:能塞进去不等于能稳定记住,更不等于响应速度可控,Anthropic 和 Google 在公开场合也都承认过这个限制。
对普通人的影响
- 对企业 IT:长上下文如果真正落地,企业可能第一次可以把一份完整的产品手册或合规文档塞进 AI 里直接问答,知识库类应用的工程门槛会下降。
- 对个人职场:先别激动,目前还在「被曝光」阶段,离稳定可用还有距离,等正式版本、定价和合规说明出来再评估更稳妥。
- 对消费市场:如果数字属实,C 端用户最直接的感知是 AI 对话不再聊几页就「失忆」,长文档、长视频脚本这类任务会更顺手。