xAI 这周把 Grok 4.7 放上了 AWS Bedrock(亚马逊云的大模型托管平台)— 一款带 50 万 token 上下文、能「自己检查作业」的模型,现在任何 AWS 企业客户都能直接调用。

这是什么

Grok 4.7 是 xAI 目前最强的模型,定位写代码、做长链路自主任务(Agent:能自己拆步骤、连续执行的 AI 助手)和知识工作。三个细节值得记。 第一,50 万 token(模型处理文字的最小单位,约等于一个中文词)的上下文窗口,可以一次性塞进一本中等厚度的书或几百页法律合同。第二,推理强度分四档(低/中/高/超高),用户可以按任务难度付费,省成本。第三,xAI 最强调的是「自验证」:模型在长任务中会自己检查上一步对不对,再决定下一步 — 一个错误不滚成十个,对 Agent 可靠性很关键。 训练上更「耐力型」:强化学习(让模型通过试错自我改进的训练方法)跑得更久,任务刻意偏向要花数小时完成的那种。这次上 AWS Bedrock,意味着它和 Claude、GPT、Llama 走同一个采购流程。

行业怎么看

积极面的判断:xAI 终于拿到企业市场的入场券。AWS Bedrock 是大模型分销最成熟的货架 — 之前 xAI 只靠自家 API 和 X 平台,现在和 Anthropic、OpenAI 并排出现,企业采购时多了一个选项。 但风险同样明显。第一,xAI 在企业端的品牌力远不如 OpenAI 和 Anthropic,采购名单里容易被默认排除。第二,「自验证」的官方数据来自 xAI 自己,独立测评 Artificial Analysis 给出的是综合进步,但没把 Grok 4.7 推上单项第一。第三,AWS Bedrock 已经挤了十多家模型,多一个选择未必等于多一个订单 — 价格、合规、本地化才是中国企业客户真正关心的。 我们关心的是,这次发布透露出一个信号:xAI 不再只押注 C 端(消费者端)的 Grok App,开始认真抢 B 端(企业端)的预算。

对普通人的影响

对企业 IT:选型清单又多一行。50 万 token 对处理法律合同、医疗病历、财务报告这类长文档有吸引力,值得纳入下季度评估。 对个人职场:暂时用不到。日常用的 ChatGPT、文心、Kimi 等消费级产品不受影响。 对消费市场:xAI 在 C 端的策略没变 — 还是靠 Grok App 和 X 平台吸引个人用户,B 端扩张不会直接传导到消费端价格或功能。