本周 OpenRouter 和 OpenCode 上线了一个名为「Space Bunny Alpha」的模型,被 Reddit 用户 /u/crusaderky 发现:它的推理过程(Chain of Thought,也就是一步步思考的中间过程)用的是极简的「原始人语言」——「the cat sat on the mat」会被压缩成「cat sit mat」。这位开发者特地卸载了所有插件确认——这不是用户端的问题,是模型本身的设计。该模型被普遍认为是 MiniMax 的 M3.1。我们的判断:这不是 bug,是省钱策略。

这是什么

去年 OpenAI o1 把「思考过程外显」变成了大模型的新卖点——AI 先把推理过程写出来,再给出最终答案,效果更好,但 token(模型按输入输出字数计费)消耗翻倍。所谓 caveman mode(原始人模式),就是把这串思考过程的语言也压缩:用最少的字表达同样的推理。Space Bunny Alpha 不是个例,最近几个月多个开源权重(可下载本地运行的)推理模型都在试这条路。

行业怎么看

支持者认为这是商业化的必然。Anthropic、DeepSeek 等头部厂商都在卷「让推理更便宜」,因为企业客户最终看的是单次调用成本,而不是思考过程多优雅。token 省下来,API 价格就能压下来,「深度思考」功能才能铺开。

但也有研究者提醒三个风险:第一,压缩过度可能让模型丢掉推理细节,「想对了但说错了」的情况会增加;第二,调试变难——开发者无法看清模型究竟想了什么,出了问题只能盲猜;第三,跑分测试表现好不代表真实场景稳定,因为跑分不考察思考过程是否合理。

对普通人的影响

  • 对企业 IT:未来半年推理类 API 的单价大概率继续下降,做深度分析、智能客服的总体成本会更可控。
  • 对个人职场:用 AI 做长文档分析、代码 review 时,等待时间会缩短,单位时间能完成的任务变多。
  • 对消费市场:ChatGPT、Claude 这类消费产品可能跟进压缩策略,「深度思考」功能在不涨价前提下覆盖更多用户。