这是什么
本周 Reddit 开源模型社区 LocalLLaMA 上,一组对比实测引发争论:同一家实验室的最新一代模型(3.8),把"思考模式"(让 AI 先写一大段推理再回答的功能)关掉后跑测试,成绩不如上一代(3.6)。
发帖人 GodComplecs 的判断是——为了押注"智能体"(Agent,让 AI 自己规划步骤完成任务的形态),实验室正在牺牲"基础模型"的体验。基础模型指不依赖长推理、直接响应指令的版本,也是企业里写邮件、改文案、做摘要最常用的形态。
行业怎么看
主流方向仍是押注思考模式。OpenAI o 系列、Anthropic Claude、DeepSeek R1、阿里 Qwen 都在把"先想再答"做成默认。背后的逻辑是:让 AI 学会拆解复杂任务,才是通往更高级智能的路径。
反对意见集中在三点。第一,思考有成本:调用更慢、token 更贵,对写邮件、改文案的场景是浪费。第二,社区实测显示,思考模型关掉思考后反不如纯指令模型,说明基础能力被挤压。第三,Reddit 评论里有人质疑:实验室是不是把算力集中投向"看起来更性感"的智能体叙事,忽视了普通用户最常用的功能?
在我们看来,风险在于当所有头部实验室都这样做,开源生态里"轻量、好用、便宜"的非思考模型可能越来越少,最后买单的是企业 IT 预算和终端用户体验。
对普通人的影响
企业 IT 采购:选型时要分清"思考模式"和"普通模式",按场景搭配,不是模型越新越好。
个人职场:写邮件、改文案、做摘要这类日常任务,长思考反而拖慢响应,可以主动关闭该功能。
消费市场:消费级 AI 产品(智能助手类)的体验可能变慢变贵,因为"思考"消耗更多算力,最终转嫁到订阅价上。