本周 Lobsters 技术社区一则题为《Thrust vs. Steer》的帖子,用飞船比喻 AI Agent 的设计哲学——「推力派」主张堆算力、堆 token(模型处理的文本单元)、做更长思维链让 Agent 直冲,「转向派」强调对齐、约束、精准导航。帖子作者直接把争论框定为又一例邓宁-克鲁格效应(一种认知偏差:能力不足者反而最自信)。这件事值得我们关心:它暴露了当下 AI 工程界最真实的路线焦虑——钱和算力砸下去,到底换来的是能力还是失控。
这是什么
飞船靠引擎推进,靠舵转向。映射到 AI:一派继续把模型做大、做长上下文、做更长 Chain-of-Thought,让 Agent 「力气更大」;另一派强化工具调用规范、加反思机制、设安全护栏,让 Agent 「更像老司机」。这不是新话题,但 2024 年底 Agent 落地潮让它重新升温——大量项目失败让从业者开始怀疑,单纯加推力并不等于能到达目的地。
行业怎么看
支持推力优先的人认为,AGI(通用人工智能)级别的能力一旦突破,许多「转向」问题会自然解决——就像有了足够强的发动机,舵的问题好办。反方意见更尖锐:有从业者评论说,现在 90% 的 Agent demo 看起来惊艳,但生产环境跑三天就崩,问题全出在「不会拐弯」。Anthropic、OpenAI 最近工程博客都在悄悄加码「可控性」方向,被视为转向派的信号。但也有中立声音提醒:两个维度本质是工程权衡而非路线对立,强行二选一才是邓宁-克鲁格的真正体现。
对普通人的影响
对企业 IT:如果团队在评估或采购 Agent 产品,别只问「能做什么」,更要问「做错了怎么兜底」。能拐弯的产品才敢上生产。
对个人职场:用 AI 工具时主动设边界比无脑放手更重要——把 AI 当实习生用,而不是当自动驾驶。
对消费市场:接下来一年,「可控性」会成为 AI 产品卖点,但也会出现过度保守导致体验下降的反例,保持自己的判断力。