这是什么
本周掘金上一篇《Codex 源码导读》第二部分在开发者圈传开。Codex 是 OpenAI 的命令行 AI 编程工具——在终端里和 AI 对话,让它直接读写代码,其底层代码(codex-rs)已开源。这篇文章拆的是最基础的问题:用户按回车后,AI 内部到底跑了一圈什么?
答案比想象中复杂。系统先判断"这是新问题还是补充上一轮",再让模型推理(即让 AI 思考下一步),再决定是否调用工具。调工具前要过五道闸门:执行策略校验、审批弹窗、沙箱隔离(防止 AI 误删文件)、并行控制、结果回收。整个流程涉及数十个文件、上千行代码协作。
我们的判断:当一个 AI 产品值得被"读源码"式拆解时,它已经从"能不能用"进入了"怎么用才稳"的阶段。
行业怎么看
看好的一方认为,这是 Agent(能自主完成多步任务的 AI 助手)走向工程化深水区的标志。OpenAI 把代码摊开,等于承认 Agent 不是"装个 ChatGPT 就能用"——它是一套需要被理解、被改造、被治理的系统。
但也有反对声音。源码越复杂,恰恰说明 Agent 离"开箱即用"还有距离。一位资深架构师评论:"五道审批闸门看着安全,背后是无数边角案例(异常情况)堆出来的妥协。普通企业直接用云端托管版更现实,自己部署等于给自己挖坑。"也有人提醒:源码公开对 OpenAI 是双刃剑——竞品可以照抄,但用户对"AI 为什么做这个决定"的信任度会更高。
对普通人的影响
对企业 IT:Agent 落地不是装软件,而是引入一位需要 KPI、日志、权限边界的新员工。审批流、行为审计、合规留痕必须提前设计,否则出事时找不到责任链。
对个人职场:用 AI 写代码、写报告的人正在分化。一类人理解 Agent 内部逻辑,能指挥它做复杂任务;另一类只会按回车键。前者的溢价会越来越明显。
对消费市场:未来 AI 产品会更透明,但也会更复杂。选型时别只看演示效果,要问清楚:它做了什么决策?谁批准的?出错谁负责?