掘金上一篇教新人用 AI 写待办事项页的教程最近阅读量破万,评论区就被同一个问题刷屏——"我按步骤做了,为什么还是有 bug"。我们判断,这指向一个被普遍跳过的环节:验收。

代码能跑不等于能用,这正是非工程师使用 AI 写代码时最容易栽跟头的地方。

这是什么

文章给出了一套由浅入深的五层验收框架:

  • 第一层:语法是否正确(括号、引号、大括号有没有配对)
  • 第二层:代码能不能运行(依赖装了吗?元素 id 对得上吗?)
  • 第三层:功能结果是否正确(这是最易出错的一层——代码不报错,但把事做错了)
  • 第四层:边界和异常是否处理(空输入、超长文本、连续点击)
  • 第五层:是否适合当前项目(框架版本对不对?允许新增依赖吗?)

编辑部注意到,文章反复强调一句话:"不要只凭'看起来对'来判断。"这恰恰是非工程师最常犯的错——把"运行没报错"等同于"功能没问题"。

行业怎么看

支持者认为,这套框架把验收从"工程师专属"拉到了"普通人也能上手",对推动 AI 编程普及有意义。文章里"未完成数量统计"的例子很典型——AI 写了 todos.length 而不是过滤未完成的项,代码跑得通,数字却错了。

反对意见同样值得听。一位资深工程师在类似讨论下留言:"如果验收靠人工填表,只是把问题往后推了一步。公司级落地必须配自动化测试和类型检查(TypeScript 这类能在写代码时就发现错误的工具),否则 AI 写得越多,bug 越多。"

更现实的隐忧是:五层检查需要时间和精力,而 AI 的诱惑恰恰是"快"。多数人会在第三层就放弃,因为前两层已经"看起来能用"。

对普通人的影响

对企业 IT:企业里用 AI 生成内部工具的人会越来越多,IT 部门可能需要新岗位——不是开发,是"懂业务的 AI 代码验收员"。

对个人职场:运营、市场、行政岗位正在用 AI 做小工具,至少做到第三层验收,会省掉大量"上线后再救火"的时间。

对消费市场:越来越多小团队甚至个人开发者的产品背后有 AI 的影子,消费者以后评估产品,可能要看的不只是功能,还有"代码验收报告"。