Coding Agent
找到 8 篇关于此标签的文章
对话越长,AI 越笨:Agent 的真正瓶颈不在记忆,而在读不懂 PPT
一位工程师提出,Agent 卡在落地的根源不是上下文太短,而是它仍在用聊天记录当工作记忆。当 PPT、表格、文档这些"产物"能被 AI 直接读、改、验证时,Agent 才真正进入工作场景。
AI 写 UI 跨页总跑偏 — 有人把网站拆成说明书喂回去
开源工具 Imprint:输入网址,输出 DESIGN.md 设计说明书,记录颜色、字体、间距规则并附置信度,专供 Coding Agent 读取。瞄准的是 AI 生成 UI 跨页风格不统一的老问题。
Qwen 27B 真改了一次 Git 仓库 — 但更值得抄的是评测方法
开发者用真实 Git 仓库测了 Qwen 27B 模型,发现它能改代码、跑测试、甚至从错误里恢复。这件事真正值得关心的不是结果,而是这份评测方法本身够不够硬——6 条标准可能是中国 AI 行业目前最缺的东西。
Simon Willison:别逐行审查 AI 代码,真本事在指挥和验收
知名独立开发者 Simon Willison 这周发文:让 AI 写代码真正落地的关键,不是逐行审查,而是'敢下指令、能验收'。我们认为这是 Agent 时代被低估的软技能,值得每位与 AI 协作的人关心。
智谱同周把模型和 Coding Agent 一起发 — 大模型公司从'卖 Token'转向'卖生态'
智谱同周发布 GLM-5.3 模型和 ZCode Coding Agent,官方数据自家组合比搭配 Claude Code 通过率高 2.39%。这反映大模型公司正从'卖模型能力'走向'模型 + 工具整套交付'。
AI 改代码,测试全过、价格算错 — 一例隐形 bug 敲打企业 IT 治理
Andrew Ng 这周反复提的那个 90% 数字,这周一篇被广转的工程师复盘把它翻译成了具体案例:Codex 帮他改火车票往返定价代码,测试全绿,标准策略却悄悄开始算错价格。Agent 项目卡在落地,卡的从来不是技术 demo。
Pi 不把 MCP 塞进核心 — 工具多了之后,这是一次更克制的工程选择
一个 AI 编程工具刻意不内置 MCP——这件事看起来像反标准,其实指向一个被默认设计掩盖的工程问题:协议解决连接,但谁来管上下文与治理策略?
一段对话存成一行行文件,AI 编程工具开始补上“长期记忆”这一课
这篇技术文章讲的不是新模型,而是 AI 编程工具真正好不好用的一层基础设施:会话持久化。把对话按 JSONL 追加写入磁盘后,AI 才能做到重启续聊、多窗口隔离和回退重走。值得关心的是,Agent 的竞争正在从“会不会答”转向“能不能稳定记住并管理过程”。