Claude/Fable 正在变成发布前工程审查与修复工具
Simon Willison 说,Claude Fable 在软件发布前的最终 review 中发现并修复了 5 个 release blocker,未补贴成本约 149.25 美元。重点不在“又一个代码助手”,而在 agent 已经能进入发布闸口,承担可计价、可复盘的质量控制环节。
审查能力开始比生成能力更稀缺:今天多条内容都指向同一件事:agent 能写、能改之后,团队最需要重建的是 review、验收、成本核算和失败追踪。
Simon Willison 说,Claude Fable 在软件发布前的最终 review 中发现并修复了 5 个 release blocker,未补贴成本约 149.25 美元。重点不在“又一个代码助手”,而在 agent 已经能进入发布闸口,承担可计价、可复盘的质量控制环节。
Theo 连发多条围绕“AI 写代码后人是否还必须读代码”的讨论,核心问题是工程责任如何迁移:人类不可能完全放弃审查,但审查对象可能从每一行实现,转向边界、测试、架构约束和失败模式。
teortaxesTex 提出一个很适合 agent 的任务:跟踪轰动论文或项目在数年后的实际落地情况,如果没有后续成果就主动提出质疑。这条线把 agent 从“生成内容”推向“持续问责和事实追踪”。