AI 每日新知Daily Field Notes

AI 每日新知

审查能力开始比生成能力更稀缺:今天多条内容都指向同一件事:agent 能写、能改之后,团队最需要重建的是 review、验收、成本核算和失败追踪。

第 99 期2026-07-05

今日重点3 条

Claude/Fable 正在变成发布前工程审查与修复工具

Simon Willison 说,Claude Fable 在软件发布前的最终 review 中发现并修复了 5 个 release blocker,未补贴成本约 149.25 美元。重点不在“又一个代码助手”,而在 agent 已经能进入发布闸口,承担可计价、可复盘的质量控制环节。

x.com

开发者开始重新讨论:模型够强后,还要不要逐行读代码

Theo 连发多条围绕“AI 写代码后人是否还必须读代码”的讨论,核心问题是工程责任如何迁移:人类不可能完全放弃审查,但审查对象可能从每一行实现,转向边界、测试、架构约束和失败模式。

x.com

结果追踪 agent 比单纯摘要更有价值

teortaxesTex 提出一个很适合 agent 的任务:跟踪轰动论文或项目在数年后的实际落地情况,如果没有后续成果就主动提出质疑。这条线把 agent 从“生成内容”推向“持续问责和事实追踪”。

x.com