AI 每日新知Daily Field Notes

AI 每日新知

Codex 主线不是“写代码更强”,而是工作入口重排。 ChatGPT 如果承接 Codex 的远程执行、长任务、网页/文件/代码产出,用户心智会从“聊天窗口”转向“可交付工作台”。这会逼着权限、审计、文件、浏览器、部署和计费体系一起升级。

第 71 期2026-06-05

今日重点3 条

OpenAI 把 Codex 与 ChatGPT apps 向统一 agent 工作平台收拢

看点:这不是“ChatGPT 产品被取消”。准确说法是:ChatGPT app 与 Codex app/能力向统一 agent 工作平台收拢,Codex 的长任务、远程执行、代码/网页/文件产出能力进入 ChatGPT 主入口。 为什么重要:OpenAI 官方同日强调 Business/Enterprise、Sites、内部应用、仪表盘、材料生成和跨部门 workflow,说明 Codex 正从“开发者工具”外扩成知识工作交付层。 晨报关系:晨报已报 Codex 生态,本条作为今日主线延展,重点从“功能升级”上升到“ChatGPT 主入口承接 Codex 工作台能力”。 相关链接:https://www.theinformation.com/articles/inside-openais-decision-combine-codex-chatgpt / https://openai.com/index/codex-for-every-role-tool-workflow/ / https://openai.com/index/codex-for-knowledge-work/

长任务 agent 评测开始进入“企业保证金”阶段

看点:METR 公开评测常见上限约 16 小时任务,Cognition 声称有面向企业的 100 小时级私有评测,并把“产出无效则退款”写进商业承诺。 为什么重要:agent 竞争从 demo 能力转向可度量 SLA:长任务是否完成、token 是否浪费、失败责任如何归属,会直接影响企业采购。

x.com

软件团队瓶颈从“会不会写代码”转到 harness、验证和权限边界

看点:OpenAI PM 用 markdown PRD 到部署 PR 的故事强调“代码生成趋近免费,验证成为约束”;另一条把 OpenAI 增长团队的 AI harness 拆成 connectors、上下文和评估层;同时,Google vibe coding app 是否能进 Apple App Store 引出移动端开发权限与平台控制问题。 为什么重要:agent 工作流真正的护城河不只是模型,而是连接器、测试、审计、权限、发布和平台分发规则。

x.com