AI 每日新知Daily Field Notes

AI 每日新知

今天可用的增量集中在 Codex 用量治理、Harness 稳定性、生成成本核算和可编辑交付。一手发布不足时,发布有限信号并标注边界,比将几条个人帖拆成十条“新知”更可靠。

第 147 期2026-08-25

今日重点5 条

有限信号补充:ChatGPT Work / Codex 的 Plus 5 小时限额将恢复

证据类型: B|OpenAI 团队成员公开说明,仍待正式产品页复核。 发生了什么: @thsottiaux 表示,ChatGPT Work 与 Codex 的 Plus 用户将恢复 5 小时限额;100/200 美元档不受该变更影响。其理由是平滑算力负载,以保留较宽的周额度。 为什么重要: 这说明订阅层的可用性治理仍会直接影响长时 Agent 工作流,而非只有模型质量决定体验。 实际影响: 将长任务拆为可恢复单元,保留状态、测试结果与人工接管点,避免关键交付卡在单次会话尾部。 边界: 这是团队成员的公开说明,不是完整稳定的产品条款;应以产品内提示与正式帮助页为准。

x.com

Codex 额度消耗异常可能与缓存命中率有关

证据类型: B|OpenAI 团队成员公开说明。 发生了什么: @thsottiaux 称部分用户近期缓存命中率低于此前稳定状态,可能使额度消耗更快,团队正在修复。 为什么重要: 对高频开发工作流,成本和可用性取决于上下文复用、任务切分与缓存行为,不能只按标称模型价格判断。 实际影响: 记录同类任务的额度消耗、上下文长度和会话重启行为;出现异常时优先检查复用与切分,再决定是否换模型或套餐。 边界: 未披露受影响比例、具体命中率与修复 SLA,不能据此推出所有用户成本变化。

x.com

Harness 选型应先看稳定交付与可替换性

证据类型: C|从业者技术选型经验。 发生了什么: @dotey 对比 DeepSeek Harness 与 Pi 后,表示当前更偏向 Pi 的简单与稳定;其理由是测试覆盖足够时,未来替换底层的成本可控。 为什么重要: Agent 框架的迁移成本来自团队学习、可观测性、故障恢复和维护,而不只是功能列表或演示效果。 实际影响: 用一个可回滚的真实任务比较安装、权限、日志、测试、故障恢复和替换接口,并提前设定退出标准。 边界: 没有给出版本、任务规模或基准数据;这是个人经验,不能解释为通用性能排名。

x.com

视频生成的真实成本取决于重抽次数

证据类型: C|个人产品实测/转述。 发生了什么: @AI_Jasonyu 称 Topview 接入 Wan 3.0 后,30 秒视频报价约 1.2 美元,对比 Seedance 2.5 约 3.6 美元;@yanhua1010 提醒实际预算经常被 reroll 放大。 为什么重要: 单次报价无法代表可用成片成本,稳定性和可用率才决定批量生产的预算。 实际影响: 用“单条可用成片成本 = 单次价格 × 平均重抽次数”评估,并先以同提示词、小样本测出可用率。 边界: 价格、套餐与画质均未独立核对官方页面,不能作为采购依据。

x.com

可编辑图形交付宜保留 HTML/React 中间层

证据类型: C|从业者工作流观点。 发生了什么: @dotey 认为现阶段用 HTML 或 React 生成并编辑图形较实用:模型训练覆盖充分,结果可修改,且容易转换为其他格式。 为什么重要: 需要反复改字、改数据和做多尺寸导出的图解,若只交付位图,就失去版本化与可维护性。 实际影响: 保留组件、数据与样式,再导出 PNG/SVG;交付前仍需做响应式、无障碍、真实内容与视觉回归验收。 边界: 这不是对插画、印刷或品牌资产的普适结论,复杂视觉仍应按用途选择专用工具。

x.com