DeepSeek-V4.1-Flash 以新架构接替旧 Flash:先把它当成一次生产迁移,而不是无感升级
DeepSeek 在 9 月 10 日将 DeepSeek-V4.1-Flash 正式放上 API:它是新架构家族中体量最小的一档,加入原生多模态视觉理解,支持 JSON、工具调用、Responses API 和 Anthropic 兼容接口;调用名改为 deepseek-flash。旧的 deepseek-v4-flash 与 deepseek-v4-flash-vision-exp 暂仍可用,但请求已被路由到新模型并按 Flash 价格计费。这不是一次只在模型卡里发生的升级,而是一次真实的默认路由迁移。 价格也给出了足够明确的迁移动机:Flash 在非高峰期每百万 token 的缓存命中输入、未命中输入、输出分别为 0.003、0.15、0.60 美元;高峰期翻倍。上下文为 1M,最大输出 384K,官方列出并发上限 2,500。对已有工作流而言,真正要复测的是图像输入、长上下文、工具格式和旧别名是否仍得到同样的行为,而不只是把每百万 token 的单价抄进预算表。 这项发布的规范页只有日期、没有精确时刻;为避免因为时间粒度漏报,本期按 P0 规则保守地置于首条。官方基准是厂商自测,且旧别名的兼容路由是“暂时”安排;把它推进默认生产前,应固定一套包含视觉、工具、多轮上下文和失败重试的回归集,同时把模型名和结果版本写进日志。
OpenAI 把 Agent harness 和企业数据入口并排产品化:能力不再只由模型决定,而由环境和语义层共同决定
OpenAI 在同一天发布了公测的 Agents API 和 ChatGPT Work 的 Data agent。前者把 Codex 的编排层、长会话、工具调用与托管或自选沙箱交给开发者,连子代理并发也成为一项 API 配置;后者让工作区用户把自然语言问题接到 Redshift、BigQuery、Databricks、Snowflake、Drive、SharePoint 等已批准的数据和文档上,再生成或刷新交互式仪表盘。它们共同把“能回答”推向“能在指定环境里持续工作”。 关键差别不在界面,而在谁定义了事实和边界。Data agent 声称会继承连接账户的表、行、列级权限,并利用 dbt、语义层和 BI 仪表盘中的定义;管理员仍要逐项决定哪些连接、哪些角色可用。Agents API 则允许开发者选择 OpenAI 托管沙箱、自有基础设施或第三方沙箱,意味着文件、密钥、网络出口和保存中间产物的责任没有消失,只是被拆给了不同部署选项。 这两项公告都在 9 月 10 日发布,已超出本次严格 P0 窗口,但不该因晨报提过就跳过。团队现在最值得做的试点不是让它直接替代分析师或运维,而是选一个只读、可回放的问题:把同一指标问题交给语义层、人工 SQL 和 agent,比较口径、引用、权限拒绝、成本和纠错时间;再把“创建仪表盘”“发 Slack”“执行已批准动作”分成不同权限。厂商客户案例能说明路径可用,不能替代本组织的数据定义和安全验收。
Anthropic 的威胁报告把“Agent 会执行”从演示变成防御输入:密钥、检测和回滚要按攻击闭环来设计
Anthropic 最新威胁情报报告披露,其团队在 2025 年 12 月至 2026 年 8 月间发现并中断了七类滥用活动,涉及网络攻击、影响行动、监控、诈骗、生物与常规武器、蒸馏。报告说,多数案例已不只是聊天式辅助,而是多 Agent 工作流参与侦察、利用和数据外传;人仍决定目标并审看外传结果。值得注意的是,报告称所述案例主要涉及 Haiku、Sonnet 和 Opus,并无 Fable 或 Mythos 级模型的恶意使用,只有一宗蒸馏例外——因此它不能被简化成“所有最新模型已被滥用”的结论。 对安全团队最实用的新信息是攻击者也在把自动化接到自己的闭环上:报告描述了会在恶意组件被安全产品标记后,自动修改、重建并重新部署的流程;另有案例利用从受害环境窃取的 AI API 密钥继续发动攻击。无论归因与损失数字仍需外部机构逐项交叉验证,这已经足够改变防守优先级:静态检测规则只是一次减速,不是终点。 接下来应把 agent 当成一条可被滥用的执行链来守,而不是只做提示词过滤。最低限度包括短寿命密钥与分段权限、把异常工具调用和大批量外传接进告警、为高风险动作保留人工批准和可撤销点,并把厂商附带的 IOC 接入既有检测后再核实命中。报告提供的是厂商观察样本和可操作指标,不是全行业发生率;但它明确说明了为什么“发现后重跑”的速度会成为新的防御指标。