Anthropic 把“专家上手做项目”推到台前,开始直接争夺科研与工程一线场景
@AnthropicAI 宣布启动 STEM Fellows Program,邀请科学与工程领域专家与其研究团队共做数月项目。翻成中文看,模型公司已经不满足于做通用底座,而是要把顶尖领域知识直接接进训练、评估与产品闭环里。
今天最硬的一条线,是 agent 正从“会写代码”继续伸到“会操作浏览器、文档、桌面和记忆层”,执行边界在明显外扩。
@AnthropicAI 宣布启动 STEM Fellows Program,邀请科学与工程领域专家与其研究团队共做数月项目。翻成中文看,模型公司已经不满足于做通用底座,而是要把顶尖领域知识直接接进训练、评估与产品闭环里。
@theo 引用 Artificial Analysis 的榜单指出,GPT-5.5 medium 已追平当前第一梯队,high / xhigh 明显领先,xhigh 更是首次突破 50 分段。落点很清楚:这轮舆论焦点不再只是功能堆叠,而是 OpenAI 在高端推理位次上重新夺回话语权。
@dotey 的中文拆解很到位:Codex 现已支持 GPT-5.5,并新增浏览器操控、Office/Drive 文档生成、文件预览、Computer Use 等能力。换句话说,编码 agent 已经从 IDE 助手往跨应用执行体演进。