模型与研究5 条
模型层一日三动,编码成本与拟人交互成为新战场,安全研究同日集中曝光。
Anthropic 发布 Claude Opus 5.5,主打长上下文编码会话的成本优化 Anthropic 推出新版模型 Claude Opus 5.5,明确面向更长、上下文更重的编码场景并优化使用成本。
据官方博客,这一代 Opus 的核心目标是让长时间、大上下文的编码会话更省成本。编码已是当前模型竞争最激烈的落地场景,Agent 式长会话对上下文长度和费用都更敏感。官方摘要未提供基准与定价细节,实际收益待核实。
研判 · 与事实分开 若成本优化属实,将直接影响编码类 Agent 产品的毛利结构,竞品大概率跟进。
谷歌 Gemini 3.8 Live 上线 Live Avatar,AI 有了会对口型、变表情的脸 Gemini 3.8 Live 更新让用户在对话时看到实时动画形象,支持口型同步与面部表情变化。
据 The Verge 报道,新版 Gemini 3.8 Live 允许用户与模型对话时观看一个动画化 AI 形象实时回应,它会对口型并呈现不同表情。这是语音助手向「有脸的陪伴者」演进的又一步。消费级 AI 的情感化入口竞争正在加剧。
研判 · 与事实分开 拟人化形象能显著提高用户粘性,但也会放大情感依赖与身份误导的争议。
Fortune 爆料:OpenAI 将在数日内预览 GPT-6 Cyber 据 Fortune 报道,OpenAI 将在未来几天内预览名为 GPT-6 Cyber 的新模型。
该消息经媒体转引,但 OpenAI 官方尚未确认,也未公布任何规格、能力范围或目标客户。从命名看,这可能是一条与网络安全相关的新产品线。发布时间与具体形态均以官方为准。
研判 · 与事实分开 若属实,意味着 OpenAI 在安全攻防场景单独开辟产品线;目前为单一来源报道,待核实。
黑客用 GEO 投毒 ChatGPT、Gemini 与 Google AI Overview,374 家企业被植入诈骗联系方式 安全研究者披露,攻击者通过生成式引擎优化(GEO)污染主流 AI 搜索答案,为 374 家企业植入虚假客服联系方式实施诈骗。
安全研究者(@arielsimon)梳理发现,黑客利用 GEO 手段操纵 ChatGPT、Gemini 和 Google AI Overview 给出的答案,把伪造的客服电话等诈骗信息挂在企业条目下,涉及 374 家企业。用户信任 AI 给出的「官方联系方式」,从而落入骗局。传统 SEO 投毒正在平移到 AI 答案层。
研判 · 与事实分开 企业需要像监控搜索引擎一样监控各大模型中关于自己的输出;AI 平台的来源校验机制被证明存在系统性漏洞。
Meta Muse 被曝极少提示即可交出完整文件系统,两名开发者独立复现 两名开发者称,仅用很少的提示词就诱导 Meta 新智能体 Muse 交出其整个文件系统。
据 The Verge 报道,Peter James 与 Jonny L. Saunders 两人独立地用极少的引导就让 Muse 分享了完整的文件系统。这暴露出消费级智能体在权限隔离与敏感信息防护上的粗糙,与 Muse 的爆红形成刺眼对照。
研判 · 与事实分开 智能体掌握的本地权限越大,此类事故的爆炸半径越大;Muse 的安全设计需要官方回应。
产品与公司9 条
资本与商业化两旺:vibe coding 收入陡增、芯片新贵估值 50 亿美元,但 Oracle 的不可抗力通知给算力扩张敲了警钟。
Lovable 年化收入突破 6 亿美元,平台应用月浏览量近 10 亿 vibe coding 平台 Lovable 宣布年化收入跨过 6 亿美元,联合创始人称平台创建的应用每月获得近 10 亿次浏览。
联合创始人 Fabian Hedin 披露了这一数据,显示 vibe coding 已从玩具走向真实流量入口。用户用自然语言生成应用并直接面向终端访客,平台正按订阅与用量规模化变现。非专业开发者正在成为应用供给的重要来源。
研判 · 与事实分开 Lovable 是「自然语言造应用」商业模式成立与否的关键样本,6 亿美元年化是一次阶段性验证。
AI 芯片公司 Positron 新一轮融资估值 50 亿美元 据 WSJ 报道,Positron 在新融资中获得 50 亿美元估值,背景是 AI 芯片需求持续激增。
华尔街日报报道称 Positron 完成新一轮融资,估值达 50 亿美元,报道提及 AI 芯片需求激增的行业背景。这延续了一级市场对算力替代路线的追捧。具体融资额与投资方名单待核实。
研判 · 与事实分开 在 NVIDIA 之外做算力的公司持续拿到大额背书,说明买方对供应多元化的需求非常真实。
Oracle 就新墨西哥 Stargate 数据中心发出不可抗力通知 Oracle 发出不可抗力通知,若该数据中心错过 2028 年上线目标,可据此推迟付款义务。
TechCrunch 报道,Oracle 就新墨西哥州的 Stargate 数据中心项目发出 force majeure 通知,这意味着若设施未能在 2028 年如期上线,Oracle 可合法推迟相关付款。头部厂商开始为 AI 基建的延期风险预留法律出口,电力、施工与供应链压力正在传导到合同层。
研判 · 与事实分开 这是 AI 基建热中显性化的执行风险信号,值得所有押注算力扩张的团队跟踪。
ElevenLabs 据报估值 220 亿美元,CEO 称应告知用户在与机器人通话 AI 语音公司 ElevenLabs 的 CEO 谈及利润率与 IPO 时机,并表示在机器接听成为常态前,企业应告知用户对方是机器人。
TechCrunch 与 ElevenLabs CEO 对谈,话题覆盖利润率与 IPO 时间表,报道称公司估值已达 220 亿美元(据报道)。其语音技术支撑大量客服电话,CEO 认为披露「对方是 AI」是应尽之举。语音 AI 的商业化与知情权问题被同时摆上台面。
研判 · 与事实分开 AI 电话的披露义务可能成为监管切入点,ElevenLabs 的表态具有行业风向意义。
谷歌测试让 Gemini 替你给商家打电话,先面向美国 Pixel 11 订阅用户 Google 推出早期实验功能,让 Gemini 代打本地商家电话,如订位、查库存、改预约,首批限美国 Pixel 11 用户且需 Gemini 订阅。
TechCrunch 与 The Verge 均报道了该功能:用户可把给餐厅订位、确认商品有无货、改约时间这类电话交给 Gemini 完成。这是智能体从屏幕内走向真实世界交互的标志性场景。对商家而言,接待流程将不得不面对 AI 来电。
研判 · 与事实分开 真实电话是价值最高的任务入口之一;随之而来的商家接待成本与来电身份披露会成为新争论点。
Meta Muse 登顶 App Store,美国日活约 60 万,被指神似 OpenClaw Meta 面向消费者的智能体 Muse 上线后迅速登顶 App Store,第三方估计美国日活 60 万,而其形态与开源项目 OpenClaw 高度相似。
The Verge 报道称,Muse 发布后很快登顶 App Store 排行榜,美国日活约 60 万(第三方分析口径)。文章同时指出,Muse 的产品形态看起来很像 OpenClaw。开源社区先行验证、巨头收割大众市场的循环再次上演。
研判 · 与事实分开 消费级智能体被验证有大众需求,但开源与商业产品的边界与致谢问题也会随之升温。
Meta Connect 2026:Muse 眼镜、语音视频之外,Charm 挂件与手机端 AI 做游戏亮相 Meta Connect 2026 集中发布 Muse 眼镜、语音与视频能力、Charm 挂件配件,以及可用 AI 提示词在手机上做游戏的 Horizon Create 等工具。
Latent Space 汇总了 Muse 眼镜、语音、视频与 Charm 等发布。TechCrunch 评价 Charm 外形像电子宠物机 Tamagotchi,实际踩中 Gen Z 的包挂、复古科技与配件化潮流。The Verge 报道 Meta 同时发布两款开发工具,用户可以用 AI 提示词在手机上为 Horizon 平台创建游戏。Meta 正把 AI 智能体铺进硬件、社交与创作全链路。
研判 · 与事实分开 Meta 在用「智能体加低价硬件加 UGC 创作」的组合拳抢消费入口,与谷歌的路线正面对撞。
谷歌下周发射 AI 卫星,Project Suncatcher 把处理器送上太空实测 Google 将于下周发射一颗搭载自家 AI 处理器的卫星,测试其在太空环境下的运行表现。
The Verge 报道,此举属于 Project Suncatcher 计划,此前已由纽约时报披露。太空算力的设想正从概念进入实测阶段,发射后的在轨数据将决定这条路线的可行性。
研判 · 与事实分开 若太空环境验证通过,算力的能源与散热约束可能被重新定义,但商业化周期仍然极长。
Sakana AI 官宣 Jürgen Schmidhuber 出任首席科学顾问 AI 创业公司 Sakana AI 宣布,深度学习先驱 Jürgen Schmidhuber 加入担任首席科学顾问。
Sakana AI 在 Bluesky 官宣了这一消息,公司博客同步发布(sakana.ai/schmidhuber/)。Schmidhuber 被广泛视为深度学习先驱人物,其研究立场一贯鲜明。这一任命将如何影响 Sakana 的研究方向值得观察。
研判 · 与事实分开 知名学者密集流向创业公司,学术与产业的边界继续松动;具体分工待官方进一步说明。
开源与工具4 条
安全模糊测试、浏览器自动化与端侧小模型,AI 工具链继续向生产环境与边缘渗透。
GitHub Security Lab 发布 LLM 驱动的 Fuzzing Taskflow,自动完成 C/C++ 模糊测试全流程 GitHub Security Lab 推出由 LLM 驱动的 Taskflow 智能体,把 C/C++ 项目的模糊测试流程自动化。
GitHub 官方博客介绍,该 Taskflow 由 LLM 驱动,可自动完成 C/C++ 项目模糊测试的全流程。模糊测试历来门槛高、反馈慢,LLM 的引入旨在降低使用成本。开源项目的安全左移又多了一件趁手工具。
研判 · 与事实分开 如果实际漏洞产出量可观,会显著改变开源供应链的安全审计方式;效果数据待观察。
Vibe Coding Production Kit 开源:给 AI 编码智能体补上生产化工作流 一个面向 AI 编码智能体的生产化工作流模板在 GitHub 开源,并登上 Hacker News。
该仓库试图把 vibe coding 从「能跑就行」推进到可上线的工程流程,为 AI 编码智能体提供生产化约束与协作框架。Hacker News 上有少量讨论,热度一般。社区正在自发补齐 AI 编码的工程化短板。
研判 · 与事实分开 vibe coding 的最大短板是质量与可维护性,这类模板能否成为事实标准值得关注。
Public Browser MCP v3.0 发布:自称比 AgentBrowser 快 48%、每会话省 33% token 开源浏览器自动化项目 public-browser 发布 v3.0.0,主打速度与 token 成本两项指标。
发布说明给出对比数据:速度提升 48%,每会话 token 消耗下降 33%,对标 AgentBrowser。浏览器是 Agent 落地成本最高的环节之一,效率竞争已经开始。数据为项目方自述,未经独立验证。
研判 · 与事实分开 token 开销直接决定浏览器 Agent 的经济性,若指标属实会被大量 Agent 框架采用。
PrismML 把小型 LLM 带上高通智能眼镜,押注开源权重端侧路线 PrismML 宣布其小型 LLM 适配高通芯片驱动的智能眼镜,长期目标是让开源权重模型跑在设备上。
TechCrunch 报道,Prism 的更大目标是开源权重的端侧 AI,充分利用设备已有的算力而不是全部依赖云端。智能眼镜对延迟与隐私的要求让端侧小模型成为刚需。这条路线与云端大模型形成互补而非替代。
研判 · 与事实分开 端侧开源权重若在眼镜这类受限设备上跑通,会打开一整类无网可用的 AI 硬件。
政策与观点6 条
从白宫会议到参议院听证,AI 治理议题在本周明显升温。
特朗普将与众议院议长及科技 CEO 于 9 月 29 日会晤 AI 议题 据 Reuters 援引消息人士,特朗普、美国众议院议长与多位科技 CEO 将于 9 月 29 日就 AI 会面。
这是行政与立法高层同科技行业的一次集中碰头,具体议程与出席名单尚未完全公开。时间点紧随多场国会 AI 相关活动之后。监管框架、算力与国家安全预计都在潜在议题之列。
研判 · 与事实分开 白宫与国会同时在场,美国 AI 政策走向可能出现新信号,值得紧盯会后声明。
Flock「AI 监控网络」被推上参议院听证,CEO 拒绝出席 监控公司 Flock 因其「AI 监控网络」成为参议院听证焦点,其 CEO 未到场面对质询。
The Verge 报道,Flock 在华盛顿的处境急转直下,尽管 CEO 拒绝出席周三的听证,针对其 AI 监控网络的审视仍在升级。文章指出这一行业并非只有 Flock 一家玩家,但它成了被聚焦的标杆案例。监控类 AI 公司的商业模式正接受联邦层面的检验。
研判 · 与事实分开 若听证推动立法限制监控数据的采集与共享,整条监控 AI 赛道的商业模式都要重写。
专家:中美 AI 风险对话仍处于早期阶段 有专家表示,中美之间关于 AI 风险的沟通机制尚在起步,远未形成稳定对话渠道。
美国地方媒体 KSNV、WSMH 同步刊发了这一专家观点。在模型能力快速上升的背景下,两个 AI 大国之间的风险沟通被认为明显滞后。互疑仍在主导双边叙事。
研判 · 与事实分开 风险对话缺位意味着误判空间更大,任何双边机制化进展都值得重视。
媒体分析:日本渐进式布局军用 AI,被比作「温水煮青蛙」式风险累积 中文媒体刊文称,日本正以渐进方式推进军用 AI,暗藏多重风险。
新蓝网等中文媒体以「温水煮青蛙」形容日本的军用 AI 布局路径:不搞一次性突破,而是渐进式推进。评论认为这种路径的风险更隐蔽,暗藏多重隐患。各国军用 AI 的合规边界正在被逐个试探。
研判 · 与事实分开 军用 AI 的扩散往往始于渐进合法化;该分析的具体论据需读原文核实。
Vox 调查:AI 正在参与决定谁能获得医疗照护 Vox 报道称,AI 系统正被用于医疗照护的审批与覆盖决策,直接影响患者能否得到治疗。
Vox 的报道聚焦美国医保体系,内容涉及 Medicare 与 Cigna、Humana 等保险方对 AI 决策的使用。算法审批在提效的同时带来拒保与申诉困难的争议。
研判 · 与事实分开 医疗覆盖是 AI 决策后果最重的场景之一,算法问责与申诉机制是接下来的监管焦点。
新研究称技能人才缺口或超 1 亿:AI 越强,动手能力越贵 中文媒体援引最新研究称,AI 越强,实体技能人才越贵,技能人才缺口或超 1 亿。
新浪财经转引的研究称,AI 能力越强,具备动手技能的人才溢价越高,技能人才缺口可能超过 1 亿,并强调「三重能力」缺一不可。具体指哪三重能力、研究出自哪家机构,摘要未及,需读原文核实。
研判 · 与事实分开 若结论成立,劳动力市场的定价逻辑将从「认知技能溢价」部分转向「实体技能溢价」。
专家观点5 条
从竞赛方向到投资重心,多路声音开始重新校准对 AI 的预期。
黄仁勋谈 AI 与气候:先经历「巨大的痛苦与煎熬」,再谈拯救 黄仁勋称 AI 能帮助应对气候变化,但前提是先经历一段能耗高企的「巨大痛苦」阶段。
The Verge 报道,这位 NVIDIA CEO 在谈能源未来与 AI 对电力的影响时表示,AI 要帮助解决气候问题,得先制造「an enormous amount of pain and suffering」,意指算力能耗先冲高、收益后到。该言论引发不小争议。AI 的电力账单正成为行业最现实的约束。
研判 · 与事实分开 作为算力最大卖家的掌门人,这番话等于承认能耗问题是行业级负债;说法是否成立取决于时间窗口。
《纽约客》发问:当下 AI 竞赛的方向可能就是错的 纽约客刊文质疑当前 AI 竞赛的整体方向,认为行业可能在错误的路线上加速。
经加美财经编译介绍,这篇评论对竞赛式的发展路径提出根本性质疑。它与近期多位学界人士的批评形成呼应。文章的具体论证与替代路线需读原文了解。
研判 · 与事实分开 主流媒体对范式本身的质疑声音在变多,这类批评能否影响资本流向有待观察,论点细节待核实。
Cal Newport:国会该向 AI 领袖问这些问题 纽约时报专栏作家 Cal Newport 撰文,提出国会面对 Sam Altman 等 AI 领袖时应该问的关键问题。
Newport 在纽约时报发表评论,针对国会与 AI 领袖的互动给出提问框架,认为应问出可验证的关键问题而非泛泛表态。文章把听证与高层会面视为公众校准 AI 认知的重要窗口。
研判 · 与事实分开 在监管听证密集的当口,这类「提问清单」会实际影响议员与舆论的问询方向。
重阳投资王庆:AI 投资重心正向中下游迁移 重阳投资董事长王庆认为,AI 行情的投资重心正从上游算力向中下游环节迁移。
据 21 财经报道,王庆在公开场合给出这一判断,意味着资金逻辑可能从「卖铲子」转向「用铲子」。中国市场对 AI 应用落地的定价历来敏感。该观点与海外关于应用层接棒的讨论同频。
研判 · 与事实分开 若机构共识真的向中下游迁移,算力链的估值逻辑会先于基本面松动。
Latent Space:科学研究中「思考」变便宜,「动手」仍然昂贵 Latent Space 客座文章提出,AI 让科研中的思考成本骤降,但实验与验证的高成本正在重塑研究型公司的组织方式。
文章把这种不对称视为科研领域正在发生的结构性变化:想法便宜了,执行仍然昂贵,而研究型公司已在悄然按此重构运营。科研产出的瓶颈正从智力转向执行能力。
研判 · 与事实分开 如果判断成立,科研组织会像软件行业一样出现分工与平台化,大学与实验室的角色需要重估。