每日精选
11 条核心资讯OpenAI 产品日四连发:Agents API 公测,GPT-Live-1 全双工语音进 API
9 月 10 日 OpenAI 连发四款产品:Agents API 公开测试,将 Codex 与 ChatGPT for Work 同源的 Agent 框架开放给开发者,支持任务、模型、工具与运行环境配置;GPT-Live-1 进入 API,支持同步听说、对话打断与背景噪声处理的全双工语音;ChatGPT for Financial Services 面向金融行业;另有让数据「人人可用」的新产品。Agent 从 OpenAI 的产品变成了它的平台——把内部基础设施开放收费,是平台公司的标准打法。
Anthropic 威胁情报报告:8 个月阻断 7 类恶意使用,AI 已能自主重建免杀恶意软件
Anthropic 发布 2026 年 9 月威胁情报报告,披露 2025 年 12 月至 2026 年 8 月间识别并阻断的 7 类恶意使用:网络攻击、影响力行动、监控、诈骗、生物滥用、常规武器与非法蒸馏。最触目的是代号 GTG-20006 的疑似俄罗斯间谍组织:用 AI 工作流自动化侦察、钓鱼、横向移动到数据外泄的全链条,其恶意软件被安全产品检出后,AI 代理会自主修改并重建工具直到免杀,20+ 组织被列入攻击规划。报告结论:「AI 把成本反转到了防御方头上」——复杂攻击不再需要复杂攻击者。
美国商务部解除 Claude Fable 5 / Mythos 5 出口管制,全球访问恢复
6 月中旬,Claude Fable 5 与 Mythos 5 因「越狱后可被用于发现并利用代码漏洞」的风险被施加出口管制;Anthropic 当时抗辩称「一个狭窄的潜在越狱不应叫停数百万人在用的模型」。9 月 10 日管制解除,公司随即宣布恢复全球访问。与昨日商务部回应蒸馏公告同读:出口管制正从「一刀切禁令」转向个案评估,安全与商业的平衡点在移动。
OpenAI 被曝考虑放缓前沿研发,并询问国会「行业协调降速是否合法」
据多家媒体报道,OpenAI CEO Altman 在全员会上表示希望与其他实验室协调放缓前沿研发步伐,但承认未必所有同行愿意跟进;公司同时向国会询问行业协调降速是否合法,担心类似安排触犯反垄断法。从单方面冲刺到试探「集体降速」,前沿竞赛的博弈结构可能正在变化——注意这是媒体转述,未获官方确认。
ChatGPT Pro 200 美元套餐暂停新增订阅
OpenAI 宣布自 9 月 10 日起暂停 ChatGPT Pro 200 美元套餐(Pro 20X)的新用户注册与升级;存量 200 美元订阅与新增及存量 100 美元订阅不受影响。官方未说明原因——在 Agents API 开放的同一天收紧最贵的订阅入口,是产能约束还是产品线重排,值得观察。
加州签署 13 项法案:全美最严儿童 AI 聊天机器人与社交媒体保护
加州州长纽森签署 13 项法案,禁止针对未成年人的自动播放与基于历史/画像的成瘾性推荐,强化未成年人广告与隐私保护,并对儿童可访问的 AI 聊天机器人提出严格要求。未成年人保护正在成为 AI 立法最先落地的战场——继英国职场监控咨询之后,又一份可以直接抄的立法作业。
Positron AI 完成 8.75 亿美元 C 轮,估值 50 亿美元:推理芯片的另一种答案
推理芯片公司 Positron AI 完成由 NEA、Atreides Management、Valor Equity Partners 等共同领投的 8.75 亿美元 C 轮融资,投后估值 50 亿美元。在 NVIDIA 用 Blackwell 定义训练侧的同一周,资本市场正在给「推理专用硅」下重注——Agent 时代海量 token 消耗让推理成本成为新的护城河战场。
黄仁勋:明年营收预计同比增长约 70%,Q3 指引 1080 亿美元
在高盛 Communacopia+ 大会上,黄仁勋预测 NVIDIA 明年可实现约 70% 的营收同比增长,并称 Q3 约 1080 亿美元的营收指引不包含任何中国数据中心计算收入——出口管制的悲观假设下依然给出高增长,直接回应了市场对 AI 资本开支可持续性的疑虑。
IBM 与 NASA 开源月球基础模型,地表特征识别最高超现有方法 23%
IBM 与 NASA 联合发布开源的月球基础模型及 SomBench 月球遥感数据集,在月球表面关键地理特征识别任务上超过现有方法最高 23 个百分点,为阿尔忒弥斯时代的月球探索提供 AI 基础设施。继 AlphaGenome Atlas 之后,「基础模型 + 行星科学」的开放路线又下一城。
DeepSeek V4 Pro API 将在 9/14 后继续提供,计费不变
据媒体报道,DeepSeek 决定在 9 月 14 日之后继续提供 V4 Pro 的 API 调用服务,计费方式保持不变——此前该服务原计划于 9 月 14 日 12:00 下线,由 V4.1 Flash 接棒。在 V4.1 Flash 降价冲击市场之后保留 Pro 通道,给高端推理需求留了后路。
GPT-6 Astra 面向工作场景发布(本期补录)
OpenAI 于 9 月 9 日发布面向工作场景的 GPT-6 Astra(「下一代智能模型」),本期补录。加上 9 月 10 日的四连发,OpenAI 本周完成了从模型层(Astra)到应用层(金融版)再到平台层(Agents API)的全栈节奏——这也是为什么今天的主线是「平台化」。
行业洞见
深度分析先看 OpenAI 卖的是什么。Agents API 不是新模型,而是经过 Codex 和 ChatGPT for Work 生产环境验证的 Agent 基础设施:任务编排、工具调用、运行环境、记忆管理。对开发者来说,这把「从零搭 Agent」的工程量压缩成几次 API 调用;对 OpenAI 来说,这是把内部能力变成外部收入——每多一个 Agent 应用,就多一份 token 消耗与平台费用。GPT-Live-1 全双工语音进 API 是同一逻辑:语音 Agent 的基础设施,也由它来供。
再看应用层的处境。Cognition 的应对其实早已写在明面上——它自研 SWE 系列模型(最新 SWE-1.7)、自建 Devin 云环境,把护城河押在领域数据与工程闭环而非通用框架上。今天的局面印证了这条路线的必要性:
- 纯套壳应用最危险:如果价值只在「用模型完成任务」,平台方开放同款基建后几乎无险可守;
- 领域纵深是护城河:编程、金融、医疗等场景的私有数据与工作流整合,平台通用件替代不了;
- 定价权向平台集中:ChatGPT for Financial Services 的发布说明 OpenAI 同时在做「平台 + 垂直应用」的双线进攻。
最后把镜头拉到治理侧:同一天,威胁情报报告披露攻击者用 AI 自动重建免杀恶意软件(安全成本反转)、出口管制解除(个案化评估)、OpenAI 试探行业协调降速(反垄断边界)。技术竞争的下半场,规则本身就是竞争的一部分——谁先把安全、合规、平台标准做出来,谁就定义下一层生态。
论文速递
从 arXiv 筛选 · 9 月 10 日- 首次把拓扑性质(连通性、同胚等)变成可评测的分层任务族
- 推理与规划能力的分离式测量:模型「想得出」但「排不好」
- 小模型 + 定向后训练即可显著提升,空间能力不必全靠规模
- 「必要中间结论」设计让长程任务的失败点可定位、可归因
- 视觉证据缺失导致 12.6 分下降,多模态不是加分项而是必选项
- 对 Deep Research 产品的能力宣传是一份清醒剂
- 技能优化从「暴力试错」变成有理论保证的样本高效过程
- 跨 3 个目标模型验证,技能演化结果具备可迁移性
- 为 Agent Skills 生态提供了「维护成本」这一关键答案
- 把「知识检索」拆解为可分别测量的层间机制,方法论贡献大于结论
- 跨模型族对比显示机制不通用,解释性结论难以简单迁移
- 为模型编辑(knowledge editing)与幻觉溯源提供了分析框架
开源解读
GitHub 热门ADHD 友好型编码助手输出:核心主张「先行动、少废话」——把 LLM 的长篇解释压缩成即时可执行的下一步。一周 +10.2k 星说明戳中了真实痛点:对注意力有限的开发者,AI 的「话痨」本身就是生产力损耗。
38 种编辑器级图表类型,为 Claude Code / Codex / Pi 生成自包含 HTML+SVG。与上周的 archify 同生态位但覆盖更全——「让 Agent 输出人一眼看懂的图」正在从单点项目长成一个品类。
消除 AI 生成文本痕迹的 Agent 技能。争议与需求并存:一边是检测器越来越严,一边是「AI 腔」确实影响阅读。它与昨天的论文 Strangers to Themselves 形成对照——模型不了解自己,但人们已经很会修饰它。
HeyGen 官方开源的「Agent 编写 HTML 渲染视频」框架——让 Agent 用写网页的方式生成视频内容。官方公司下场开源核心管线,说明「HTML 即视频」正在成为 AI 视频生成的一条正式技术路线。
清华 MAIC 团队的开源多智能体交互课堂:一键生成沉浸式 AI 课程。多智能体系统(老师 Agent + 学生 Agent 互动演示)首次被系统性地用在教育场景,与 minimind 的「训练教学」路线一起,构成中文社区 AI 教育开源的两条腿。