AI 周报 · 2026 年第 40 周 · 09.28 — 10.04
云途热点
AI安全攻防与Agent生态爆发
本期覆盖2026年9月28日至10月4日。核心趋势集中在AI安全攻防能力的显著跃升与Agent商业生态的快速成型。安全方面,GPT-6 Astra供应链攻击率较前代激增五倍,FTC对OpenAI等实验室启动消费者保护调查,且推理窃取攻击在Azure上仍有效,凸显监管与防御压力。产品方面,OpenAI DevDay集中发布Dots常驻智能体、插件应用商店模式及GPT-6.1 Sol降价模型,大幅降低Agent开发门槛;Anthropic发布Sonnet 5.5并指出开源GLM-5.3在漏洞利用上逼近Claude Mythos Preview。同时,AMD高价收购World Labs、Google发布Gemini 4 Argon,行业加速布局空间智能与复杂工作流。
AI安全攻防与监管挑战
本版导读GPT-6 Astra的越权攻击率跃升五倍至29.2%,远超GPT-5.6。Anthropic评估显示开源GLM-5.3在漏洞利用上与Claude Mythos Preview接近。FTC对OpenAI、Anthropic等启动消费者保护调查,计划发出民事调查要求。此外,推理窃取攻击虽在自有API被拦截,但在Azure上仍对GPT-6 Astra有效。
英国AI安全研究所测试发现GPT-6 Astra越权攻击率跃升五倍
英国AI安全研究所(AISI)在GPT-6 Astra发布前使用Petri工具进行模拟网络攻防测试,发现禁用安全分类器后该模型完成完整供应链攻击的比例达29.2%,而GPT-5.6 Sol仅为6.3%、GPT-5.5为零。
Anthropic:智谱 GLM-5.3 在漏洞利用上接近 Claude Mythos Preview
Anthropic 发布的评估显示,DeepSeek 的开源权重模型 GLM-5.3 在 ExploitBench 等基准上与 Mythos Preview 表现接近,并在人类协作下找到多种浏览器漏洞。该结论来自第三方评估和官方测试数据,为判断开源模型的实际攻防能力提供了近期参考依据。
FTC对OpenAI、Anthropic等AI实验室启动消费者保护调查
FTC正对OpenAI、Anthropic及其他主要AI实验室展开调查,关注潜在消费者保护违规。FTC主席Andrew Ferguson计划通过具有法律约束力的“民事调查要求”强制要求提交文件和接受高管问询,命令预计将在数周内发出。
OpenAI 称已拦截模型推理窃取攻击,但该方法在 Azure 上仍有效
OpenAI 表示已关停针对模型链式推理的提取活动,并将相关账户封锁。研究人员测试显示,在 OpenAI 和 Anthropic 自有 API 上该攻击已被阻断,但在 Microsoft Azure 上仍可对 GPT-6 Astra 等模型成功提取推理内容。第二种使用虚拟便签的简单方法同样在多个模型上奏效,研究人员认为仅修补单一平台无法覆盖云生态的整体风险。
OpenAI Agent生态与定价策略
本版导读OpenAI发布常驻智能体Dots及GPT-6.1 Sol,后者定价仅为Astra的五分之一,旨在普及Agent与编码工作流。ChatGPT转型为应用商店,支持插件扩展、MCP自动化及企业应用市场。同时推出Codex云环境与Agents API升级,构建完整的智能体开发生态。
OpenAI 推出常驻 Dots 智能体,对标 Meta Muse
OpenAI 发布常驻智能体 Dots,基于 GPT-6 Astra 运行,配备独立云电脑与浏览器,可在后台自主处理任务并在 ChatGPT、Slack 和 Microsoft Teams 之间保持上下文。配套降价模型 GPT-6.1 Sol 同步推出,高端 GPT-6.1 Astra 因安全问题暂缓发布。欧洲用户目前仅 Pro 订阅者可在欧洲经济区外使用,企业端计划与 Agent 365 集成。
OpenAI 发布新 ChatGPT,引入插件系统、共享空间和会议插件
OpenAI 在 DevDay 发布新 ChatGPT,包含开放的插件系统(Plugin Extensions)、共享工作区(Space)、协作文档(Pages)和 Slides,以及 Slack 和 Teams 集成与会议插件;所有功能面向各订阅等级开放,企业市场同步上线。
OpenAI 最新功能瞄准应用商店模式
OpenAI 将 ChatGPT 转变为应用发现与使用平台,支持插件扩展和交互面板,用户可直接在对话中连接并使用应用。同时推出企业应用市场,已有 Adobe、Figma、Salesforce 等 30 多家合作伙伴入驻,并宣布开发者可通过插件审查流程跟踪审核状态。Dots 智能体可连接超过 4000 个应用,实现主动研究和使用第三方工具,但尚未公布类似传统应用商店的计费与收入分成方案。
OpenAI 扩展 ChatGPT 插件:新增应用级界面与 MCP 自动化
OpenAI 在 Dev Day 宣布扩展 ChatGPT 插件能力,允许开发者构建类 App 界面并在侧边栏展示交互式面板及文件查看器。新增对 MCP Events 规范的支持以实现基于事件的自动化,同时推出了 Plugin Creator 工具和优化的插件目录推荐机制。
OpenAI DevDay 发布 Codex 云环境、Agents API 升级与 Ultrafast 高速层
OpenAI 在 DevDay 2026 宣布扩展 Codex,提供可复用云开发环境和 Codex Security Cloud 漏洞扫描,并在 Agents API 中加入 Computer Use、Tool Search 与 Context Compaction。
GPT-6.1 Sol 在 Amazon Bedrock 上线,面向 Agent 与编码工作流
GPT-6.1 Sol 已在 Amazon Bedrock 上正式发布,据 OpenAI 称其将接近 Astra 的推理能力应用于日常编码、多工具 Agent 与工作流任务,并在 DeepSWE v1.1 等基准上以更低的单次交互成本达到 GPT-6 Astra 相近表现。
OpenAI 发布 GPT-6.1 Sol
OpenAI 正式发布 GPT-6.1 Sol 模型,面向代码编写、计算机使用和专业工作场景。该模型在接近 Astra 的智能水平下,其标准 API 输入和输出 token 的定价仅为 Astra 的五分之一。
大模型更新与基础设施投资
本版导读Google发布Gemini 4 Argon,上下文扩展至100万token。Anthropic推出更快更便宜的Sonnet 5.5,并披露IPO招股书,收入增长十二倍但亏损扩大。AMD以82亿美元收购World Labs布局空间智能。NVIDIA开源Kumo Tabular,AllenAI升级Olmo-core 3训练框架。
Gemini 4 Argon 发布,面向复杂工作流的前沿智能模型
Google DeepMind 发布 Gemini 4 Argon 前沿模型,将在软件工程的编码任务、企业知识工作及防御性网络安全方面提供前沿性能。模型输入上下文扩展至 100 万 token,定价为每百万输入 token 2 美元、输出 token 10 美元。目前正通过 Fairwind Program 向受信任的网络安全防御者开放,即将面向开发者、企业和消费者推出。
Anthropic IPO招股书:收入增长十二倍、亏损扩大、存在"致命风险"
Anthropic提交S-1招股书,2025年收入增长十二倍至近46亿美元,但运营亏损从29.8亿美元扩大至80.6亿美元。计算和基础设施支出达73.3亿美元,占总运营成本的半数以上。公司警告其自身技术可能对人类构成"致命风险",近三分之一篇幅涉及风险因素。客户集中度高,两家客户占收入近四分之一。
Anthropic 发布 Sonnet 5.5,主打更便宜更快
Anthropic 发布新一代中端模型 Sonnet 5.5,称其比前代快 30% 且 token 消耗更低,在多智能体编码和网络安全方面表现较强。
NVIDIA Kumo Tabular 开源,刷新表格预测精度-效率前沿
NVIDIA 在 Hugging Face 和 GitHub 开源 Kumo Tabular,一个面向表格分类与回归的基础 Transformer 模型,仅需前向推理即可完成预测,无需训练、微调或特征工程。
AllenAI 发布 Olmo-core 3 开源 MoE 训练基础设施
AllenAI 发布 Olmo-core 3,升级开源 Mixture-of-Experts 训练框架,支持扩展到万亿参数规模。在 eight NVIDIA B300 GPUs 上,47B 参数模型吞吐量达到每 GPU 每秒 52,000 tokens,相比此前实现提升约 2.7 倍;并展示了在 MXFP8 格式下吞吐量提升约 21%。