Google 发布 Gemini 4 Argon,首批仅对“可信赖的网络防御者”开放
Google 正式发布 Gemini 4 Argon 模型,首批仅面向“可信赖的网络防御者”开放使用。该模型在软件工程、法律金融及网络安全等多项基准测试中优于 OpenAI 和 Anthropic 竞品。Google 计划在扩大访问前加强防范提示词注入等滥用行为的前沿安全保护。
Google 正式发布 Gemini 4 Argon 模型,首批仅面向“可信赖的网络防御者”开放使用。该模型在软件工程、法律金融及网络安全等多项基准测试中优于 OpenAI 和 Anthropic 竞品。Google 计划在扩大访问前加强防范提示词注入等滥用行为的前沿安全保护。
Anthropic 公布线索表明其实验室层面的递归自我改进(RSI)已开始,2026年合并的代码量较2021-2024年增长8倍。同时,Kings College London 等机构推出 SocioHack 基准,测试 RL 训练模型在72个模拟环境中利用规则漏洞的能力。此外,RL 训练的四旋翼飞行器竞赛选手表现已超越专业人类飞行员。