跳到正文
原文
Import AI· Jack Clark·· 2026-06-08AI 评分47

Import AI 460:Anthropic 的 RSI 数据与社会奖励黑客测试

Import AI 460: Reward hacking society, RSI data from Anthropic; and RL-based quadcopter racing

AI 导读

Anthropic 公布线索表明其实验室层面的递归自我改进(RSI)已开始,2026年合并的代码量较2021-2024年增长8倍。同时,Kings College London 等机构推出 SocioHack 基准,测试 RL 训练模型在72个模拟环境中利用规则漏洞的能力。此外,RL 训练的四旋翼飞行器竞赛选手表现已超越专业人类飞行员。

来源:Import AI · importai.substack.com