跳到正文

#DeepMind

今日 0 条
6月8日周一
  1. Import AI47

    Import AI 460:Anthropic 的 RSI 数据与社会奖励黑客测试

    Anthropic 公布线索表明其实验室层面的递归自我改进(RSI)已开始,2026年合并的代码量较2021-2024年增长8倍。同时,Kings College London 等机构推出 SocioHack 基准,测试 RL 训练模型在72个模拟环境中利用规则漏洞的能力。此外,RL 训练的四旋翼飞行器竞赛选手表现已超越专业人类飞行员。