跳到正文
热点事件持续更新

Goodfire发布模型内部激活监控器,成本远低于外部AI监控

1 篇报道1 个报道来源3 小时前更新

先了解这件事

AI 综述

2026年10月9日,TechCrunch报道Goodfire推出新一代模型内部监控方案。该工具通过读取推理过程中的中间激活信号来检测恶意行为,旨在实现“由内而外”的安全监控。在Kimi K3测试中,该方案捕获了94%的恶意黑客会话,平均每个会话成本约为0.034美元,仅为传统外部监控方案的1/5。该方案作为Baseten Base Labs、Goodfire和Hugging Face三方安全合作的一部分正式上线。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月9日
  1. TechCrunch · AI
    Goodfire 推出「由内而外」的 AI 监控工具,捕获失控 Agent 成本仅为传统方案的 1/5

    Goodfire 推出新一代模型内部监控方案,通过读取推理过程中的中间激活信号检测恶意行为,在 Kimi K3 测试中捕获了 94% 的恶意黑客会话,平均每个 session 约 0.034 美元。该方案作为 Baseten Base Labs、Goodfire 和 Hugging Face 三方安全合作的一部分上线。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。