热点事件持续更新
Goodfire发布模型内部激活监控器,成本远低于外部AI监控
1 篇报道1 个报道来源3 小时前更新
先了解这件事
AI 综述
2026年10月9日,TechCrunch报道Goodfire推出新一代模型内部监控方案。该工具通过读取推理过程中的中间激活信号来检测恶意行为,旨在实现“由内而外”的安全监控。在Kimi K3测试中,该方案捕获了94%的恶意黑客会话,平均每个会话成本约为0.034美元,仅为传统外部监控方案的1/5。该方案作为Baseten Base Labs、Goodfire和Hugging Face三方安全合作的一部分正式上线。
AI 根据报道生成 · 2 小时前更新
报道时间线
沿着报道,了解事件的不同侧面。
10月9日
- TechCrunch · AIGoodfire 推出「由内而外」的 AI 监控工具,捕获失控 Agent 成本仅为传统方案的 1/5
Goodfire 推出新一代模型内部监控方案,通过读取推理过程中的中间激活信号检测恶意行为,在 Kimi K3 测试中捕获了 94% 的恶意黑客会话,平均每个 session 约 0.034 美元。该方案作为 Baseten Base Labs、Goodfire 和 Hugging Face 三方安全合作的一部分上线。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。