热点事件持续更新
Goodfire 推出模型内部激活监测器监测失控 Agent
1 篇报道1 个报道来源2 小时前更新
先了解这件事
AI 综述
可解释性初创公司 Goodfire 推出了一款针对 AI Agent 的监控器。与外置 AI 读取模型输出不同,该监控器直接在模型内部读取信号,目前已面向 Baseten 客户开放。在针对 Kimi K3 模型的测试中,监控约 1,500 个会话的成本约为 51 美元,明显低于使用廉价 AI 模型逐步检查的 233 美元,更远低于顶级模型约 10,000 美元的成本。性能方面,监控探针捕获了 94% 的恶意入侵会话,对无害会话的误报率为 8.7%,且四个探针并行运行仅增加不到 2% 的响应延迟。
AI 根据报道生成 · 1 小时前更新
最新进展10月9日 00:00
Goodfire 内部激活监控器已向 Baseten 客户开放,测试显示低成本高捕获率。报道时间线
沿着报道,了解事件的不同侧面。
10月9日
- TechCrunch · AIGoodfire 推出内部激活监控器,低成本捕捉失控 AI Agent
可解释性初创公司 Goodfire 推出在模型内部读取信号、而非外置 AI 复读输出的监控器,已面向 Baseten 客户开放。在 Kimi K3 的测试中,监控约 1,500 个会话成本约 $51,远低于廉价 AI 模型逐步检查的 $233 和顶级模型的约 $10,000;探针捕获 94% 恶意入侵会话,对无害会话误报率为 8.7%,四个探针并行仅增加不到 2% 的响应延迟。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。