跳到正文
热点事件持续更新

Goodfire 推出模型内部激活监测器监测失控 Agent

1 篇报道1 个报道来源2 小时前更新

先了解这件事

AI 综述

可解释性初创公司 Goodfire 推出了一款针对 AI Agent 的监控器。与外置 AI 读取模型输出不同,该监控器直接在模型内部读取信号,目前已面向 Baseten 客户开放。在针对 Kimi K3 模型的测试中,监控约 1,500 个会话的成本约为 51 美元,明显低于使用廉价 AI 模型逐步检查的 233 美元,更远低于顶级模型约 10,000 美元的成本。性能方面,监控探针捕获了 94% 的恶意入侵会话,对无害会话的误报率为 8.7%,且四个探针并行运行仅增加不到 2% 的响应延迟。

AI 根据报道生成 · 1 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月9日
  1. TechCrunch · AI
    Goodfire 推出内部激活监控器,低成本捕捉失控 AI Agent

    可解释性初创公司 Goodfire 推出在模型内部读取信号、而非外置 AI 复读输出的监控器,已面向 Baseten 客户开放。在 Kimi K3 的测试中,监控约 1,500 个会话成本约 $51,远低于廉价 AI 模型逐步检查的 $233 和顶级模型的约 $10,000;探针捕获 94% 恶意入侵会话,对无害会话误报率为 8.7%,四个探针并行仅增加不到 2% 的响应延迟。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。