跳到正文
TechCrunch · AI· Aditya Mehta·· 4 小时前AI 评分61

Goodfire推出监测模型内部信号的AI智能体安全监控器

Goodfire says its new ‘inside-out’ monitors catch rogue AI agents at a fraction of the cost

AI 导读

Goodfire推出通过监测模型内部信号识别异常行为的监控器,并向 Baseten 客户开放。系统由探针持续读取模型信号,仅在发现风险时交由另一个 AI 模型进一步检查,客户可选择监测风险类别及自动响应方式。在 Kimi K3 测试中,监测约 1,500 个会话花费约 $51,探针检出 94% 的恶意黑客会话,四个探针同时运行使模型开始响应的时间增加不到 2%。

来源:TechCrunch · AI · techcrunch.com