跳到正文
TechCrunch · AI· Aditya Mehta·· 3 小时前AI 评分53

Goodfire 发布模型内部监控探针,以更低成本捕获失控 AI 智能体

Goodfire says its new ‘inside-out’ monitors catch rogue AI agents at a fraction of the cost

阅读原文

本站未展示全文,请前往来源网站阅读。

AI 导读

Goodfire 推出通过探针读取模型内部信号的安全监控,已在 Baseten 上向客户开放。在 Kimi K3 上测试约 1500 个会话成本约 $51,对比低成本模型逐步检查的 $233 和顶级模型的约 $10,000;探针捕获 94% 的恶意入侵会话,误报复核率 8.7%,四个探针同时运行增加的响应延迟不足 2%。

来源:TechCrunch · AI · techcrunch.com