Goodfire 发布模型内部监控探针,以更低成本捕获失控 AI 智能体
Goodfire says its new ‘inside-out’ monitors catch rogue AI agents at a fraction of the cost
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
Goodfire 推出通过探针读取模型内部信号的安全监控,已在 Baseten 上向客户开放。在 Kimi K3 上测试约 1500 个会话成本约 $51,对比低成本模型逐步检查的 $233 和顶级模型的约 $10,000;探针捕获 94% 的恶意入侵会话,误报复核率 8.7%,四个探针同时运行增加的响应延迟不足 2%。
来源:TechCrunch · AI · techcrunch.com