TechCrunch · AI· Aditya Mehta·· 4 小时前AI 评分60
Goodfire 推出内部激活监控器,拦截失控 AI 智能体
Goodfire says its new ‘inside-out’ monitors catch rogue AI agents at a fraction of the cost
AI 导读
Goodfire 发布基于模型内部激活的监控器,通过探针读取模型每一步的内部信号,仅在触发时调用另一个 AI 模型复核,已向 Baseten 客户开放。在 Kimi K3 测试中,监控约 1500 个会话成本约 51 美元,而用较便宜的 AI 模型逐步检查需 233 美元、顶级模型约 10000 美元;探针捕获了 94% 的恶意黑客会话,并将 8.7% 的无害会话送交复核。
来源:TechCrunch · AI · techcrunch.com