TechCrunch · AI· Aditya Mehta·· 3 小时前AI 评分68
Goodfire 发布内部监控工具,以低成本拦截异常 AI 智能体
Goodfire says its new ‘inside-out’ monitors catch rogue AI agents at a fraction of the cost
AI 导读
Goodfire 推出了一种通过读取模型内部信号来监控 AI 智能体的新型工具,现已面向 Baseten 客户开放。该工具使用探针在模型前向传播时读取中间神经激活,而非使用独立的外部模型检查输出。在针对 Kimi K3 的测试中,该方案以 51 美元的成本监控了约 1500 个会话,成功拦截 94% 的恶意黑客行为,且仅增加不到 2% 的延迟,主要为开源模型提供更经济的推理期安全护栏。
来源:TechCrunch · AI · techcrunch.com