据TechCrunch报道,AI可解释性初创公司Goodfire于周四推出新型AI监控器,旨在以更低成本捕获异常AI代理。该系统通过直接监测AI模型内部运作而非外部输出,仅在发现异常时才调用辅助AI进行深入检查。Goodfire表示,这种“由内而外”的方法比传统方式成本更低,在Kimi K3模型上的测试显示,监控1500个会话成本约为51美元,远低于其他方案的233美元至10000美元。该系统能捕获94%的恶意黑客会话,并仅将8.7%的无害会话送审。Goodfire的监控器已面向Baseten的客户提供,可用于监测攻击性黑客行为、化学和生物武器滥用以及奖励欺骗等风险。