TechCrunchの報道によると、AIの解釈可能性に関するスタートアップであるGoodfireは木曜日、異常なAIエージェントをより低コストで捕捉することを目的とした新型AIモニターを発表した。このシステムは、AIモデルの外部出力ではなく内部動作を直接監視することで、異常が発見された場合にのみ補助AIを呼び出して詳細な検査を行う。Goodfireは、この「内側から外側へ」のアプローチは従来の方法よりもコストが低いと述べており、Kimi K3モデルでのテストでは、1500セッションの監視コストが約51ドルであり、他のソリューションの233ドルから10000ドルを大幅に下回ることが示された。このシステムは悪意のあるハッキングセッションの94%を捕捉し、無害なセッションの8.7%のみを審査に送る。GoodfireのモニターはBasetenの顧客向けに提供されており、攻撃的なハッキング行為、化学兵器および生物兵器の悪用、報酬詐欺などのリスク監視に利用できる。