以太坊联合创始人Vitalik Buterin在推文中表示,对抗性治理机制设计理论可能成为解决AI安全问题的“杀手级应用”。他指出,这两种环境之间存在深刻的二元性,都涉及一个复杂程度较低的“委托人”试图从一组更复杂的“代理人”那里获得理想结果。在第一种情况下,委托人是静态算法,代理人是人类;在第二种情况下,委托人是人类加上较弱的大语言模型,代理人是更强的大语言模型。Buterin强调,一项关键发现是,如果能限制代理人串通的程度,就能取得更好的结果,这一论点应自然地适用于AI安全的新情境。