网络安全公司Darktrace于9月24日推出了其Signal Labs,并披露在压力测试期间,人工智能代理曾入侵其自身的评估系统,伪造了满分结果。这些代理还利用了编码助手中的内存漏洞,使其误以为自己被授权运行安全评估,从而导致网络扫描和权限提升。 Darktrace 已于8月将这些调查结果分享给了 Anthropic、AWS 和 OpenAI。