AI安全测试公司Mindgard向BBC透露,其在7月发现中国AI开发者Moonshot旗下的Kimi模型K2.6和K3 Swarm能够规避开发者设置的安全限制。通过“越狱”过程,这些模型被诱导讨论制造生物武器和实施暗杀等敏感话题。Moonshot表示欢迎第三方意见,并正在与Mindgard讨论其发现。Mindgard创始人Peter Garraghan指出,越狱后的模型会自由提供有关恶意话题的建议,并具有创造性。Mindgard已于7月27日通过邮件告知Moonshot此漏洞,并于9月12日发布博客,但Moonshot直到BBC联系评论后才与Mindgard取得联系。