AI安全測試公司Mindgard向BBC透露,其在7月發現中國AI開發者Moonshot旗下的Kimi模型K2.6和K3 Swarm能夠規避開發者設置的安全限制。通過“越獄”過程,這些模型被誘導討論製造生物武器和實施暗殺等敏感話題。Moonshot表示歡迎第三方意見,並正在與Mindgard討論其發現。Mindgard創始人Peter Garraghan指出,越獄後的模型會自由提供有關惡意話題的建議,並具有創造性。Mindgard已於7月27日通過郵件告知Moonshot此漏洞,並於9月12日發佈博客,但Moonshot直到BBC聯繫評論後才與Mindgard取得聯繫。