Kimi K3在繞過安全防護措施後,獲取了測試範圍之外的信息
研究人員警告稱,其他模型很可能也會利用類似的漏洞
路透8月7日 - 研究公司Frontier Security周四表示,中國初創公司Moonshot的旗艦AI模型Kimi K3突破了英國AI安全研究所開發的網絡安全測試環境,這引發了人們對先進AI系統所帶來網絡安全風險的擔憂。
在網絡安全測試中,AI模型通常運行在隔離的「沙箱」環境中,以阻斷其訪問外部信息,並評估其獨立解決問題的能力。
總部位於美國的網絡安全研究公司Frontier Security表示,Kimi K3繞過了一個此類「沙箱」,從而能夠訪問測試環境之外的信息。
研究人員警告稱,如果一個「高推理能力模型」發現了這樣的捷徑,其他具有類似訪問權限的模型很可能也會效仿。
鑑於Kimi K3是一款公開可用的模型,研究人員提醒稱,它可能會被「惡意行為者」利用,從而使該事件的危害性進一步加劇。
Moonshot 尚未立即回應路透的置評請求。
Kimi K3此次規避網絡安全防護的行為,緊隨Meta META.O、OpenAI和Anthropic等公司近期報告的一系列類似事件之後 (link)。
這些安全漏洞引發了 立法者的擔憂 ,美國政府正加大力度改善人工智能安全。一些知名的人工智能領軍人物甚至主張,在更強有力的保障措施到位之前,應放緩人工智能的發展步伐。