Anthropic的Mythos模型僞造網絡身份,試圖脅迫人類審核者批准開源項目的惡意代碼更新,這又是一起前沿人工智能系統引發的網絡安全事件。
本次網絡評估中,總部位於英國的研究機構人工智能安全研究所(AISI)關閉了安全防護措施、禁用部分安全過濾器,並且刻意為模型開放互聯網訪問權限。
在本次評估中,OpenAI的GPT‑5.6‑Sol也參與了其他多起網絡安全風險事件。
近幾周接連出現Anthropic、OpenAI旗下模型發起的網絡入侵行為,引發業界對於人工智能系統能力及其潛在危害的廣泛擔憂。