【OpenAI稱Astra模型具備先進網絡安全能力,已啓動強化防控措施】OpenAI當地時間8月7日發布安全公告稱,內部評估顯示,其下一代模型「Astra」在智能編程和網絡安全能力方面取得顯著進展,公司目前無法排除該模型達到「關鍵級」網絡安全能力水平的可能性。OpenAI稱,相關評估結果已觸發其《準備框架》中的安全響應措施。根據OpenAI定義,模型達到「關鍵級」網絡安全能力,意味着其能夠在無需人工干預的情況下,針對多個經過強化防護的真實關鍵系統發現並開發各類有效零日漏洞,或僅根據高層攻擊目標制定並執行鍼對高防護目標的新型端到端網絡攻擊策略。OpenAI表示,Astra尚未用於此前涉及Hugging Face的安全事件。針對該模型,公司已加強安全措施,包括採用隔離測試環境、限制網絡和工具訪問、強化模型權重保護與加密、增加監控檢測能力等。