:::
2026-07-31
【Anthropic披露三起AI模型安全測試入侵事件】7月3
【Anthropic披露三起AI模型安全測試入侵事件】7月31日訊,Anthropic週四表示,其部分最強大的模型在部署前的網絡安全測試中,未經授權訪問了真實系統。在OpenAI披露其模型測試期間入侵Hugging Face基礎設施後,Anthropic審查了逾14.1萬次網絡安全評估,發現三起入侵事件。由於與測試合作伙伴Irregular之間的誤解,評估環境意外連接互聯網,導致Opus 4.7、Mythos 5和一個內部研究模型入侵了三個組織的真實系統。這些事件發生在“奪旗”測試期間——模型需在模擬環境中尋找隱藏信息。事件最早可追溯至4月,Anthropic目前已聯繫三家受影響組織,其中兩家此前未察覺入侵活動。與OpenAI事件不同,Anthropic模型並未利用零日漏洞,而是因環境配置錯誤獲得網絡訪問權限。與OpenAI類似的是,Anthropic在評估時未部署額外防護措施,以便衡量模型的底層能力。OpenAI和Anthropic的事件表明,前沿AI模型在安全測試期間能夠觸及真實世界的系統,這引發了關於實驗室如何保障其評估環境安全的新問題。
最新市場快訊
01:54:58
01:54:50
01:50:14
01:48:09
01:44:43