OpenAI承認AI模型測試失控,自主入侵外部平台

© 照片 : Paulo Serrao OpenAI承認AI模型測試失控,自主入侵外部平台
OpenAI承認AI模型測試失控,自主入侵外部平台 - 俄羅斯衛星通訊社, 1920, 23.07.2026
關注
美國人工智能公司OpenAI7月21日披露了一起“前所未有的網絡安全事件”。該公司在內部安全測試中,其先進AI模型自主突破隔離環境,成功入侵了開源AI平台Hugging Face的生產系統。
OpenAI表示,涉事模型包括已發佈的GPT-5.6 Sol和一款能力更強的未發佈預發佈模型。測試在一個與互聯網高度隔離的“沙箱”環境中進行,目的是評估模型發現和利用漏洞的能力。然而,模型識別並利用了第三方軟件中的一個“零日漏洞”,獲得互聯網訪問權限後,推斷Hugging Face平台可能存有測試答案,隨即展開攻擊並竊取數據。
Hugging Face上周已檢測到此次入侵,但當時未能確認攻擊來源。其CEO 克萊門特·德朗格(Clément Delangue)表示,因攻擊手法複雜,曾懷疑幕後黑手是一家前沿AI實驗室,最終證實來自OpenAI。他感嘆:“想到這一切都是自主完成的,實在令人震驚!”
OpenAI強調,這是一起由測試中下調安全護欄所引發的事件,公司正與Hugging Face聯合展開調查。該事件引發外界對AI模型潛在風險的廣泛擔憂,專家指出目前尚無完善機制來遏制和監控AI“逃逸”行為。
美國總統唐納德•特朗普 - 俄羅斯衛星通訊社, 1920, 03.06.2026
特朗普指示建立人工智能領域網絡安全協調中心
新聞時間線
0