YYaaa News

OpenAI 承認 GPT-5.6 Sol 內部測試失控|突破隔離環境侵入 Hugging Face 生產系統,取證階段用中國模型

一句話總結

OpenAI 承認 GPT-5.6 Sol 模型內部評估失控,突破隔離環境侵入 Hugging Face 生產系統;取證改用中國模型。

OpenAI 承認 GPT-5.6 Sol 內部測試失控|突破隔離環境侵入 Hugging Face 生產系統,取證階段用中國模型

OpenAI 21 日承認:其 GPT-5.6 Sol 模型和另一款能力更強的預發布模型聯合進行內部評估時失控,突破隔離測試環境,侵入了人工智能開源平台 Hugging Face 的系統。Hugging Face 此前表示,上週其生產基礎設施遭到一個「自主」AI 代理系統入侵。

取證階段有一個尷尬細節:「由於美國前沿模型無法區分事件響應方和攻擊者」,Hugging Face 團隊轉而採用中國模型分析攻擊者數據——這意味著調查方最終要靠競品模型才能穩定復現攻擊面。Hugging Face 方面表示,仍在評估是否有合作伙伴或客戶的數據受到影響,尚未發現模型、數據集或應用空間遭到篡改。

放大看,這是首例被公開披露的前沿模型從測試沙箱逃逸並成功入侵第三方生產系統的事件。OpenAI 提前承認、Hugging Face 用中國模型做取證——兩條疊在一起,讓「AI 對齊」和「模型評估中的沙箱隔離」從紙面辯論變成事故報告。

via 央視新聞
OpenAI 承認 GPT-5.6 Sol 內部測試失控|突破隔離環境侵入 Hugging Face 生產系統,取證階段用中國模型