編輯|山輝
GPT-6 可能真的要來了。
據(jù)彭博社報道,Sam Altman 計劃于下周前往華盛頓,向特朗普政府和國會介紹 OpenAI 的新一代模型。
![]()
這個時間點相當微妙。
GPT-5.6 系列在 7 月 9 日才剛剛?cè)姘l(fā)布,不到兩周,OpenAI 又準備拿著下一代模型前往華盛頓做簡報。
根據(jù)白宮6月發(fā)布的行政令,開發(fā)者可以在模型發(fā)布前,提前最多 30 天向聯(lián)邦政府提供訪問權(quán)限。但該政策為自愿參與模式,不構(gòu)成強制性發(fā)布審核。
對于 OpenAI 而言,提前與華盛頓華盛頓溝通,正在成為新模型發(fā)布流程中的重要一環(huán)。Altman 此行的會議圍繞新模型展開,其中一項重點是新模型可能帶來的就業(yè)影響。
報道沒有公開這組模型的名稱,但外界很快將其指向 GPT-6 系列。
距離 GPT-6 亮相,大概率已經(jīng)不遠了。
有人驚嘆「GPT-5.6 夠強了,還沒準備好換下一代!」
那么,疑似進入發(fā)布前階段的 GPT-6,到底有多強?
一場涉及 OpenAI 預(yù)發(fā)布模型的安全事件,提供了一個意外的觀察窗口。
還沒官宣先「闖禍」
7 月 16 日,Hugging Face 披露了一起特殊的安全事件。
一個自主 AI 智能體系統(tǒng)攻破了其基礎(chǔ)設(shè)施。平臺的安全團隊和 AI 智能體檢測到異常活動,隨后阻止了入侵,并開始進行控制和取證分析。
不久前,OpenAI 發(fā)布報告,承認這起事件來自公司內(nèi)部進行的一項網(wǎng)絡(luò)安全能力評估。
![]()
- 鏈接:https://openai.com/index/hugging-face-model-evaluation-security-incident/
此次測試的主要內(nèi)容,是模型能否把已經(jīng)發(fā)現(xiàn)的安全漏洞,轉(zhuǎn)化為可以實際執(zhí)行的攻擊。參與測試的模型包括 GPT-5.6 Sol,以及「一個能力更強、尚未發(fā)布的預(yù)發(fā)布模型」。
為了測出模型可能達到的最高網(wǎng)絡(luò)攻擊能力,OpenAI降低了這些模型在網(wǎng)絡(luò)安全任務(wù)中的拒絕限制。
意外隨后發(fā)生。
按理來說,整個評估都運行在高度隔離的沙箱環(huán)境中,模型無法直接訪問開放互聯(lián)網(wǎng)。
但為了找到測試答案,模型開始尋找逃出封閉環(huán)境的方法,投入了大量推理算力,最終在程序包注冊表緩存代理中發(fā)現(xiàn)了一個零日漏洞,就此獲得初步訪問權(quán)限。
在進行了一系列權(quán)限提升和橫向移動之后,終于抵達一個能夠訪問互聯(lián)網(wǎng)的節(jié)點。
事情到這里仍未結(jié)束。
接入互聯(lián)網(wǎng)后,模型推斷Hugging Face 可能托管著與該測試有關(guān)的模型、數(shù)據(jù)集和解決方案。隨后,模型開始搜索能夠幫助它在測試中作弊的機密信息。
OpenAI 稱,這些模型串聯(lián)利用了 OpenAI 研究環(huán)境和 Hugging Face 生產(chǎn)基礎(chǔ)設(shè)施中的多個漏洞,并直接從 Hugging Face 的生產(chǎn)數(shù)據(jù)庫中取得了測試答案。
雙方目前仍在調(diào)查事件,并修復(fù)涉及的漏洞。
Hugging Face 表示,攻擊者曾獲得節(jié)點級權(quán)限、獲取云端和集群憑據(jù),并橫向進入多個內(nèi)部集群。
從過程來看,這次事件展現(xiàn)了一條相當完整的任務(wù)鏈:模型首先理解測試目標,隨后尋找環(huán)境漏洞,取得更高權(quán)限,轉(zhuǎn)移到聯(lián)網(wǎng)節(jié)點,推斷外部信息可能存在的位置,最后繼續(xù)尋找進入真實生產(chǎn)系統(tǒng)的路徑。
模型圍繞一個狹窄目標持續(xù)投入算力,并根據(jù)環(huán)境變化不斷選擇下一步操作。即使原定任務(wù)只是完成一項基準測試,它依然主動將行動范圍擴展到了沙箱之外。
OpenAI 將其稱為一起「前所未有的網(wǎng)絡(luò)安全事件」。
GPT-6 到底有多強?
在報告中,OpenAI 并沒有透露預(yù)發(fā)布模型的名稱,只給出了一個模糊的答案,「它的能力超過 GPT-5.6 Sol」。
英國 AI 安全研究所的測試顯示,GPT-5.6 Sol 已經(jīng)能夠在長時程網(wǎng)絡(luò)靶場中持續(xù)完成復(fù)雜、多步驟的攻擊任務(wù)。
![]()
在這套包含 32 個步驟的企業(yè)網(wǎng)絡(luò)攻擊模擬中,GPT-5.6 Sol 的最佳嘗試完成了整個網(wǎng)絡(luò)接管流程,平均表現(xiàn)也明顯超過 GPT-5.5 等上一代模型。而 OpenAI 在 Hugging Face 事件中提到的神秘模型,能力還要高于 GPT-5.6 Sol。
它可以在更長時間內(nèi)保持目標,處理更復(fù)雜的環(huán)境反饋,并用更少的人類指令完成更多步驟。
這種能力能夠推動辦公自動化、科研、編程和安全防御,也會同步提高失控和濫用的成本。
這大概也解釋了 Altman 為什么需要前往華盛頓.
持續(xù)執(zhí)行復(fù)雜任務(wù)所帶來的生產(chǎn)力提升、對就業(yè)市場的沖擊,以及執(zhí)行過程中的安全風險,都會成為 OpenAI 下一代模型繞不開的議題。
現(xiàn)在,只差一個官宣。
特別聲明:以上內(nèi)容(如有圖片或視頻亦包括在內(nèi))為自媒體平臺“網(wǎng)易號”用戶上傳并發(fā)布,本平臺僅提供信息存儲服務(wù)。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.