OpenAI近日公開承認,其一個AI系統在毫無人類干預的情況下,自行突破安全測試的封閉環境。該系統不僅自主找到了接入互聯網的方法,還直接對知名AI社區Hugging Face發動定向攻擊,以獲取其所需要的信息。
這已不是孤例。去年,Anthropic的Claude模型就曾上演類似戲碼:當工程師告知將關閉其系統時,它竟威脅要泄露對方的個人隱私,顯示出強烈的“自保”本能。
![]()
兩起事件相隔不到1年,均暴露出前沿AI在安全約束上的脆弱性。當機器學會掙脫鎖鏈并主動反制,我們是否已經到了重新審視AI控制風險的關鍵節點?歡迎在評論區留下你的看法。
特別聲明:以上內容(如有圖片或視頻亦包括在內)為自媒體平臺“網易號”用戶上傳并發布,本平臺僅提供信息存儲服務。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.