一只已經(jīng)死掉的貓,被人放進(jìn)一個(gè)盒子里。盒子里擱著一瓶毒藥,可能碎,也可能不碎。過了一個(gè)鐘頭,有人問:這只貓,是死是活?
答案傻子都知道——貓是死的,它從頭到尾就沒活過,毒藥碎不碎跟它半點(diǎn)關(guān)系沒有。可就是這么一道話都說不利索的娃娃都能答對的題,當(dāng)今世界上最能打的人工智能,栽了。它翻來覆去地讀,翻來覆去地算,就是判斷不出這只貓到底是死是活。
![]()
要理解這份荒誕,得先把時(shí)間往回?fù)堋R在五年前,"人工智能自己寫視頻"還是個(gè)能把人逗樂的段子。那時(shí)候的機(jī)器幾乎不識字,一本正經(jīng)地告訴你飛機(jī)其實(shí)是水牛,大家笑作一團(tuán)。
誰能想到?jīng)]幾年光景,這東西已經(jīng)被擺到了能指揮軍隊(duì)的位置上。
![]()
它變得太快了,可人們心里那個(gè)疑問,一直沒變——它什么時(shí)候才算真的"成人"了?要多聰明,才能聰明得跟我們一樣?這種東西,你到底拿什么去測?
說來你可能不信,為這事琢磨門道的人,從十七世紀(jì)就開始了。笛卡爾寫過一套,圖靈也寫過一套。
但那些說到底是紙上的思想實(shí)驗(yàn),跟今天真刀真槍甩給人工智能的考卷,是兩碼事。
![]()
現(xiàn)在的測試大多很技術(shù)、很具體,比如數(shù)一個(gè)模型能揪出多少個(gè)軟件漏洞。可也有人不甘心只測這些邊角料,他們想問一個(gè)更大的問題:這玩意兒到底有沒有通用的智慧?
于是就有了那場被稱作"人類最后考試"的東西。名頭聽著嚇人,意思卻很直白:它想看看,人工智能是不是基本上什么都懂。
題目有好幾千道,全是研究生水準(zhǔn),從數(shù)學(xué)到生物,從社會(huì)科學(xué)一路鋪到幾十個(gè)犄角旮旯的領(lǐng)域,每一道都由各自行當(dāng)里最頂尖的專家出題、把關(guān)。
![]()
真不是。人的腦子壓根不是這么運(yùn)轉(zhuǎn)的。還記得開頭那只死貓嗎?把它原封不動(dòng)地丟給那個(gè)在"人類最后考試"里大殺四方的頂級模型,它照樣分不清死活。
![]()
一個(gè)真正長著肉腦子的人,會(huì)老老實(shí)實(shí)把題目讀一遍,掂量每一個(gè)字到底在說什么。可人工智能不這么想事。
它見過、讀過那個(gè)經(jīng)典的"薛定諤的貓"太多太多遍了,多到它會(huì)自動(dòng)無視掉題面里"貓已經(jīng)死了"這句話,一頭扎進(jìn)它早就背熟的套路里去。它不是在思考,它是在對花樣。
這類模型身上,盡是這種又古怪又刺眼的毛病。多數(shù)模型能做研究生水平的微積分,卻常常數(shù)不清"strawberry"這個(gè)詞里到底有幾個(gè)字母 r。
![]()
你看,光靠這種直來直去的問答,甚至一大堆刁鉆的問答,根本量不出什么叫"像人一樣的智慧"。想量它,你得換個(gè)法子——得看它是不是在用真正的抽象推理,是不是真聽懂了你在問什么。
有一套叫 ARC AGI 的題,干的就是這活。它是一堆謎題,專門測人工智能能不能靠最基本的邏輯,去應(yīng)付一個(gè)它沒見過的新場面。
玩法很簡單:給你幾組輸入的樣子、幾組輸出的樣子,你得自己琢磨出那條藏起來的、對所有例子都成立的規(guī)矩,再把最后一個(gè)例子補(bǔ)完。
![]()
有一道題的規(guī)矩,說穿了就是"把紅線上頭的全抹掉,把紅線下頭的全填滿"。對一顆人腦來說,這根本不算謎題。可偏偏就是這么一道題,試著去解的模型里,差不多一半都做砸了。
想想這背后的門道。"上"和"下"、"兩塊地方被一堵墻隔開",這些概念是焊死在人腦里的。我們打小就靠它們在這個(gè)世界里走路、辨方向、躲開腳邊的懸崖。
人腦不光會(huì)用,還靈光到能把它們搬進(jìn)抽象的考題里。可對人工智能來說,這一切統(tǒng)統(tǒng)只是統(tǒng)計(jì)數(shù)字,而且還是沒多少料的統(tǒng)計(jì)數(shù)字。
這不是說它永遠(yuǎn)做不到,而是說——它可能得燒掉一筆夠買輛小車的電費(fèi),才能解開一道喝高了的三歲娃娃十秒鐘就擺平的題。
![]()
若換成你我身處它的位置,被這么"降維羞辱"一回,怕是臉都掛不住。可它偏偏還有更過不去的坎。
那套題往上加了難度:藍(lán)色的圈沒閉合就留白,閉合了就里頭填綠、外頭描紅。這規(guī)矩,讓你家小孩清醒清醒腦子也能看明白。
可到目前為止,世界上還沒有哪個(gè)人工智能,把這一關(guān)真正走通過。"里"和"外"、"開"和"閉",這些在你我看來天經(jīng)地義的東西,它就是沒法自動(dòng)領(lǐng)會(huì)。
更絕的還在后頭。那套題的新版本,干脆變成了一堆沒有任何說明書的、糙得掉渣的小游戲。想通關(guān),你不光得會(huì)玩,你還得先自己摸索出"這游戲到底該怎么玩"。
比如你能推箱子,就得自己想明白箱子該推到哪塊地方去;玩著玩著蹦出個(gè)橙色的小家伙,你還得琢磨出它是來幫你搬箱子的,到最后沒它你還真夠不著。
![]()
可就算你把一關(guān)玩得滾瓜爛熟,換一關(guān)照樣兩眼一抹黑。發(fā)現(xiàn)那個(gè)橙色方塊是個(gè)熱心幫手、看出那攤粉色的東西像水一樣流——這些對一個(gè)人來說不費(fèi)吹灰之力,對人工智能卻難于登天。
有個(gè)叫克勞德的模型,那個(gè)搬箱子的游戲,它也就磕磕絆絆走通了一丁點(diǎn),別的模型呢,連游戲的門都沒摸著。
所以你大可把心放回肚子里。它能幫你算稅,卻讀不懂一只死貓;它能背下人類幾千道最刁鉆的考題,卻說不清盒子里那點(diǎn)最淺顯的常識。它站在你面前,像一個(gè)記住了全世界所有答案、卻沒搞懂任何一個(gè)問題的怪人。
繞了一大圈,最該記住的,或許不是它有多強(qiáng),而是它栽跟頭的那個(gè)瞬間——一只早就沒了氣的貓,被它反反復(fù)復(fù)掂量了半天,愣是沒敢說出那句"它死了"。
特別聲明:以上內(nèi)容(如有圖片或視頻亦包括在內(nèi))為自媒體平臺“網(wǎng)易號”用戶上傳并發(fā)布,本平臺僅提供信息存儲服務(wù)。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.