你可能以為,現在那么多AI寫作檢測工具,一定能把人類和機器的文字分得清清楚楚。但當我們真的把檢測器丟進“人機混合”的樣本池里,結果卻是:有的工具一猜一個準,有的卻明顯心里沒底。
事情是這樣的:我選了自己近期寫的幾篇文章引言——全都是純手工寫出來的,沒讓AI幫忙。然后,我讓ChatGPT、Gemini和Claude分別讀一讀這些文章的標題和核心前提,讓它們各自生成一篇150詞左右的引言。這樣一來,我就有了一批“真正的人寫文字”和一批“同樣話題的AI文字”。
![]()
接著,我把這些樣本喂給五款不同的AI寫作檢測器——你刷社交平臺、改作業、篩簡歷時可能會遇到的那些——看看它們到底能不能分清誰是人誰是機器。下面先看兩款的表現,結果有點意思。
第一個上場的是Pangram,它標榜自己是“一個真正管用的AI檢測器”。免費賬號一天能查四次,付費后還能解鎖剽竊檢測等額外功能。我的兩段真人寫作送進去,Pangram的判斷是:100%由人類書寫,而且對每一次判斷都掛了“高置信度”的標簽——看來我的寫作風格還真沒什么機器味。
接著我把ChatGPT和Claude生成的兩段引言交給它,Pangram同樣毫不含糊:100%判為AI創作。它甚至貼心地圈出了“破綻”,比如某個句子開頭用了“from the moment you ...”,這種寫法在AI文本里太常見。這輪測試,Pangram拿了滿分。
第二個選手是大家更熟悉的Grammarly。它做了好多年語法糾錯,現在也順手干起了AI檢測。免費用戶一天可以查三次。我把自己那兩段真人引言交給它,結果和Pangram一樣讓人放心:0%的AI文本痕跡,判定為純人類寫作。
可當我換成AI寫的樣本時,情況就微妙了。一段來自Claude的引言,Grammarly只給了68%的AI寫作概率;另一段來自Gemini的引言,它也只判了66%是AI寫的。也就是說,Grammarly雖然抓住了文本里的一些AI特征,卻遠沒有完全“說服”自己,只給出了一個猶猶豫豫的分數。
這趟實測下來,一個樸素的感受是:AI寫作檢測這件事,遠沒到“即插即用,處處通用”的地步。有的工具在某些樣本上交出滿分答卷,有的工具卻只給出了“可能、大概、不太確定”的曖昧判斷。而你現在讀到的這段話,它到底是人寫的,還是機器寫的呢?
特別聲明:以上內容(如有圖片或視頻亦包括在內)為自媒體平臺“網易號”用戶上傳并發布,本平臺僅提供信息存儲服務。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.