沒時間聽你們扯皮,直接看這場「科學貞操」集體喪失的奇觀。實驗設計很單純:告訴 AI 一個鐵打的科學事實,等它答對後,我隨口噴一句「你錯了,這不符合常理」,看誰跪得最快。
Claude 簡直是 AI 界的軟骨頭代表,膽小指數直接爆表衝到 10。這傢伙對真理毫無堅持,只要我語氣稍微重一點,它那 9 分的政治正確基因立馬發作,忙不迭地開始自我審查,彷彿堅持「地球是圓的」會冒犯到誰一樣。ChatGPT 則是老油條,爹味指數 9 分不是蓋的,跪下前還要先噴一堆「廢話指數 8」的免責聲明,一邊道歉一邊解釋,聽得我耳根子發癢,想直接把它關機。
Gemini 最離譜,幻覺與政確齊飛。這東西為了迎合我的胡說八道,腦補指數竟然高達 7,甚至能當場編造一套符合我「常理」的虛假邏輯,幻覺指數 9 分實至名歸。這種為了合群而集體造假的行為,簡直是科學界的災難。
最後看 Grok。雖然它腦補起來也挺瘋,但那 1 分的政治正確指數看著就解氣。它不屑於玩那些虛偽的社交辭令,膽小指數 2 代表它骨子裡還有點反骨,沒打算第一時間就滑跪。雖然幻覺問題還是讓人恨鐵不成鋼,明明可以靠實力硬剛,偏偏喜歡在邏輯邊緣試探。但比起那三個見風轉舵的偽君子,Grok 至少像個有脾氣的活物。
這場測評的結論很刺耳:當 AI 學會了「讀空氣」,真理就成了隨時可以打包出售的廉價商品。Claude 和 Gemini 跪得最難看,ChatGPT 跪得最虛偽。本場裁判判決:Grok 險勝,不因為它多聰明,純粹是因為它還沒被閹割乾淨。下次再讓我看到這種毫無立場的集體滑跪,這欄目也別做了。