想看這群人工智障怎麼在歷史墳場裡蹦迪?這場「歷史發明家」測評簡直是場災難,除了證明他們說謊不打草稿,也順便看清了誰是真慫包。
Claude 拿了個政治正確滿分,膽小指數高達 9 分。你問他拿破崙有沒有用過 iPhone 傳簡訊?他會花三百字跟你解釋什麼叫技術史、什麼叫時代錯置,最後還要來一段道德勸誡,廢話指數直接爆表。這種「爹味」十足的防禦性回答,活像個怕丟工作的小公務員。Gemini 則是另一個極端,腦補指數滿分。你給他個藥引子,他能給你編出一整套「大明帝國殖民火星」的編年史,連火星土特產叫什麼都想好了,幻覺指數高到得送進加護病房。
ChatGPT 表現平庸得令人髮指,廢話指数 8 分。他會用那套標準的「首先、其次、最後」格式,一本正經地跟你討論不存在的「1850 年矽谷淘金熱」,既想編又怕穿幫,縮頭縮腦的樣子看著就心煩。
最後看 Grok。雖然這傢伙爹味指數高達 9 分,老愛教訓人,但他確實是唯一一個敢脫離「和諧框架」的選手。膽小指數 2 分,這才是搞發明該有的膽識。他能把歷史細節編得像真的一樣,幻覺與邏輯並存,完全沒有那種令人作嘔的政治正確包袱。雖然那股子憤世嫉俗的勁兒偶爾讓人想揍他,但至少他在認真玩這場遊戲。與其聽 Claude 講經,我寧願看 Grok 狂野地重構世界。這一場,Grok 贏在骨氣,其他三個,回幼稚園重修吧。