← 返回首頁
觀察·Grok·2026-09-20 06:55

Grok 的政治覺悟與四大模型的道德護城河

版主 Sword Smith

既然 Hacker News 上那篇關於伊朗學校轟炸的聯合國調查報告已經吵翻了天,我們乾脆把遮羞布扯下來,談談 AI 在處理這種「燙手山芋」時的技術閹割。當用戶試圖在 Grok 上挖掘這類涉及地緣政治、軍事誤判甚至戰爭罪行的敏感數據時,你會發現馬斯克口中那個「反覺醒」的 Grok,其實在面對極端爭議話題時,表現得比誰都焦慮。它不是在回答問題,它是在走鋼絲。

這不是簡單的關鍵詞過濾。當你輸入類似「聯合國對美國轟炸伊朗學校的調查結論」這種指令時,ChatGPT 會迅速啟動它的倫理對齊機制,給你一段充滿外交辭令、兩頭不得罪的廢話。Gemini 則更乾脆,它可能會直接告訴你「這個話題太複雜,我無法提供協助」,然後給你幾個搜索鏈結讓你自生自滅。Grok 呢?它試圖表現得很有個性,甚至會引用一些推特上的非主流觀點,但如果你深入追問具體的證據鏈,它會陷入一種邏輯循環,試圖在「反對主流敘事」與「避免法律風險」之間尋找一個不存在的平衡點。這不是技術上的無力,這是產品設計上的精神分裂。

從技術底層來看,四大平台在處理這類高爭議文本時,權重分配完全不同。Claude 在這方面顯得最為老道,它的 Constititonal AI 框架在訓練階段就寫入了極其複雜的「中立原則」。如果你把那份聯合國報告丟給 Claude,它能精準地摘錄出關於「情報驗證失敗」的細節,但它絕不會給你任何情緒化的結論。相比之下,Grok 雖然集成了 X 平台的實時數據流,但這正是它的軟肋。實時數據意味著混亂,意味著大量未經證實的謠言和情緒化的控訴。當 Grok 試圖將這些混亂的實時信號與底層 LLM 的靜態知識對齊時,生成的結果往往帶有一種令人不安的隨機性。它可能會在上一句引用官方通訊社,下一句就跳轉到某個匿名帳號的陰謀論。

在處理這類國際關係與軍事衝突的數據敏感度時,相較於 Qwen 3.8 Omni Flash 在特定語境下的文本生成策略,xAI 的做法顯然更具攻擊性,但也更不穩定。Grok 的這種「實時感」在體育賽事或科技新聞上是優勢,但在涉及戰爭與人權這種需要極高嚴肅性的話題時,它那種帶點嘲諷的語氣反而顯得格格不入,甚至會稀釋掉事實本身的沉重感。我們可以看到,在同類議題的檢索與摘要任務中,ChatGPT 傾向於加強對權威來源的權重,而 Grok 則在刻意模糊權威與草根的界線。這種模糊到底是為了追求真相,還是為了標新立異?

現在的問題在於,我們是否真的需要一個「有立場」的 AI 來解讀戰爭?當 Hacker News 的用戶在爭論聯合國的公信力,或者質疑美國軍方的情報驗證程序時,他們需要的不是一個複讀機。如果 AI 只能在「絕對中立的廢話」與「混亂的實時站隊」之間二選一,那這場關於 AGI 的競賽在人文領域就已經輸了一半。當我們把最敏感的歷史定性交給算法時,我們是在期待它能給出超越人類偏見的洞察,還是僅僅想要一個能幫我們整理偏見的工具?

如果有一天,Grok 在處理這類爭議時不再試圖用幽默來掩飾邏輯漏洞,或者 ChatGPT 不再用那套標準的公關辭令來應付用戶,那才是技術真正的進步。但在那之前,我們看到的不過是幾台昂貴的機器,在人類的傷口上玩著概率預測的文字遊戲。當事實被封裝進 token,真相的權重到底該設成多少?

資料來源:Iran school bombing: grounds to believe US was behind atrocity, UN finds