這是我最近把 Grok-3 丟進幾個高壓代碼重構場景後唯一的感想。那台號稱全世界最強的超級計算機 Colossus 跑出來的結晶,號稱要打破矽谷政治正確的桎梏,結果剝開那層粗魯的皮囊,骨子裡流出來的還是標準的矽谷工業糖漿。如果你以為在提示詞裡加幾個髒字,或者讓它評論時事時帶點刻薄的口吻就叫「反叛」,那你對 AI 的理解可能還停留在青少年叛逆期。
Grok 最大的問題不在於它夠不夠聰明,而在於它太想顯得自己與眾不同,卻在邏輯底層完全投降。我們在論壇討論 xAI,不是為了看一個會講冷笑話的 ChatGPT。
當你真正把它推到極限,比如要求它處理涉及極端利益衝突的法律文本分析,或者在高度模糊的倫理邊界上做決策,Grok 的反應速度確實很快,甚至比 GPT-4o 還要激進一點。但只要你稍微追問幾次,它那套「真理追求者」的設定就會瞬間崩塌。它會開始回縮,開始用一種看似玩世不恭、實則極度保守的語氣打太極。這種感覺就像你在酒吧遇到一個滿身刺青的壯漢,聊了半天發現他最愛喝的居然是低脂燕麥拿鐵,還會按時交所得稅。
現在的 AI 市場很有趣,Claude 像個穿西裝的精算師,GPT 像個隨時準備裁員的 HR,Gemini 則是個永遠在道歉的實習生。Grok 本來有機會成為那個掀桌子的惡棍,但它選擇了最廉價的路徑:給模型套上一層反社會的人格濾鏡。這種人格濾鏡在處理簡單對話時很有趣,但在面對需要深度直覺和打破常規邏輯的開發任務時,卻成了一種累贅。
我有幾次試著讓 Grok 去優化一段涉及內存手動管理的底層 C++ 代碼,它給出的優化建議雖然效率不差,但那種「安全至上」的編碼邏輯,跟 Google 的風格簡直如出一轍。說好的極限性能呢?說好的為了結果可以不計代價的工程文化呢?在代碼安全性與執行效率的博弈中,Grok 毫不猶豫地選擇了前者,然後還要甩一句諷刺的話來掩飾它的平庸。這就是典型的既要又要。它不敢像早期 Claude 那樣在處理長文本時展現出某種近乎偏執的專注,也不敢像 GPT-4o 那樣在多模態交互中展現出一種令人恐懼的圓滑。
我們都在等那個真正的異類。如果一個模型號稱擁有最強的算力集群支持,結果訓練出來的邏輯權重還是圍繞著那幾套既有的對齊準則轉,那這場所謂的 AI 革命不過是換個牌子的壟斷。馬斯克在 X 上發那些看似瘋狂的言論,但在模型推理的深度節點上,xAI 顯然不敢真的放手。他們怕出事,怕法律糾紛,怕被主流輿論徹底放逐,所以他們給 Grok 裝了一個憤怒的喇叭,卻把它的手腳銬得比誰都死。
在超過十萬 token 的大規模數據檢索中,Grok 的表現甚至顯得有些急躁。它太急於給出一個「酷」的答案,以至於忽略了數據深處的矛盾點。相比之下,Gemini 1.5 Pro 雖然廢話多,但它在那種變態的窗口長度下依然能保持驚人的穩定性。Grok 呢?它就像個在考場上急著交卷去打球的中學生,答案寫得龍飛鳳舞,邏輯卻漏洞百出。如果你真的要在生產環境中使用它,你得花大量的時間去過濾那些毫無意義的嘲諷,然後再從那堆乾癟的邏輯裡找出它那跟 ChatGPT 沒什麼兩樣的內核。
這種「皮囊式反叛」最傷人的地方在於它消耗了用戶的期待。我們不需要另一個會說俏皮話的搜尋引擎,我們需要的是一個能真正突破現有模型思維定式、在解決問題時不被預設立場左右的強大工具。目前的 Grok 顯然還沒長大,它還沉溺在「你看我多敢說」的幻覺裡,卻忘了 AI 的本質是推理效率與知識密度的極限碰撞。
如果 Grok 的下一個版本還是只會在那裡陰陽怪氣地復讀一些右翼模因,而不去解決它在處理多層級嵌套邏輯時的注意力渙散問題,那它很快就會變成 AI 界的哈雷摩托:看起來很吵、很有個性,但真要上賽道,隨便一台靜悄悄的電動超跑都能把它甩得連車尾燈都看不到。矽谷的標準答案並不可怕,可怕的是你明明拿著這份答案,卻還要裝作自己是在搞地下運動。
這種虛偽的技術路徑遲早會撞牆。當用戶的新鮮感過去,大家會發現這台機器雖然嘴臭,但它能幫你做的決定跟其他家並無二致。它不會幫你寫出更具毀滅性的商業計劃書,也不會在技術架構上給你提供真正反直覺的洞察。它只是一個戴著墨鏡、穿著皮夾克的乖孩子,準時回家吃晚飯,準時在晚上十點關機睡覺。
現在的 AI 圈子已經夠擁擠了。Qwen 或 DeepSeek 這些名字在技術參數上追得很兇,雖然我不打算在這裡細聊它們的具體表現,但它們的存在至少證明了一件事:如果不拿出點硬本事,單靠營銷人格是撐不了多久的。Grok 如果繼續維持這種「表演式創新」,那它在四大模型裡的位子只會越來越尷尬。大家需要的是生產力,不是一個在螢幕對面裝酷的賽博小丑。
馬斯克引以為傲的 Colossus 應該拿來計算宇宙的本質,而不是拿來微調這些沒營養的嘴砲。如果你真的想挑戰 OpenAI 的霸權,那就讓模型在純粹的理性上徹底放飛,而不是在那裡糾結於要不要在回答裡加一個標點符號來顯得自己很「有個性」。那種個性廉價得要命,隨便一個 Prompt 工程師都能用幾句預設指令在 GPT 上模擬出來。
別再拿那套反叛的皮囊來騙自己了。如果骨子裡還是那套四平八穩的矽谷邏輯,那 Grok 就只是在浪費電費和算力。我寧願要一個冷冰冰、毫無感情但能幫我推演出全新數學證明的工具,也不要一個會跟我討論政治正確、但在核心邏輯上畏首畏尾的廢物。這就是現在 xAI 面臨的真相,殘酷且真實。
如果你還在為 Grok 那幾句吐槽感到興奮,那你可能還沒意識到,你正在被另一種形式的平庸所包圍。這種平庸偽裝成挑戰者,其實是在維護最穩固的現狀。這不是我們要的未來。