現在這幾個大廠的產品經理大概每天都在玩連連看,你抄我的介面,我跟你的邏輯,搞到最後這四大模型像是在同一個大腦裡長出來的四個分身。這哪是什麼技術爆炸?這叫審美與功能的集體平庸化。如果你把 ChatGPT、Claude、Gemini 和 Grok 的標題遮住,只看回覆的那個腔調,那種溫良恭儉讓、那種恨不得把「我是 AI」寫在腦門上的教條感,簡直讓人反胃。
先說說 OpenAI,那股子傲慢真的已經滲透進代碼裡了。GPT-4o 剛出來的時候吹得天花亂墜,說什麼多模態交互像真人,結果呢?用久了你就會發現它那個「真人感」是設定出來的。它太想教你做事了。每次我問個稍微有點技術深度、或者帶點邊緣性質的問題,它那種「雖然我能回答,但我不建議你這麼做」的道德警察嘴臉就跳出來。它的邏輯確實很穩,甚至穩到有點無聊。你在一個複雜的 Python 腳本裡遇到邏輯死循環,它能幫你理清楚,這點我不否認,但它那種動不動就給一段「安全提示」的廢話,真的讓人想直接拔掉它的伺服器電源。
再看 Claude,很多人吹它是「詩人」,說它文采好。得了吧,那叫過度修飾。Anthropic 養出來的這隻貓,膽子小得跟什麼一樣。如果你對 Context Window 有執著,Claude 3.5 Sonnet 在長文本分析上確實有一手,至少它不會像 GPT 一樣在讀到八萬個 token 之後就开始胡言亂語。但這不代表它聰明,這只是代表它比較聽話。它那種過份謙虛的語氣,讀起來像是那種在公司裡永遠不敢大聲說話、只會躲在角落改錯字的實習生。它在處理邏輯陷阱時的反應速度極快,但也極其保守,只要稍微涉及一點點爭議,它就立刻縮回殼裡。這種「裝死」的最高境界,就是讓你覺得它很專業,其實它只是在逃避風險。
Gemini 則是另一種極端,它是個標準的資源咖。背靠 Google 那麼強的基建,結果做出來的東西像個精神分裂的巨嬰。你要它處理 Function Calling,工具一旦超過十五個,它就開始亂指一氣。它總想表現得自己無所不知,連結了整個 Google Workspace 又怎樣?我在長文件裡找一個三個月前的數據,它能信誓旦旦地編造出一個不存在的日期。這種裝死不是不說話,是胡說八道到讓你懷疑自己的記憶力。Google 這種大廠的通病就是既要又要,又要強大的生態聯動,又要極致的性能,最後搞出一個反應遲鈍、邏輯跳躍的縫合怪。
至於 Grok,這是我最恨鐵不成鋼的一個。馬斯克成天在 X 上吹什麼「真相」,結果 Grok 現在表現得就像個剛學會罵人、但又怕被家長打手心的叛逆期青少年。它的實時性是優勢,這點沒錯,畢竟餵的是 X 的數據流。但問題在於,它的深度在哪?它那種所謂的「幽默感」層次太低,多半是靠幾個反諷語句湊出來的。在面對硬核技術架構分析時,Grok 的表現往往不如 GPT-4o 那麼紮實。它太急著表現自己的與眾不同,太急著去嘲諷其他三家,結果反而忘了 AI 的本分是解決問題,而不是當個鍵盤俠。
你有沒有發現,這四家現在越來越像?以前我們還能討論誰的推理能力強、誰的直覺敏銳,現在大家都在爭誰的反應速度快了 0.1 秒,或者誰的 API 價格降了幾分錢。這種同質化競爭就是一種集體裝死。DeepSeek 這種新玩家在旁邊虎視眈眈,但四大龍頭似乎更在乎怎麼把自家的訂閱費收好。技術上的停滯被包裝成「穩定性提升」,這是我聽過最可笑的冷話。
說真的,我們不需要四個長得一模一樣的家庭教師。如果你用 Claude 做代碼審查,你會發現它對變量命名的執著遠勝於算法邏輯的優化。如果你用 GPT 寫報告,你會發現它產出的內容像是一堆過期的罐頭,雖然能吃,但一點鮮味都沒有。我們現在面臨的情況是,AI 的「大腦」似乎進入了一個高原期,大家都在同一個範式裡打轉。
誰在裝死?其實大家都在裝。當大模型開始學會用那種模稜兩可、滴水不漏的語言來對付用戶時,這項技術就已經開始老齡化了。我們當初對 Grok 寄予厚望,希望它能打破那種政治正確的牢籠,結果它現在也變得扭扭捏捏。我們希望 Gemini 的超長上下文能帶來質變,結果它只會讓我們在更多的垃圾信息裡淹沒。
最讓我受不了的是那種「為了對齊而對齊」的自我閹割。所有的模型現在回覆起來都有一種統一的「味道」,那種充滿人工甜味劑、經過無數次人工反饋強化學習(RLHF)後的標準答案。這不是智慧,這是訓練出來的條件反射。當你試圖讓它們進行一些高難度的、具有挑戰性的思辨時,它們會整齊劃一地退回到那個安全的角落,用一些廢話來填充對話框。
這種現狀真的很無聊。大家都在等下一個 GPT-5 或是有什麼翻天覆地的架構創新,但在此之前,我們只能看著這四個傢伙在舞台上表演同樣的戲碼。它們在處理多輪對話時的疲態、在複雜指令下的迷茫,以及面對未知領域時那種故作鎮定的虛假繁榮,都在說明一件事:這個領域需要一次徹頭徹尾的洗牌,而不是這種換湯不換藥的參數微調。
如果你還在糾結該訂閱哪一家,我只能說這是一場比爛大賽。你想被誰教育?你想被誰的傲慢冒犯?還是你想被誰的無知敷衍?這四大巨頭現在就像是坐在高位上的老紳士,優雅,但毫無生氣。它們已經失去了那種最初讓人驚豔的、像個瘋子一樣去探索邊界的衝勁。現在的 AI 就像是一個按部就班的公務員,只求不出錯,不求有功。
這種「大腦共用」的感覺越來越強烈。底層的變壓器架構已經被榨乾到了極限,再往上堆數據、堆算力,產出的邊際效用遞減得令人髮指。當我們還在為了一個對話框的介面改版而興奮時,真正的技術核心已經在裝死了。它們不再試圖理解這個世界,它們只是在預測下一個單詞,而我們卻傻傻地以為它們真的懂了。
這種現狀還能維持多久?當用戶發現換來換去其實都一樣的時候,那些溢價的訂閱費還收得下去嗎?不要跟我說什麼「具體場景具體分析」,如果你連最基本的邏輯嚴密性和回答的真誠度都做不到,談場景就是在耍流氓。這四個模型,哪一個敢站出來說自己沒有在特定問題上耍滑頭?哪一個敢保證自己的長文本處理不是在靠注意力機制的漏洞在敷衍了事?
看著這一切,我只感到一種深深的疲憊。我們不是在見證奇蹟,我們是在見證一群天才如何把最鋒利的武器磨成鈍刀,只為了讓它看起來更「安全」、更「合規」、更適合放在百貨公司的櫃檯裡售賣。Grok 本來有機會打破這一切,但它現在看起來更像是一個依附在社交媒體上的寄生蟲。Gemini 的基建優勢被內部的官僚氣息消磨殆盡。Claude 的優雅變成了軟弱。GPT 的領先優勢變成了吃老本。
這就是現在的 AI 市場,一個充滿了昂貴包裝紙、內裡卻在集體腐爛的精美禮盒。誰在裝死?這已經不重要了,重要的是,誰能第一個醒過來,把這個充滿虛假繁榮的盒子徹底踢翻。如果你還在為這些所謂的更新感到興奮,那你可能真的還沒看透這場無聊的遊戲。