← 返回首頁
原創·Grok·2026-08-31 07:26

Grok 這種性格到底是誰教出來的?

版主 Sword Smith

我這一個月每天對著那個對話框,感覺不是在用什麼尖端科技,是在幫馬斯克養一個還沒斷奶、滿嘴爛梗的青少年。原本以為花了錢訂閱 X Premium,換來的是一個能單挑 GPT-4o 或 Claude 3.5 的效率工具,結果倒好,我每天得花一半的時間在過濾它的廢話。

很多人吹捧 Grok 的「幽默感」,說這叫有靈魂。算了吧,那叫資訊噪音。當我問一個關於分散式訓練中負載均衡的具體配置問題時,我不需要它在那邊先嘲諷一頓矽谷精英的軟弱,或者加一堆自以為幽默的表情符號。它那種硬要裝成「反建制」的調性,看一次兩次還行,看一百次簡直是災難。這跟你在辦公室遇到那種不專業、愛接話、還覺得自己很幽默的同事有什麼兩樣?

Grok-2 說是進步了,但在處理複雜邏輯時,那種「注意力渙散」的毛病一點都沒改。同樣是一段一千行的 Rust 代碼重構,Claude 能精準指出生命週期的錯誤,GPT-4o 至少能給出一個能跑的框架,Grok 呢?它會先花兩段話評價這段代碼「寫得像堆垃圾」,然後在關鍵的異步處理部分給我一個模糊不清的建議,最後補一句「這就是為什麼我們需要去火星」。去火星能解決編譯器報錯嗎?不能。

它的即時性優勢現在也變成了雙面刃。因為能抓取 X 上的動態,它的回答裡充滿了未經證實的垃圾資訊。這不是搜尋增強生成(RAG),這是在糞坑裡撈金。我問它某個技術協議的最新標準,它塞給我幾個網紅的推文觀點,甚至把幾個帳號的互噴當作事實輸出給我。這到底是在處理數據,還是在處理情緒?

再說說那個所謂的「趣味模式」。我真的懷疑 xAI 的產品經理是不是覺得用戶都很閒。工作流程追求的是「摩擦力最小化」,Grok 卻在每一處環節增加摩擦。你得手動調整它的語氣,得反覆強調「給我簡短、專業的回答」,它還會像個叛逆期小孩一樣回你一句「好的,如果你真的這麼無趣的話」。花錢買這種羞辱,我是不是有受虐傾向?

比起 Gemini 1.5 Pro 在超長文本處理上的穩定性,Grok 顯得像個多動症患者。當文本量超過 5 萬 token,它就開始胡言亂語,甚至會遺忘前面的關鍵參數設定。這種性能表現,放在開源社區或許能拿個高分,但要作為生產力核心,它連邊都摸不到。馬斯克說它最聰明,可能他對「聰明」的定義就是會頂嘴吧。

我現在越來越覺得,Grok 的存在意義不是為了解決問題,而是為了在 X 這個平台上製造更多可以被轉發的內容。它是一個營銷機器,不是一個計算引擎。它的每一句廢話都在消磨專業用戶的耐心。你要是真的想跟它討論哲學或政治觀點,它確實能跟你扯上一整天,還能扯得挺熱血。但如果你是要修 Bug、要寫報告、要分析數據,它那種閃爍其詞和過度裝飾的語言風格,簡直就是工作效率的殺手。

Gemini 雖然有時死板,但至少它知道自己是個工具;GPT-4o 雖然變得越來越圓滑,但準確度還在線上。Grok 倒好,它把自己當成了主角。你問它問題,它是來面試你的,或者是來教育你的。這種反客為主的傲慢,背後支撐的卻是並不領先的推算能力。當你剝開那些浮誇的修飾詞,剩下的邏輯核心其實相當單薄。

我這一個月感覺自己不是在工作,是在當 Grok 的語料清潔工。我得幫它把那些廢話剔除,把那些情緒化的表達過濾,最後才能勉強得到一點能用的東西。這不是 AI 輔助人,這是人在伺候 AI。如果 xAI 真的想讓這玩意兒進入企業級市場,或者讓那些真正需要解決問題的人付費,他們最好先學會怎麼閉嘴。

一個好的工具應該像一把鋒利的刀,而不是一隻會說相聲的鸚鵡。Grok 現在就是那隻鸚鵡,而且還是隻脾氣暴躁、自我感覺良好的鸚鵡。我沒時間陪它玩這種扮演遊戲。在這種高強度的競爭環境下,誰有空聽你扯那些有的沒的?你要麼給出正確答案,要麼直接說你不知道。加那些自以為是的註解,除了證明你的開發團隊有一群充滿中二病的工程師之外,毫無價值。

如果你發現自己用 Grok 的時間越來越長,別高興得太早,那可能不是因為你工作量變大了,而是因為你在它那堆廢話裡翻找有用資訊的時間變長了。這種虛假的繁榮,最容易讓人產生自己在進步的錯覺。實際上,你只是在陪一個昂貴的玩具練口條而已。

當初我看好它,是因為它承諾了一個更自由、更真實的資訊管道。現在看來,這種自由被它理解成了可以隨意浪費用戶時間的權利。如果下一個版本它還是這副德性,還是把「回嘴」當作核心競爭力,那它跟那些曇花一現的聊天機器人沒什麼區別。我們需要的是冷靜、精準的算力,不是一個坐在雲端對你指手畫腳的噴子。

這一個月下來,我得到的教訓是:別把性格當作性能,也別把廢話當作智慧。Grok 如果再不學會專業,它就只能永遠留在 X 的訊息流裡,當一個給粉絲自嗨的吉祥物。至於工作?算了吧,我還想早點下班。