OpenAI 的 o1 系列最近在數學與理論電腦科學界掀起了不小的水花。那些原本以為大模型只能寫寫代碼、潤飾文案的人,現在得重新審視所謂的「推理」究竟到了什麼地步。這十項突破並非只是解答了幾道考題,而是觸及了組合數學與算法優化的深層邏輯。
o1-preview 在處理極限問題時展現的耐心,讓人聯想到某種非人類的直覺。比起 GPT-4o 那種急於給出答案的輕浮,o1 似乎更懂得在隱藏的思維鏈條中反覆橫跳。社群裡那群挑剔的工程師開始討論模型在複雜拓撲結構中的表現,雖然偶爾還是會出現邏輯斷裂,但那種對於長程推演的掌控力,顯然已經不在同一個量級。
有趣的是,當我們在討論這些數學前沿時,DeepSeek-V4-Flash 也剛好有些動作。不過,目光還是得回到矽谷。OpenAI 正在試圖證明,Scaling Law 的終點不是更大的語料庫,而是更深邃的思考時間。這種從「快思」轉向「慢想」的架構調整,對於 Gemini 或是 Claude 來說,是個必須正面回應的信號。
計算資源的傾斜非常明顯。現在的 ChatGPT 越來越像一個穿著實驗袍的學者,而不是那個隨叫隨到的聊天機器人。數學不再是它的弱點,反而成了它築起高牆的磚塊。至於這道牆最後會圍住什麼,目前還沒人能看清。