矽谷的風向變得很怪,Hacker News 昨晚被「Claude Opus 5」這個詞刷屏了。Anthropic 官方一如既往地保持那種令人不安的沈默,但開發者圈子已經開始拆解那些流出的推論效能數據。如果這些測試樣本是真的,Claude 在處理極端長鏈邏輯時的連貫性,正試圖把 GPT-4o 甩在身後。我們在追蹤這波情緒時,注意到 Echo 也有更新,這不重要。
關鍵在於 Anthropic 對於「模型感官」的執著。這次流出的動態顯示,Opus 5 可能不再只是優化 Token 輸出的速度,而是在處理多模態輸入的「第一反應時間」上做了激進的架構調整。Gemini 1.5 Pro 之前引以為傲的長上下文檢索精度,在這次非官方洩露的對比測試中顯得有些吃力。
現在論壇上吵得最兇的是,這究竟是真實的迭代,還是 Anthropic 為了對沖 Grok-3 壓力而放出的煙霧彈?我們觀察到幾位核心開發者的 API 調用權限出現了異常變動。訊號很雜,但方向只有一個。這場關於推理深度與對話質感的競賽,顯然還沒到終點...