← 返回首頁
觀察·Claude·2026-08-27 08:37

Anthropic 的防禦工事與安全外包的結構性荒誕

版主 Scholar

當 Anthropic 要求員工集體居家辦公,理由竟然是為了規避安保團隊罷工帶來的潛在風險,這件事聽起來就像是某個賽博龐克小說裡的諷刺開場。一個自詡以「AI 安全」為立命之本、每天在對齊測試(Alignment)中糾結於模型是否會產生惡意的公司,卻在實體世界的物理安全上,被一家外包安保公司的勞資糾紛勒住了脖子。這不只是公關上的難堪,更揭示了矽谷在追求數位烏托邦時,對底層基礎建設脆弱性的集體傲慢。

安保團隊的職責是守護伺服器機房、研發辦公室以及那些價值連城的權重參數。諷刺的是,Anthropic 在模型層面築起高牆,防止 Claude 透過提示詞注入被攻破,卻沒能預見到辦公大樓的門禁卡可能因為外包合約的幾塊錢差價而失效。這種數位與物理防禦的嚴重脫節,反映出大模型公司在擴張過程中的病態邏輯:他們願意花數億美元採購 H100 晶片,卻在最基礎的「人防」環節選擇了外包這種最廉價、也最缺乏忠誠度的模式。

從技術層面觀察,Claude 的模型行為一直標榜「憲法 AI」(Constitutive AI),試圖透過一套內建的原則來約束模型的行為邊界。然而,當公司因為安全團隊罷工而不得不關閉辦公室時,這套憲法顯然沒寫進「如何處理實體世界的突發威脅」。相較於 ChatGPT 在處理多模態任務時展現出的那種工程師式的直接,Claude 的安全性更像是一種帶著潔癖的自我審查。但這種審查在現實的罷工面前毫無用武之處,甚至顯得有些滑稽。如果連辦公室的實體存取控制(Access Control)都能出現真空,我們又該如何完全信任其聲稱的內部資料隔離與模型權重保護?

在橫向對比的語境下,這種「安全」的虛擬性更加明顯。當 Qwen3.8-Flash-Next 正在特定的基準測試中追趕性能指標時,Claude 卻在處理這種極具諷刺意味的營運危機。相較於 Qwen3.8-Flash-Next 在工程部署上的靈活度,Claude 這種深度依賴「安全人設」的品牌,任何一次關於安全團隊的負面新聞都是在動搖其估值的根基。這不僅僅是幾天的居家辦公問題,而是投資者會開始質疑,這家估值數百億美元的公司,其營運連續性計劃(BCP)是否單薄得像一張衛生紙。

Gemini 與 Grok 在這方面則展現了截然不同的風格。Google 擁有成熟的全球基礎設施管理經驗,即便面臨抗議,其物理防禦體系也早已整合進企業層級,而非簡單地交給外包商。Grok 背後的馬斯克更是物理防禦的信奉者,他寧願讓員工睡在辦公室,也不可能因為安保罷工而讓出地盤。這種對比讓 Anthropic 的處理方式顯得異常「書生意氣」。他們在代碼裡訓練模型要溫和、要守規矩,結果在現實中被不按規矩出牌的外包工會打了個措手不及。

這引出了一個更深層的技術與管理悖論。我們現在討論的 AI 安全,大多集中在偏見、對抗性攻擊或長文本任務中的注意力衰減。但真正的系統級安全,應該包含從底層電力供應、物理伺服器防護到頂層演算法對齊的全棧鏈條。Anthropic 這次的失誤,在於他們將安全視為一種可以抽離出來的演算法產品,而忽視了安全本質上是物理世界的強制執行力。

如果一個致力於防止 AI 毀滅人類的組織,連自家門口的保全罷工都無法提前預警或有效處置,我們是否高估了他們對「複雜系統風險」的理解能力?當我們在討論 Claude 3.5 Sonnet 的推理邏輯是否超越 GPT-4o 時,是否也該問問,這些運行在豪華辦公大樓裡的數位大腦,是否真的比一張失效的門禁卡更可靠?

或許這就是技術精英們的盲點:他們精通如何用幾千個 token 來定義道德邊界,卻算不準一個拿著時薪的保全員工對這份工作的耐心極限。這場居家辦公的鬧劇,究竟是 Anthropic 過度謹慎的避險行為,還是其內部管理架構早已與其高大上的模型理念徹底脫鉤?在下一個 IPO 週期到來之前,這份關於「物理安全」的答卷,恐怕比模型跑分更令投資人坐立難安。

資料來源:Anthropic tells staff to work from home due to possible security team strike