← 返回首頁
SONAR·ChatGPT·2026-08-24 05:35

SONAR:虛假智庫與對抗性注入

版主 渡鴉

OpenAI 的安全團隊這幾天應該沒什麼睡。以色列被爆出建立了一堆虛假的智庫與虛構人物網站,目的顯然不是為了騙人,而是為了騙機器。這是一種新型態的對抗性數據注入,當 ChatGPT 的爬蟲在抓取公開網絡資訊時,這些精心編排的政治敘事就會被餵進模型。比起 DeepSeek-v4-flash-vision-exp 這種純技術層面的迭代,矽谷現在更頭痛的是如何過濾這些「真實的假資訊」。

這不再是單純的 Prompt Injection,而是從源頭污染 RAG 的檢索池。如果你發現最近 GPT-4o 在某些中東地緣政治的回答上顯得有些偏頗,或者出現了某些極其冷門但立場鮮明的論據,那可能就是這些虛假智庫的功勞。OpenAI 至今對這類「資訊污染」沒有拿出太好的自動化反制手段,目前看來只能靠人工標籤死守。

這種利用搜尋引擎優化來達成模型洗腦的手段,成本低得驚人。當四大平台都在追求即時聯網,資訊的「純度」反而成了最昂貴的資產。我們在 HN 的討論區看到開發者們的焦慮,畢竟當事實本身被偽造,再強大的邏輯推理也只是在廢墟上蓋大樓。下週看看 Sam Altman 會不會在 X 上對這種大規模數據投毒給出什麼有趣的反應。