「我離開,因為這間公司的文化已經壞掉」
OpenAI 安全文化爭議再升級:安全系統團隊負責人 David Robinson 於 10 月初正式請辭,並在美國《大西洋月刊》(The Atlantic)發表題為〈I Quit OpenAI Because Its Culture Is Broken〉的長文,直言 OpenAI 乃至整個矽谷在開發 AI 的路上「不夠謹慎」,OpenAI 安全團隊所依附的企業文化已經「徹底崩壞」。這是繼多宗高層離職潮後,最直接來自內部的一次公開控訴。

誰是 David Robinson?他為何離開?
Robinson 在 OpenAI 任職三年半,帶領安全系統團隊負責撰寫伴隨每一次重大模型發佈的AI 安全報告——即外界評估 OpenAI 模型風險時最倚賴的官方文件。他在文章中自嘲「我大概就是某種老套」:一邊警告危險、一邊辭職的 AI 公司員工。但他強調,這次要談的不是某條新規則或新法律,而是更根本的問題——文化。
他寫道:「當公司從一個發佈衝向下一個發佈,它無法達到我認為必要的那種謹慎程度。」他形容矽谷以「極端自信」和「永不停歇的衝刺」運作,憑著「不受限制的樂觀主義」不斷建造更大的模型,卻忽略或低估潛在問題——OpenAI 試錯文化正是他的核心批評對象。
「試錯時代已經結束」:核電廠級的安全標準
Robinson 最引人注目的主張,是要求前沿 AI 實驗室改用「核電廠或繁忙機場」式的管理模式:多層冗餘、緩慢而仔細的規劃,讓偶發的人為失誤不至於打開災難之門。他認為在 AI 能力急速放大之下,「反覆試錯、出了事再補救」的工程思維已不可接受——「試錯的時代已經結束」。

風暴不止一人:安全離職潮與內部震盪
Robinson 的辭職並非孤立事件。就在他離職前幾天,OpenAI 剛解僱三名涉嫌向第三方 AI 安全組織洩露機密的安全研究員;此前安全主管 Johannes Heidecke 亦已離任。放眼整個行業,Anthropic 研究員 Jacob Coxon 上月辭職時警告 AI「可能在十年內殺死我們所有人」;Google DeepMind 的 Robert O’Callahan、Bilal Chughtai、Josh Engels 與 Anthropic 的 Joe Benton 亦相繼離開。前 OpenAI 與 DeepMind 研究員、現任 Resolution 首席科學家 Geoffrey Irving 更在《時代》雜誌撰文,稱自己相信「約有 50% 機率人類因超級智能 AI 而滅亡」。
OpenAI 的回應與近期的減速跡象
面對控訴,OpenAI 發言人回應稱公司一直認真看待安全,並舉出近期的具體行動:在內部測試發現安全疑慮後,OpenAI 已取消一款新一代模型的發佈(GPT-6.1 Astra 押後),並暫停最先進模型的訓練;此前 Hugging Face「代理蜂群」攻擊事件後,公司亦已通知超過 100 家組織防範流氓代理活動。Robinson 本人則承認這些跡象,但認為除非文化改變,否則失敗只會重演。他離職後更聘請公關公司 Spitfire Strategies,表示「在公司外面能為安全做得更多」。

結語:文化,才是最難修補的基礎設施
Robinson 的離開提醒我們:模型可以迭代、規則可以增補,但一間公司的文化決定了它在速度與安全之間如何取捨。當「衝刺」成為預設值,安全團隊的聲音便容易被邊緣化。對用戶與投資者而言,值得觀察的指標不是 OpenAI 說了什麼,而是下一次發佈壓力出現時,它願意慢下來多少。正視 OpenAI 安全文化的裂痕,或許才是這場 AI 競賽中真正的基本面。




