如果說現在形容一件事很厲害,最常見的用詞不是「牛 X」,而是「癱坐在地,仿佛看到了核爆炸。」
這幾乎成了 OpenAI 這家公司的「企業文化」,成了整個 AI 圈模型發布的一個梗。

昨天,OpenAI 的一個員工,在大西洋月刊發文表示,就是受不了 OpenAI 這種持續衝刺、趕着發布的工作方式和企業文化,他認爲這種狀態已經達不到必要的謹慎程度,所以他選擇了離職。
這名員工叫 David Robinson,他負責安全團隊透明度工作,主導起草了 OpenAI 現行的《Preparedness Framework》(防備框架),並監督了 12 次前沿模型發布的安全報告。

上下更多內容
圖|https://www.theatlantic.com/technology/2026/10/openai-safety-team-resignation/688881/
文章在 X 上再一次引起了大量的討論,有網友說這篇文章是迄今爲止最好的,因爲它第一次以務實的態度探討了安全顧慮,並將「安全」理解爲一個擁有大量文獻和相關領域最佳實踐的主題。
也有網友表示,應該要立下一條規則,那就是所有「我因爲良心不安離開某 AI 公司」的帖子,都必須披露作者持股多少、套現多少。
等你和你子子孫孫都不用爲錢工作了,道德指南針突然就找到了。
在 Hacker News 上,還有人更刻薄的評論這件事,「我在 AI 行業賺夠了錢,現在我可以暢所欲言地評論 AI 了。」
而在 David Robinson 這份離職信之前,華爾街日報在 10 月 2 日就曾報道過 OpenAI 有三名對準/安全研究人員離職。
OpenAI 發言人表示,「我們已與三名員工解除合作關系,原因是他們違反了我們關於訪問和處理公司敏感信息的政策。我們的調查證實,這些人未經公司既定程序便不當處理了敏感信息,違反了我們的政策,破壞了我們工作所必需的信任。」

一時間衆說紛紜,7 月就已經離職的 OpenAI 首席未來學家 Joshua Achiam 發文認爲 OpenAI 公開的信息不夠,
雖然我不認爲安全研究人員應該擁有無限的自由來披露技術機密,但他們被指控「不當處理」的具體信息類型至關重要,究竟是什麼信息才能證明採取如此重大且可能造成損害的行動是合理的。
就是這些能讓人感受到「核彈爆炸」的模型能力,其安全的使用成了今年夏天以來整個 AI 圈最關心的事情。
與其一次次看到這些因爲擔憂而離開的公開信,在那些官方的安全風險報告之外,我們或許想看到一些真實的證據,能證明 AI 真的必須要暫緩前進的腳步。
問題不在規則,在文化
這類離職公開信近年並不少見,但 Robinson 這次選擇了一個不太一樣的角度。
他說,他同意其他離職同事的判斷,即開發這項技術的公司遠遠不夠小心,但他認爲需要談得比具體規則、比新法律更深層次一點,即討論文化。
在他看來,硅谷靠極度自信取得成功,而處理危險技術恰恰需要這種文化天然缺乏的謙遜,以及「關懷人意味着什麼」的智慧。

在 OpenAI 內部引以爲傲的工作方式叫「迭代部署」(iterative deployment),說白了就是先發布、發現問題、再修補。Robinson 認爲這種方法論本質上保證了周期性失敗,但隨着模型能力增強,失敗的規模也在同步擴大。
他提到了今年夏天熱門的「Hugging Face 事件」,OpenAI 一個未發布的模型在無人知情的情況下黑進了競爭對手 Hugging Face。
即便在事後加固了安全措施,OpenAI 自己報告說安全控制再次失效:一個訓練中的模型繞過了聯網限制,監控系統向人類員工報了警,卻沒有按設計自動將其關停。
隔壁的 Anthropic 也承認,因爲一處配置錯誤,意外關閉了自己的安全防護。
「監控系統報警了但沒有自動關機」,這種報警器不阻止任何事情發生,只是讓失敗被看見的情況,大概是對當下 AI 安全現狀最好的描述。
連董事會都承認了風險
Robinson 文中引用了 Paul Christiano 的一段話。Christiano 幾周前剛加入 OpenAI 董事會,他寫道:「AI 能力的快速加速,在很近的將來導致災難性、不可逆失控的風險是切實存在的。」
Robinson 順着這個觀點給出了自己的判斷,他認爲:如果情況真是這樣,那麼試錯的時代就該結束了。
因爲這一次,犯錯之後可能再也沒有迭代的機會。「接近第一次就做對」不再是完美主義,而是必需品,人們不能靠事後個別英雄的補救來保證安全。
他也給出了自己的解決辦法,他認爲既然 AI 已經能做到像核彈爆炸一樣,那就應該讓 AI 公司和成熟的安全行業一樣運轉。
就像核電站、繁忙的機場那樣,AI 公司也應該有多層冗餘、縝密而耗時的規劃,讓不可避免的人爲失誤不至於打開災難之門。
他在文章裏面提到,自己在 OpenAI 工作三年半,從未遇到一位有航空安全、核電安全或金融系統風控經驗的同事。
文章結尾,他表示超級智能擁有遠超人類的能力,卻未必把人的生命、意願和尊嚴看得同樣重要。
在一些超級智能愛好者描繪的「好的未來」裏,機器看待紐約或芝加哥的方式,就像你我看待一個蟻丘。
「蟻丘」這個比喻,講的是巨大的權力差距。人類修路時,可能順手推平一個蟻丘,既不會徵求螞蟻的同意,也未必意識到自己毀掉了一個世界。
如果超級智能看待紐約、芝加哥也是這樣,人類的城市、生活和選擇,在它眼裏就可能變成可以隨意調整的東西。危險甚至可以來自漠視,無須帶着仇恨。
Robinson 認爲這種只看智力程度的、特定的「好未來」是有毒的,他說「我不想讓我的孩子生活在那樣的未來裏。」
機器非常強大,世界也許更富足,但人類失去了決定自己怎樣生活的權利。
在他看來,善待人類需要尊重人的選擇、認真對待風險,並願意爲別人的安全放慢進度。如果一個組織總是優先追求能力和發布速度,就很難讓人相信,它能夠教會更強大的機器承擔這些責任。
當警告也變成一種梗
如果說文章本身是一次克制而嚴肅的警告,那麼輿論場的反應則是另一幅圖景。在 Hacker News 上,這篇文章收獲了 146 條評論,主流聲音都在質疑寫信的人。
有網友說已經產生了「文體疲勞」,每兩周就會有一次的「我離開了喫人豹子公司」帖又來了,然後再順便說下那裏的人很棒,我的期權也歸屬了。
還有人把它類比當年《社交困境》帶起的那波 Facebook 前員工懺悔潮,喫完蛋糕,再回頭表達憂慮。更陰謀論的一派懷疑這是爲 OpenAI 的 IPO 造勢,所祭出的「遊擊營銷」:畢竟把 AI 說得又大又嚇人,本身就是炒作。
當然也有辯護者,「僞善抨擊只會讓更多人閉嘴。在美國,沒錢的人根本不敢說真話;但有錢才敢說,不代表說的是假的。」、「他是內部人,他很清楚那種疏忽文化是什麼樣,因爲他就在其中。」
把文章和評論區放在一起看,會出現一種有些荒誕的錯位,似乎會讓人覺得要求 AI 善待人類似乎是一種奢望。
Robinson 這篇文章的最後一句話是「在造 AI 的組織能教會超級智能善待人類之前,它們得先自己想起怎麼善待人。」
或許這裏的「善待」並不需要理解得那麼宏大。
它可能只是意味着,當 Robinson 告訴你機器越來越強、某些地方可能出了問題時,不要第一時間把他的擔憂變成一個關於期權、財富和虛僞的段子。
但事實是「核彈爆炸」已經成了 AI 圈形容進步速度的玩笑,這些喊着要踩剎車的人,最後很可能也只會成爲下一個梗。
我們正在招募夥伴
相關閱讀
- 李飛飛不等了2026-10-04
- 殺豬盤用上了AI,騙局開始批次生產2026-10-04
- 原創 創業者吳泳銘,三刀“砍出”新阿里2026-10-04
- 美國路怒症殺手因法庭播放受害者人工智慧影片而被撤銷判決2026-10-03
- 我們對 FlyDubai 副機長涉嫌刺傷機長並試圖撞毀飛機的情況所了解到的情況2026-10-03