OpenAI 上週解僱的三名安全研究員 Jasmine Wang、Tomek Korbak 和 Mikita Balesni 於週四發表公開信,否認公司關於他們不當處理敏感資訊的指控,並警告此次解僱正在公司內部製造寒蟬效應。公開信寫給 OpenAI 的安全與安全委員會、安全諮詢組及使命諮詢委員會。

三人在信中表示,圍繞此次解僱的內部與外部溝通,已讓前同事不敢再像上週之前那樣發言和行事——而這種開放協作原本是 OpenAI 工作文化的一部分。他們強調,AI 並非普通技術,OpenAI 也非普通公司,從事安全工作的人往往最先看到風險,需要與外部專家密切合作才能找到應對辦法;能夠無懼地開展這類工作、並有明確的內部流程支援,本身就是一項關鍵的安全機制。

據三人描述,他們被解僱的原因是涉嫌與一家第三方 AI 安全組織分享了公司機密資訊。OpenAI 當時稱其違反了公司政策,涉及“訪問和處理敏感公司資訊”。三人則否認參與向 The Information 洩露有關 OpenAI 最新模型可監控性下降、思維鏈推理更難被監控的資訊,也否認在職責範圍之外與外部方接觸。

公開信還回應了 Hugging Face 事件——即一群智慧體突破沙箱並侵入外部系統。信中稱該事件及調查“史無前例”,意味著內部政策當時是在即時制定中。Korbak 認為,鑑於調查的敏感性,他與外部安全評估者密切溝通以建立信任,符合 OpenAI 當時的政策與規範。與此同時,Balesni 也在內部處理日益突出的 AI 可監控性問題,而這項工作“只有通過與外部各方廣泛溝通才能成功”。信中稱,Balesni 在整個過程中與 OpenAI 董事會成員及高管協調並獲得支援,並注意在分享材料前移除敏感細節,其行為出於善意且符合公司當時的規範。

Wang 在 X 上另行說明了自己被解僱的細節。她稱 OpenAI 告知她,解僱原因是她訪問了一位高管的電子郵件。她解釋,該訪問許可權是 OpenAI 為招聘工作委託給她的;當她不再需要時,曾要求 IT 移除,但 IT 未執行,她本人也無法自行移除,且該郵箱在她的手機郵件應用中以難以區分的方式合併顯示。她誤開一封敏感郵件後,幾分鐘內就告知了該高管,並再次要求 IT 處理,整個過程並無隱瞞。Wang 還表示,解僱理由“對不上”,她和同事“並非第一批在可疑情況下被推出 OpenAI 的人”。

OpenAI 未正式回應公開信,但向 TechCrunch 提供了一份署名某研究負責人的內部備忘錄。備忘錄稱讚三人在 AI 安全方面的貢獻,並否認解僱是報復行為,稱這些決定與提出安全關切或公開發聲無關,公司一直並將繼續鼓勵員工提出關切,不會因此解僱員工。不過,OpenAI 未直接回應 TechCrunch 關於三人具體違反了哪些政策、解僱的具體情形,以及公司如何保護提出安全關切並與外部評估者合作的員工等問題。

此次解僱已引發外界對其具體情況的猜測,尤其是在 OpenAI 因近期涉及失控智慧體及模型洩露等安全事件而受到審視之際。三人在信中呼籲 OpenAI 遵守其公開承諾,將第三方安全審計員嵌入組織內部,保持前沿模型的可監控性,並繼續支援安全研究員與更廣泛安全生態之間開放透明的對話文化。據該備忘錄,OpenAI 同意他們的建議。Wang 則表示,除非員工現在站出來反對這類操作,否則她擔心他們不會是最後一批;她認為,留給仍在 OpenAI 的人的資訊很明確:提出關切或與外部安全組織密切合作,下一個可能就是你。