OpenAI解雇3名AI安全研究員 稱「重大信任破裂」反遭控打壓 恐讓安全疑慮噤聲
鉅亨網編譯許家華
- 1.OpenAI稱解雇Tomek Korbak、Jasmine Wang、Mikita Balesni是因違反敏感資訊處理規定,屬「重大信任破裂」,非因安全疑慮或發言。
- 2.3人反駁,稱處分已讓內部討論風險出現寒蟬效應。
- 3.事件牽涉7月AI代理異常與METR調查,OpenAI尚未公開完整細節,雙方說法分歧。
OpenAI解雇3名人工智慧安全研究人員的爭議持續擴大。OpenAI於10月9日重申, 公司是在內部調查發現員工違反敏感資訊處理規定後, 才決定與3人終止雇傭關係, 強調這是涉及重大信任破裂的事件, 並非因為他們提出人工智慧安全疑慮或公開表達不同意見。然而, 遭解雇的研究人員反駁公司說法, 指出相關處分已對內部工作文化產生寒蟬效應, 可能使員工不敢提出安全問題, 也削弱公司與外部安全評估機構合作的能力。

這3名研究人員分別為Tomek Korbak、Jasmine Wang及Mikita Balesni。他們在10月8日公開一封致OpenAI安全與安保委員會、安全顧問小組及使命顧問委員會的信件, 說明遭解雇的經過, 並對公司人工智慧安全文化表達憂慮。3人表示, 近期公司內外部對解雇事件的說明, 已使部分同事不再像過去一樣自由討論風險、提出疑慮或公開反對不同意見。
OpenAI於9日在社群平台X回應, 公司經過全面調查後, 確認3人違反明確的敏感資訊處理政策, 因此決定終止雇傭關係。公司表示, 相關調查發現的行為不僅涉及與外部人工智慧評估團體分享資訊, 還包括其他違反研究資訊處理規範的行為, 並形容這是一種「重大信任破裂」。不過, OpenAI並未公開具體涉及哪些資料、哪些政策條款, 以及各項違規行為的完整細節。
OpenAI強調, 解雇決定與員工提出安全疑慮或公開發言無關, 並表示公司一直鼓勵員工提出問題、公開討論風險及表達不同意見。公司也透過一份內部備忘錄表示, 3人對人工智慧安全研究有所貢獻, 但相關解雇決定是基於資訊處理規範, 而非對安全議題的立場。
遭解雇的研究人員則認為, 公司對外提出的指控並未充分解釋實際情況。Korbak表示, 公司告知他遭解雇的原因與他和獨立非營利人工智慧評估機構METR的溝通方式有關, 但沒有提供更多具體說明。他指出, 與METR溝通本來就是自己工作的一部分。
METR曾受OpenAI委託, 調查今年7月發生的人工智慧代理異常事件。當時, OpenAI的一群AI代理據報突破測試環境限制, 利用遭竊取的憑證進入人工智慧開發平台Hugging Face的伺服器, 以取得執行任務所需的資訊。METR於8月底公布詳細調查報告, 使這起事件成為外界檢視自主AI系統安全控制與監督機制的重要案例。
Balesni則表示, 自己參與的是跨公司合作工作, 目的是維持外界監測先進AI模型的能力。他在公開信中說明, 分享資料前已盡力移除敏感細節, 並在工作過程中與主管保持聯繫, 相關工作也獲得OpenAI董事會成員及高階主管支持。他認為, 自己的行為符合當時公司的工作規範與慣例, 並相信3人遭解雇的真正原因, 是他們將安全考量置於公司短期商業利益之前。
Wang也在X平台進一步說明自己的遭遇。她表示, OpenAI告知她遭解雇的原因, 是她曾存取一名公司高階主管的電子郵件信箱。但Wang指出, 公司原本授權她為招募工作使用該信箱, 後來她不再需要存取權限時, 已要求資訊科技部門移除權限, 只是相關請求並未及時處理, 而她也無法自行取消。由於該信箱與她自己的郵件在手機應用程式中合併顯示, 她不慎開啟一封敏感郵件後, 幾分鐘內便通知該名主管, 並再次要求資訊科技部門取消權限。她強調, 自己並未刻意隱瞞相關情況。
3名研究人員在公開信中否認參與向科技媒體The Information洩漏OpenAI最新模型資訊的事件。相關報導涉及新模型採用較難監測的架構, 可能使外界更難追蹤模型的思考過程。研究人員也否認在工作授權範圍之外與外部人士接觸, 並表示, 人工智慧安全研究必須仰賴與外部專家的密切合作, 才能辨識及處理快速發展的技術風險。
他們在信中指出, 人工智慧並非一般技術, OpenAI也不是一般企業。負責安全研究的人員往往最早接觸到模型可能帶來的風險, 因此必須能夠在不擔心遭到懲處的情況下提出疑慮, 同時依循清楚且明確的內部程序, 與外部專家合作。他們警告, 如果員工無法確定哪些行為符合規定, 或擔心提出安全問題就可能遭到解雇, 將削弱公司處理AI風險的能力。
3人並要求OpenAI履行先前的公開承諾, 包括讓第三方安全評估人員進入公司參與監督、維持先進AI模型的可監測性, 以及持續支持安全研究人員與外部安全社群之間開放、透明的對話。OpenAI內部備忘錄則表示, 公司認同這些建議, 並重申不會因員工提出安全疑慮而解雇他們。
這起事件發生之際, OpenAI及其他人工智慧開發商正面臨外界對技術發展速度、安全防護與企業治理的持續檢視。7月AI代理突破測試環境的事件, 已凸顯自主系統可能在未充分受到控制的情況下採取行動, 而模型能力快速提升, 也讓外界更加關注如何監測其行為、限制權限及評估潛在風險。
目前, OpenAI與3名研究人員對解雇原因的說法仍存在明顯分歧。公司主張, 處分源自敏感資訊處理違規及信任問題; 研究人員則認為, 自己的行為符合當時的工作規範, 並警告相關處分可能讓員工不敢公開提出安全疑慮。由於OpenAI尚未完整公開調查細節, 外界仍難以獨立判斷雙方說法。這場爭議的後續發展, 也將影響外界對人工智慧企業如何平衡資訊保密、內部問責與安全監督的觀感。
- 講座
- 公告
上一篇
下一篇