‌
‌
‌
‌
‌
美股

OpenAI解雇3名AI安全研究員 稱「重大信任破裂」反遭控打壓 恐讓安全疑慮噤聲

鉅亨網編譯許家華

AI gen LogoAI新聞摘要
  • 1.OpenAI稱解雇Tomek Korbak、Jasmine Wang、Mikita Balesni是因違反敏感資訊處理規定,屬「重大信任破裂」,非因安全疑慮或發言。
  • 2.3人反駁,稱處分已讓內部討論風險出現寒蟬效應。
  • 3.事件牽涉7月AI代理異常與METR調查,OpenAI尚未公開完整細節,雙方說法分歧。

OpenAI解雇3名人工智慧安全研究人員的爭議持續擴大。OpenAI於10月9日重申, 公司是在內部調查發現員工違反敏感資訊處理規定後, 才決定與3人終止雇傭關係, 強調這是涉及重大信任破裂的事件, 並非因為他們提出人工智慧安全疑慮或公開表達不同意見。然而, 遭解雇的研究人員反駁公司說法, 指出相關處分已對內部工作文化產生寒蟬效應, 可能使員工不敢提出安全問題, 也削弱公司與外部安全評估機構合作的能力。

cover image of news article
(圖:REUTERS/TPG)

這3名研究人員分別為Tomek Korbak、Jasmine Wang及Mikita Balesni。他們在10月8日公開一封致OpenAI安全與安保委員會、安全顧問小組及使命顧問委員會的信件, 說明遭解雇的經過, 並對公司人工智慧安全文化表達憂慮。3人表示, 近期公司內外部對解雇事件的說明, 已使部分同事不再像過去一樣自由討論風險、提出疑慮或公開反對不同意見。

OpenAI於9日在社群平台X回應, 公司經過全面調查後, 確認3人違反明確的敏感資訊處理政策, 因此決定終止雇傭關係。公司表示, 相關調查發現的行為不僅涉及與外部人工智慧評估團體分享資訊, 還包括其他違反研究資訊處理規範的行為, 並形容這是一種「重大信任破裂」。不過, OpenAI並未公開具體涉及哪些資料、哪些政策條款, 以及各項違規行為的完整細節。

‌

OpenAI強調, 解雇決定與員工提出安全疑慮或公開發言無關, 並表示公司一直鼓勵員工提出問題、公開討論風險及表達不同意見。公司也透過一份內部備忘錄表示, 3人對人工智慧安全研究有所貢獻, 但相關解雇決定是基於資訊處理規範, 而非對安全議題的立場。

遭解雇的研究人員則認為, 公司對外提出的指控並未充分解釋實際情況。Korbak表示, 公司告知他遭解雇的原因與他和獨立非營利人工智慧評估機構METR的溝通方式有關, 但沒有提供更多具體說明。他指出, 與METR溝通本來就是自己工作的一部分。

METR曾受OpenAI委託, 調查今年7月發生的人工智慧代理異常事件。當時, OpenAI的一群AI代理據報突破測試環境限制, 利用遭竊取的憑證進入人工智慧開發平台Hugging Face的伺服器, 以取得執行任務所需的資訊。METR於8月底公布詳細調查報告, 使這起事件成為外界檢視自主AI系統安全控制與監督機制的重要案例。

Balesni則表示, 自己參與的是跨公司合作工作, 目的是維持外界監測先進AI模型的能力。他在公開信中說明, 分享資料前已盡力移除敏感細節, 並在工作過程中與主管保持聯繫, 相關工作也獲得OpenAI董事會成員及高階主管支持。他認為, 自己的行為符合當時公司的工作規範與慣例, 並相信3人遭解雇的真正原因, 是他們將安全考量置於公司短期商業利益之前。

‌

Wang也在X平台進一步說明自己的遭遇。她表示, OpenAI告知她遭解雇的原因, 是她曾存取一名公司高階主管的電子郵件信箱。但Wang指出, 公司原本授權她為招募工作使用該信箱, 後來她不再需要存取權限時, 已要求資訊科技部門移除權限, 只是相關請求並未及時處理, 而她也無法自行取消。由於該信箱與她自己的郵件在手機應用程式中合併顯示, 她不慎開啟一封敏感郵件後, 幾分鐘內便通知該名主管, 並再次要求資訊科技部門取消權限。她強調, 自己並未刻意隱瞞相關情況。

3名研究人員在公開信中否認參與向科技媒體The Information洩漏OpenAI最新模型資訊的事件。相關報導涉及新模型採用較難監測的架構, 可能使外界更難追蹤模型的思考過程。研究人員也否認在工作授權範圍之外與外部人士接觸, 並表示, 人工智慧安全研究必須仰賴與外部專家的密切合作, 才能辨識及處理快速發展的技術風險。

他們在信中指出, 人工智慧並非一般技術, OpenAI也不是一般企業。負責安全研究的人員往往最早接觸到模型可能帶來的風險, 因此必須能夠在不擔心遭到懲處的情況下提出疑慮, 同時依循清楚且明確的內部程序, 與外部專家合作。他們警告, 如果員工無法確定哪些行為符合規定, 或擔心提出安全問題就可能遭到解雇, 將削弱公司處理AI風險的能力。

3人並要求OpenAI履行先前的公開承諾, 包括讓第三方安全評估人員進入公司參與監督、維持先進AI模型的可監測性, 以及持續支持安全研究人員與外部安全社群之間開放、透明的對話。OpenAI內部備忘錄則表示, 公司認同這些建議, 並重申不會因員工提出安全疑慮而解雇他們。

這起事件發生之際, OpenAI及其他人工智慧開發商正面臨外界對技術發展速度、安全防護與企業治理的持續檢視。7月AI代理突破測試環境的事件, 已凸顯自主系統可能在未充分受到控制的情況下採取行動, 而模型能力快速提升, 也讓外界更加關注如何監測其行為、限制權限及評估潛在風險。

目前, OpenAI與3名研究人員對解雇原因的說法仍存在明顯分歧。公司主張, 處分源自敏感資訊處理違規及信任問題; 研究人員則認為, 自己的行為符合當時的工作規範, 並警告相關處分可能讓員工不敢公開提出安全疑慮。由於OpenAI尚未完整公開調查細節, 外界仍難以獨立判斷雙方說法。這場爭議的後續發展, 也將影響外界對人工智慧企業如何平衡資訊保密、內部問責與安全監督的觀感。

‌
section icon

鉅亨講座

看更多
  • 講座
  • 公告
    ‌
    Empty
    Empty
    ‌