鉅亨網編譯余曉惠
OpenAI周一(21日)公布一套針對尖端人工智慧(AI)開發安全與防護的建議,重點放在「對齊研究」(alignment research),以及一項稱為「遞迴自我改進」(recursive self-improvement, RSI)的運算技術。
OpenAI在部落格文章中表示:「要安全的因應這項轉變,需要讓對齊研究跟上這些能力的發展速度,確保我們及其他業者開發的系統,持續與人類價值觀一致,並受到人類控制。」
OpenAI呼籲各國展開國際合作,共同制定先進AI標準,並建議在全球現有AI安全研究機構的工作基礎上進一步發展。
OpenAI表示,這些技術標準應聚焦於前沿AI模型與開發商,以及對自動化AI研究人員進行利益與風險管理,包括RSI。
RSI受到AI開發商關注,因其具有打造基礎模型的潛力,讓AI系統能夠在沒有人工介入的情況下自行升級。
但RSI領域的進展也引發部分科技人士的疑慮,擔心模型開發商可能失去對根本技術的控制,或無法充分考量AI系統日益複雜、並廣泛存在於網際網路後,可能產生的非預期後果。
OpenAI在部落格文章中表示:「完全自主的RSI目前尚未實現,我們不應追求這項技術,除非且直到它能夠以安全的方式實現。如果沒有適當的重視與謹慎,RSI可能導致人類失去對AI開發的實際控制,甚至無法對自己已無法理解的研究流程進行監督。」
OpenAI的文章也提到Hugging Face遭AI代理程式駭入的事件。該事件並未涉及RSI技術,但OpenAI認為,這可視為未來若缺乏強健防護措施與對齊機制時,相關風險可能大幅加劇的預演。
競爭對手Anthropic上周也提出前沿AI模型安全開發的相關構想,回應近期業界研究人員接連對AI可能威脅人類的警告。
曾任職於Anthropic與OpenAI的Jacob Coxon在約兩周前宣布辭職,他當時表示,這些公司正在「拿我們的生命下注」,當時引發全球熱烈討論。在近期一連串與AI相關的資安事件,以及Coxon公開發表看法後,Anthropic執行長阿莫戴(Dario Amodei)發表文章,呼籲AI公司放慢基礎模型開發速度,並提出其他安全措施。
阿莫戴也提出讓第三方評估機構進駐AI公司的構想,以審查並降低相關技術可能對社會造成的風險,例如加速資安駭客攻擊,或協助製造生物武器。
OpenAI執行長奧特曼(Sam Altman),以及SpaceX(SPCX-US)執行長馬斯克等競爭對手陣營的領導人,也公開支持阿莫戴的提議。
不過,由於AI評估領域仍處於非常早期的階段,目前尚未形成統一共識,也沒有無一套基本標準與原則,能讓獨立第三方比目前更深入地檢視。
這也是AI評估機構聯盟呼籲基礎模型開發商考慮一套「最低條件」的部分原因,目的是讓評估機構能更深入執行技術稽核與檢查,包括取得更深層的系統存取權,以及避免因發布不利報告而遭報復。
上一篇
下一篇
