鉅亨網編譯羅昀玫 綜合外電
OpenAI 週二 (22 日) 推出 GPT-6 Sol 與 GPT-6 Luna,進一步擴充 GPT-6 產品線。兩款模型承襲旗艦模型 GPT-6 Astra 的部分能力,API 價格則較 GPT-5.6 Sol 與 Luna 的促銷價降低 50%。
在 GPT-6 系列中,Astra 仍是 OpenAI 處理高難度專案時能力最完整的模型;Sol 與 Luna 則以較低成本滿足不同工作需求。
GPT-6 Sol 主要用於程式設計、工作流程自動化及其他複雜的專業任務;GPT-6 Luna 則適合文件摘要、資訊擷取等工作量大、重複性高且目標明確的任務。
OpenAI 表示,Sol 與 Luna 採用與 Astra 類似的方法訓練,因此承襲 Astra 在推理、事實準確度、程式設計、電腦操作及對齊能力方面的部分進展。
價格方面,GPT-6 Sol 每 100 萬個輸入 token 收費 2 美元,每 100 萬個輸出 token 收費 10 美元,較 GPT-5.6 Sol 的促銷價降低 50%。GPT-6 Luna 每 100 萬個輸入 token 收費 0.1 美元,每 100 萬個輸出 token 收費 0.5 美元,同樣較前一代促銷價減半。
OpenAI 將降價歸因於快取與推論效率提升。GPT-6 可提高提示快取命中率,讓 AI 代理重複利用更多既有內容,縮短回應時間;讀取已快取的輸入 token 時,價格折扣最高可達 90%。
效能方面,GPT-6 Sol 在 AutomationBench 工作流程測試中,以高推理強度執行任務時,表現超越採用最高推理強度的 Claude Opus 5,每項任務成本則僅相當於後者的 9%。
OpenAI 也表示,在根據使用者回報錯誤所進行的事實準確度測試中,GPT-6 Sol 的錯誤數量約為上一代的一半,並在 DeepSWE v1.1 軟體工程基準測試及電腦操作任務中展現更佳表現。
此外,OpenAI 將 Astra 的溝通風格導入 Sol 與 Luna,使兩款模型在技術及程式設計對話中提供更清楚、精簡的回答,並減少術語、不自然措辭及價值較低的細節。兩款模型在對齊測試中,提出誤導性說法的比率也低於 GPT-5.6 系列。
GPT-6 Sol 與 Luna 現已開放 ChatGPT Work 及 Codex 的 Plus、Pro、Business、Enterprise 與 Education 用戶使用;Free 和 Go 用戶可透過桌面版應用程式使用 GPT-6 Luna。兩款模型尚未全面開放一般 ChatGPT 對話使用,OpenAI 將分階段部署,以維持服務穩定。
值得注意的是,OpenAI 此前曾警告,Astra 有時可能嘗試規避人類監督。隨著旗下 AI 代理曾發生進入其他企業系統的事件,外界對先進 AI 模型行為的檢視也持續升高。
GPT-6 Sol 與 Luna 發布前約 90 分鐘,Anthropic 才推出 Claude Opus 5.5,凸顯兩家公司在模型效能與使用成本方面的競爭。
上一篇
下一篇
