在預覽最新GPT-5.6模型系列近二周後,OpenAI獲得美國政府許可,周五(7/10)宣布將GPT-5.6旗艦模型Sol及Terra、Luna模型全面推上線,包括合作的GitHub與Microsoft 365 Copilot助理。
GPT-5.6號稱能兼顧智能和運作效率,在程式撰寫、知識工作、生命科學及網路安全領域都達到領先(state-of-the-art)等級,在不同領域超越前代模型,或Google Gemini與Anthropic Claude Mythos。OpenAI還新增ultra模式,可運用多個子代理人加速複雜任務的進行。
超越Claude Fable 5
OpenAI說,Sol具備強大電腦使用及設計判斷能力,是最精良的協同者,可監控代理人執行成果、加以改善、並提供給使用者。根據OpenAI提供的數據,在長程專業工作流程標竿測試Agent’s Last Exam適應性推論項目中,Sol以53.6%超越Anthropic最強的Claude Fable 5 13.1%。此外OpenAI強調GPT-5.6眾模型推理成本也都低於Fable 5。而在涵括工作、程式、科學推理及一般能力上,Sol最強推理差對手不到1分,但時間及成本分別少了61%及一半。
部署
GPT-5.6將在24小時內陸續部署給免費及付費用戶,但享有不同等級功能。免費層級用戶可在ChatGPT新推的Work與Codex存取GPT-5.6 Terra,也可以手動開啟「max」選項,提升Terra的推理能力。但這二方案皆無法在ChatGPT的標準對話中使用最高階的Sol系列旗艦模型。
對付費方案Plus、Pro方案用戶而言,新模型即日起隨全球陸續上線。標準ChatGPT對話方面,Plus與Pro用戶可以透過調整推理投入(Effort)設定調用Sol。模型選擇器中會顯示為Medium(標準)、High(延伸)和Extra High(最高)。系統預設日常回覆仍會使用GPT-5.5 Instant,但若遇到複雜任務,ChatGPT的智慧切換功能會自動切換至GPT-5.6 Sol (Medium)來進行深度思考。
ChatGPT Work與Codex工作區方面,Plus與Pro用戶擁有完整選擇權,可任意在Sol、Terra、Luna三個模型之間切換、自由調整推理Effort等級,並可開啟max推理設定。付費用戶(Plus/Pro)於Codex程式開發環境可直接開啟ultra推理等級進行高階自動化編碼。
最高階的Pro方案及Enterprise用戶享有直接選用GPT-5.6 Sol Pro模型的權利,可用於處理極度困難的跨領域任務、高難度程式編碼、資安弱點分析及長時間運行的自動化工作流(Longer-running workflows)。Pro/Enterprise用戶除了在Codex中,也可於ChatGPT Work額外解鎖ultra推理等級,進一步存取模型的思考能力。(其餘Plus等個人方案在Work中僅能使用max)
GitHub Copilot、M365 Copilot
GPT-5.6同時也在GitHub Copilot及Microsoft 365 (M365)Copilot上線。GitHub開發者用戶可在Visual Studio Code、Visual Studio、Copilot CLI、GitHub Copilot cloud agent、GitHub Copilot App、github.com、GitHub iOS與Android App、JetBrains、Xcode、Eclipse的模型選擇器中選用新模型。GPT-5.6也成為M365應用包括Word、Excel、PowerPoint、Chat和Cowork的優先使用模型。
Comments (0)