全部模型

GPT 5.6 Sol登陸Okou:OpenAI最新的旗艦推理模型

OpenAI GPT-5.6預覽代的旗艦檔。在OpenAI這邊,做智能體程式設計、深度推理和長流程電腦操作,它是最強的選擇。

400K tokens · Text / Vision / Code · Prompt cache

GPT 5.6 Sol是OpenAI GPT-5.6預覽代的頂配檔。當一件事既要深度推理又要可靠的工具呼叫時,你要找的就是它:編排多步驟的智能體流程、必須一次落地的程式碼修改,以及跨越大量介面操作的電腦操作工作流。

GPT 5.6 Sol是什麼?

2026年7月預覽版(GPT-5.6家族的頂配檔) · GPT-5.6家族的旗艦檔,位於GPT 5.6 Terra和GPT 5.6 Luna之上。OpenAI最新的前沿模型,面向智能體程式設計和推理。

GPT-5.6是OpenAI最新的GPT代際,2026年7月推出,它不是單個模型,而是由Sol、Terra、Luna三個檔位組成的家族。Sol是旗艦檔,OpenAI把它定位給最難的智能體程式設計、推理和電腦操作任務。40萬token上下文視窗和reasoning_effort參數從GPT-5.5原樣沿用,所以現有的Codex智能體可以直接換過來,不用重寫。

因為GPT-5.6還是預覽家族,公佈的數字都很早期,之後還會變。OpenAI已指出前沿模型在SWE-bench Verified上存在訓練資料汙染,所以任何絕對分數都只作方向性參考。更耐用的訊號是那些結構性的行為:工具呼叫準確率、電腦操作的可靠性、第一次補丁的質量——預覽資料顯示這三項相比GPT-5.5都在改善。

GPT 5.6 Sol有什麼特別之處

架構與能力上的主要亮點。

GPT 5.6 Sol沿用GPT-5系列的40萬token上下文視窗,整個視窗都按標準輸入價格計費。它支援reasoning_effort參數,支援提示詞快取——快取輸入按輸入價格的十分之一計費(0.50美元/100萬token),另加快取寫入費用(6.25美元/100萬token)——也支援codex CLI預設使用的Responses API介面。工具呼叫、結構化輸出和電腦操作都從GPT-5.5沿用下來。輸入支援文字、視覺和程式碼多模態;沒有原生影像生成能力(請用Images API)。

規格速覽

家族GPT-5.6代(預覽)
模態文字、視覺、程式碼
語言以英文為主,支援多語言
提示詞快取支援(OpenAI)
上下文視窗40萬token
最大輸出最多128K token
推理強度Minimal / Low / Medium / High
服務商標價每100萬token:輸入5美元,輸出30美元

GPT 5.6 Sol基準測試

預覽資料來自OpenAI的GPT 5.6 Sol材料,並與公開的GPT-5.5數字做了對比。所有百分比都只作方向性參考:這個家族還在預覽階段,而且OpenAI已指出前沿模型在SWE-bench Verified上存在訓練資料汙染。

SWE-bench Verified預覽資料;高於5.5的約82%
約84%
Terminal-Bench 2.0預覽資料,工具呼叫
約72%
AIME 2025(不帶工具)預覽資料,競賽數學
約97%
GPQA Diamond預覽資料,研究生級科學
約90%
OSWorld(電腦操作)預覽資料
約77%
MMMU(多模態)預覽資料
在GPT-5.6家族中領先
速度medium強度,早期估算
約每秒70個token

GPT 5.6 Sol價格

服務商標價,按每100萬token計。

輸入$5.00
輸出$30.00
快取讀取$0.50
快取寫入$6.25

GPT 5.6 Sol實際用起來怎麼樣

來自生產環境智能體執行的實際觀察。

工具路由

工具呼叫走錯的比例在GPT-5.6家族裡最低。和GPT-5.5的差距體現在難處理的邊界情況上:按條件選工具、參數巢狀很深,以及在長時間推理之後才發出的工具呼叫。

一次改對程式碼

補丁質量在家族裡最強。當智能體要改的程式碼必須持續編譯透過、測試也不能掛,尤其是改動橫跨多個檔案時,選它最合適。預覽版的SWE-bench Verified成績直接反映了這一點。

電腦操作

在多步驟的介面操作上比GPT-5.5更可靠,OSWorld的分差記錄的就是這件事。當智能體要連著幾十步操作瀏覽器或桌面應用、中途跑偏代價很大時,就用它。

速度

比Terra慢,比Luna慢得多。早期測試中,medium強度下約為每秒70個token。把它留給真正需要額外推理深度的環節,其餘的並行交給更輕的檔位。

幻覺表現

Sol延續了GPT-5系列更嚴格的置信度校準,不確定時傾向於直說,而不是編一個答案。這也是為什麼在更便宜的模型已經在基準測試上追上來之後,團隊在高風險推理上仍然願意多付這筆錢。

GPT 5.6 Sol最適合的智能體任務

統籌多工具計劃的編排者

讓Sol當那個規劃者:把一個訴求拆成十個步驟,每一步派給Terra檔或Luna檔的子智能體,最後再把結果拼回去。只在規劃這一層用Sol,成本只是全程跑它的一小部分,質量卻基本保留。

一次就改對、不白跑CI的程式碼修改

讓Sol把一個50個檔案的程式碼庫從一個ORM遷到另一個、重構一個纏成一團的模組,或者在整個倉庫裡打上同一個安全補丁。補丁第一次就乾淨應用的機率高於家族裡任何其他檔位——你的CI帳單反映的正是這件事。

必須把流程走完的電腦操作智能體

當智能體要驅動瀏覽器走完一套多步驟預訂流程、操作桌面應用或老舊的後臺介面時,Sol更高的OSWorld分數意味著中途跑偏更少,需要人接手的次數也更少。

硬數學或硬科學的研究環節

丟進一套競賽級數學題或一段研究生物理推導,Sol能一路做下來,不會出現輕量檔位上常見的差一步失誤。AIME 2025和GPQA Diamond考的正是這種表現。

什麼時候不該用GPT 5.6 Sol

這幾類場景別用Sol:高頻的常規工作,GPT 5.6 Terra用一半的積分成本就能達到同樣的質量標準;對延遲敏感的聊天回覆,GPT 5.6 Luna快得多;批次分類或資訊抽取,Luna是更便宜的可選項。

GPT 5.6 Sol與其他模型對比

GPT 5.6 Sol對比GPT 5.6 Terra

Terra是GPT-5.6家族裡均衡的主力,多數智能體選它就對。只有當Terra在高難度推理、長時間智能體執行或一次改對程式碼上明顯不行時,才升級到Sol——通常是讓它當編排者,往下把活派給Terra和Luna。

GPT 5.6 Sol對比GPT-5.5

定位相同,代際更新。Sol是GPT-5.5的預覽版繼任者,標價和積分檔位一樣,在智能體程式設計和電腦操作上的預覽分數更高。在GPT-5.6走出預覽之前,Okou上預設的OpenAI模型仍然是GPT-5.5;想要最新的推理深度時再選Sol。

GPT 5.6 Sol對比Claude Opus 4.8

兩個不同家族裡的同級旗艦:當便宜檔位頂不住時,你升級過去承擔高風險編排的那一個。Opus 4.8有100萬token上下文視窗和Anthropic的安全特性;Sol有Codex生態和OpenAI的電腦操作分數。按你現有智能體面向哪個框架來選。

結論:你該用GPT 5.6 Sol嗎?

GPT 5.6 Sol是OpenAI這邊最新的升級檔。預設用Terra,只在Terra明顯不夠用的那幾個具體環節升到Sol,同時要預料到預覽分數還會繼續變。

常見問題

GPT 5.6 Sol的上下文視窗有多大?

40萬token,每次回覆最多輸出128K token。整個視窗都按標準費率計費。

GPT-5.6在Okou上正式可用了嗎?

還在預覽階段。Sol、Terra、Luna三個檔位都可以選,但在GPT-5.6家族走出預覽之前,預設的OpenAI模型仍然是GPT-5.5。預覽階段的基準測試數字都很早期,之後還會變。

什麼時候該選Sol而不是GPT 5.6 Terra?

三種情況:(a)這個智能體是規劃者,它的判斷會一層層傳下去;(b)單次執行足夠長,Terra已經開始把工具呼叫走錯;(c)輸出必須一次就能幹淨用上,比如程式碼修改、結構化資料和電腦操作工作流。

GPT 5.6 Sol支援提示詞快取嗎?

支援。快取輸入按0.50美元/100萬token計費,快取部分相當於打了一折,另加6.25美元/100萬token的快取寫入費用。只要你的系統提示詞或工具定義在多次呼叫之間保持不變,就值得用。

GPT 5.6 Sol在Okou上用的是哪個框架?

Codex。Okou把GPT-5.6路由到Codex框架的Responses API介面,也就是codex CLI預設使用的那一套。在Okou上,Claude Code框架的智能體與GPT-5系列模型不相容。

替代選擇

在Okou上使用GPT 5.6 Sol

在Okou上使用GPT 5.6 Sol的兩種方式

Okou既支援把GPT 5.6 Sol作為Built-in模型使用、按Okou積分計費,也支援你用OpenAI API key自帶金鑰接入。Built-in這條路走的是Okou Managed路由和下文說明的價格檔;自帶金鑰這條路由上游服務商直接向你收費,完全跳過Okou的積分換算。

Okou的建議

Okou把GPT 5.6 Sol定位為核心智能體模型,用於編排、涉及程式碼的工作,以及其他一旦答錯代價很高的環節。

積分與$$$價格檔

Okou給每個Built-in模型都定了四檔積分價格——$$$$$$$$$$——它會作為標記出現在模型選擇器裡,也出現在zero model lsprice tier那一行。GPT 5.6 Sol屬於$$$。這一檔決定你從Okou積分餘額里扣掉多少;上表裡的服務商標價,則是上游服務商在Okou把它換算成積分之前收取的費用。

自July 2026 (preview)起在Okou上可用。