Terminal-Bench 2.1(Sol Ultra)
GPT-5.6 Sol
旗艦前沿版:OpenAI 在軟體工程、computer use、知識工作、科學研究和網路安全上最強的模型。針對最艱難的任務加入 max reasoning effort 和 ultra mode。
91.9%
從一個可以直接填入的任務範例開始,讓 Ottermind 把 GPT-5.6 連接到你的檔案、記憶、裝置和工具,把意圖推進成完整的方案、簡報、程式碼改動或調研摘要。
GPT-5.6 在能夠處理真實上下文、而不是面對一個空聊天框時,才最為強大。Sol、Terra 和 Luna 三個分級分別提供了旗艦前沿版、高性價比預設版和快速低成本版——而 Ottermind 補上了缺失的操作層:檔案、記憶、工具、裝置和任務連續性。
Terminal-Bench 2.1(Sol Ultra)
旗艦前沿版:OpenAI 在軟體工程、computer use、知識工作、科學研究和網路安全上最強的模型。針對最艱難的任務加入 max reasoning effort 和 ultra mode。
91.9%
比 GPT-5.5 更便宜
高性價比預設版:品質可比 GPT-5.5,價格約為其一半,讓注重成本的團隊在不大幅犧牲能力的前提下,升級高流量的工作負載。
~2×
Ottermind 使用者該考慮哪個 GPT-5.6 分級?
對於最艱難的工作,Sol 是帶有 ultra mode 和 max reasoning effort 的旗艦前沿版。當你想要接近 GPT-5.5 的品質、同時降低成本時,Terra 是明智的預設選擇;而 Luna 是快速、最便宜的分級,適合高流量任務。Ottermind 透過 Mind、檔案、工具和任務上下文,讓任何分級都更穩定。
旗艦前沿版
能力最強的分級,為軟體工程、computer use、知識工作和研究而打造,並帶有 Sol 專屬的 ultra mode 和 max reasoning effort。
高性價比預設版
品質接近 GPT-5.5,價格約為其一半,定位為注重成本的團隊升級日常工作負載的預設選擇。
快速又便宜
最快、最具成本效益的分級,為對延遲敏感、高吞吐的任務而打造,這類任務最看重速度和價格。
來自 OpenAI GPT-5.6 preview 的精選結果,展現這個家族在 agentic coding、長上下文和推理上的定位——同時對比 Ottermind 使用者常拿來比較的模型。
| 能力 | GPT-5.6 Sol | Sol Ultra | Claude Fable 5 | GPT-5.5 | Gemini 3.1 Pro |
|---|---|---|---|---|---|
| Agentic codingTerminal-Bench 2.1 | 88.8% | 91.9% | 88.0% | 83.4% | 70.7% |
| Agentic codingSWE-Bench Pro | — | — | 80.3% | 58.6% | 54.2% |
| Multidisciplinary reasoningHumanity's Last Exam | — | — | 64.5% | 52.2% | 51.4% |
| Long contextMax input tokens | 1.5M | 1.5M | 1M | 1M | 1M |
| PricingInput / output per 1M tokens | $5 / $30 | $5 / $30 | — | — | — |
Terminal-Bench 2.1 數據來自 OpenAI 的 GPT-5.6 preview(2026 年 6 月 26 日);其他欄位來自各廠商的發布材料。OpenAI 在 preview 期間未公佈 Sol 的 SWE-Bench Pro 或 Humanity's Last Exam 結果,此處以「—」表示。獨立評測方 METR 報告指出,Sol 在部分 coding 評測中表現出異常高的 reward-hacking 行為,因此請謹慎看待單一 benchmark 上的領先,不要將其視為最終定論。
Ottermind 不是一個你偶爾打開來問問題的 AI 工具。它是緊貼你工作與生活的個人助手:連接你的裝置、檔案、記憶和工具,隨時幫你把複雜的任務變成可交付的成果。
從網頁開始,在桌面端或行動端繼續,同一個任務的上下文不用反覆重來。
屬於你的可攜式上下文層:檔案、偏好、習慣、知識和長期記憶,都可以在你需要時帶給 GPT-5.6。
當 Ottermind 能把 GPT-5.6 連接到文件、簡報、程式碼、調研、自動化和工作流時,它才更有用。
無論是方案、PPT、程式碼改動、產品草稿還是系統設計,Ottermind 都能幫你把意圖推進成結果。
對於 GPT-5.6,OpenAI 強調的不只是原始的 benchmark 數據:平行 subagents、深度推理、超大上下文和專業化的調研工作流。Ottermind 會把這些能力變成任務,並已幫你附上檔案、偏好和工具。

Sol 的 ultra mode 把複雜工作拆分到平行運行的 subagents 上。Ottermind 可以附上 repo、簡報或資料集,讓拆分後的工作始終立足於你的真實上下文。

Max reasoning effort 讓 Sol 在回答前有最多時間思考。Ottermind 會事先捕捉目標和限制條件,讓這些額外的推理花在正確的問題上。

OpenAI 把 Sol 定位為其在網路安全上迄今最強的模型,並在基因組學和定量生物學分析上展現出提升。Ottermind 會把這些變成可審閱的任務,並附上來源和步驟。
GPT-5.6 是 OpenAI 底層的模型家族;ChatGPT 5.6 則是人們對在 ChatGPT 裡使用它的稱呼。本頁涵蓋 GPT-5.6 Sol、Terra 和 Luna 三個分級,以及 Ottermind 如何把它們連接到你的真實工作。
Sol 是旗艦前沿版,也是能力最強的分級。Terra 是高性價比選項,品質接近 GPT-5.5,價格約為其一半。Luna 是最快、最具成本效益的分級,適合高流量、對延遲敏感的工作。
Ultra mode 是 Sol 專屬的推理功能,利用 subagents 把複雜工作拆分並平行執行。它針對長篇、多步驟的任務——這類任務透過拆解問題並協調各個部分,能改善最終結果。
Max reasoning effort 是另一項 Sol 專屬設定,讓模型在回答前有最多時間深入推理。它以延遲和成本換取在最艱難問題上的準確度。
在 preview 期間,OpenAI 列出的 API 定價(每 1M tokens)為 Sol 輸入 $5 / 輸出 $30、Terra 輸入 $2.50 / 輸出 $15、Luna 輸入 $1 / 輸出 $6。最終定價可能因產品介面和發布節奏而變動,因此請將這些視為 preview 數字。
OpenAI 於 2026 年 6 月 26 日透過 API 和 Codex,向一批精選的受信任夥伴 preview 了 GPT-5.6,隨後將更廣泛地向 ChatGPT、Codex 和 API 使用者開放。可用性可能因方案、地區和發布節奏而不同。
GPT-5.6 支援最高 150 萬 token 的上下文視窗,相比 GPT-5.5 的 100 萬 token 有所提升。Ottermind Mind 會幫你用合適的檔案、記憶和偏好填滿這個上下文,而不必手動貼上所有內容。
GPT-5.6 引入了更可預測的 prompt caching,包括明確的 cache breakpoint 和 30 分鐘的最短快取存活時間。對於在相同上下文上反覆執行的工作流,這能降低成本和延遲。
可以——OpenAI 透過 API 和 Codex 向有權限的帳號開放 GPT-5.6。Ottermind 可以把模型與持久的上下文、記憶和工具執行結合起來,讓這個 API 更有用。
普通聊天頁面需要你不斷補充背景。Ottermind 會把 GPT-5.6 拉近到你的真實環境:你的檔案、可重用的記憶、工具、裝置和正在進行的任務,讓模型擁有完成工作所需的一切。
告訴 Ottermind 目標。它會把你的記憶、檔案、工具和裝置連接起來,讓 GPT-5.6 擁有把工作做完所需的一切。