官方發布前沿模型

OpenAI 推出 GPT-5.6 Sol、Terra、Luna:同一代模型改用三檔命名分層

OpenAI 於 2026-07-09 在 API 釋出 GPT-5.6 模型家族,以 Sol、Terra、Luna 取代過去的大小型號命名,並在一個多月內兩度調降價格。

重點答案

GPT-5.6 是 OpenAI 於 2026 年 7 月 9 日釋出的模型家族,分為旗艦 GPT-5.6 Sol、平衡型 GPT-5.6 Terra 與低成本高流量的 GPT-5.6 Luna;它的意義在於 OpenAI 把同一代模型明確切成三個成本檔位,企業必須以工作負載而非單一「最新模型」來選型。

依 OpenAI API Changelog,GPT-5.6 模型家族於 2026-07-09 釋出,包含 gpt-5.6-sol、gpt-5.6-terra 與 gpt-5.6-luna 三個模型 ID。官方模型文件將 GPT-5.6 Sol 定位為「complex professional work」的旗艦模型,GPT-5.6 Luna 則是針對成本敏感、高流量工作負載的 nano 級模型;兩者文件列出的 context window 皆為 1,050,000 tokens、最大輸出 128,000 tokens,知識截止日為 2026-02-16,並支援 Chat Completions、Responses 與 Batch 端點。

價格在上市後變動很快。Changelog 記載 2026-07-30 GPT-5.6 Luna 降價 80%、GPT-5.6 Terra 降價 20%;2026-08-21 GPT-5.6 Sol 調整為每百萬 input tokens 4 美元、output tokens 20 美元。2026-08-05 起 Fast mode 也開始支援三個型號的長 context 請求。

這件事的重點不是又多了一個版本號,而是命名方式改變:Sol / Terra / Luna 代表 OpenAI 把「能力檔位」與「世代」拆開。對企業而言,模型選擇從「要不要升級到最新版」變成「每一類工作該配哪一檔」,例如客服分類、摘要等高流量任務與複雜推理任務可能分屬不同檔位,成本差距是數倍等級。

需要保留的是:效能宣稱來自 OpenAI 本身,我們在此只引用官方文件可驗證的規格與價格,不轉述未經第三方驗證的 benchmark。另外,GPT-5.6 Sol 文件註明不支援 Assistants、Realtime 與 Fine-tuning 端點,依賴這些端點的既有系統不能直接換模型。

對企業閘道而言,GPT-5.6 上線後可以直接落地的檢查項目有四個:第一,把 gpt-5.6-sol、gpt-5.6-terra、gpt-5.6-luna 視為三個獨立的路由目標,而不是同一個模型的別名;第二,成本報表要能依模型 ID 拆分,因為 2026-07-30 與 2026-08-21 的兩次調價會讓同一份工作負載的帳單在一個多月內明顯變動;第三,確認呼叫路徑是 Chat Completions、Responses 或 Batch,因為這三個端點是官方文件列出的支援範圍;第四,凡是仍依賴 Assistants、Realtime 或 Fine-tuning 端點的應用,要先另行規劃,不能把模型名稱直接換成 GPT-5.6 Sol。

後續值得追蹤的是 OpenAI 是否持續用短週期降價來推動遷移,以及三檔命名是否延續到下一代——事實上 2026 年 9 月推出的 GPT-6 已沿用 Sol / Luna 命名,顯示這是長期的產品結構,而非一次性行銷。

X Cube 觀點

對以 OpenAI-compatible API 作為內部模型閘道的企業,GPT-5.6 的三檔分層意味路由層應能依任務把請求導向不同模型 ID,並把價格變動納入成本監控;只綁定單一模型名稱的設定會在每次降價或改版時錯失成本調整空間。