← 全部模型

GPT 5.6 Luna:Okou 目前支援的推理模型

Okou 目前支援的推理模型,提供內建存取方式。

400K tokens · Text / Vision / Code · Prompt cache

由 OpenAI 提供的推理模型,收錄於 Okou 目前模型目錄。

GPT 5.6 Luna是什麼?

2026年7月預覽版(GPT-5.6家族的經濟檔)

Okou 目前支援 GPT 5.6 Luna,模型 ID 為 gpt-5.6-luna,內建模型相對成本級別為 $。

規格速覽

提供商OpenAI
模型 IDgpt-5.6-luna
模態Text, Code
Okou 價格級別$

GPT 5.6 Luna基準測試

資料來自OpenAI的GPT-5.6預覽材料,對照的是Luna所接替的GPT-5.4 Mini公開數字。所有百分比都只作方向性參考:這一家族仍處於預覽階段,OpenAI也提醒過前沿模型普遍存在SWE-bench Verified資料汙染。

SWE-bench Verified預覽版;經濟檔
約70%
Terminal-Bench 2.0預覽版工具呼叫
約58%
AIME 2025(不使用工具)預覽版競賽數學
約89%
GPQA Diamond預覽版研究生級科學
約80%
OSWorld(計算機操作)預覽版
約62%
MMMU(多模態)預覽版
GPT-5.6家族入門檔
速度中等推理強度,早期估算
約130token/秒

GPT 5.6 Luna價格

內建模型的相對 credits 成本。實際費用取決於用量和設定,最新價格請以產品內顯示為準。

價格級別$

GPT 5.6 Luna最適合的智能體任務

對延遲敏感的對話回覆

面向使用者的助手,響應時間會被直接感知,Luna約130token/秒的速度讓回覆保持利落,同時還能處理工具呼叫和結構化輸出。

Terra和Sol之下的底層

在分層的智能體裡,Luna承擔大量便宜又快的步驟——取資料、做格式化、簡單的工具呼叫——Terra跑日常邏輯,Sol接最難的規劃。分層讓整條流水線的成本壓得住。

先出草稿再打磨的迴圈

讓Luna快速產出初稿——大綱、候選程式碼、摘要——只把真正需要打磨的那些交給Terra或Sol。前沿檔的價格只花在一小部分量上。

常見問題

GPT 5.6 Luna的上下文視窗有多大?

40萬token,每次回覆最多輸出12.8萬token。整個視窗都按標準價格計費。

什麼時候該用Luna而不是Terra?

當速度和成本比推理深度更重要時:大批次分類與資訊抽取、對延遲敏感的對話,以及分層智能體裡那層便宜的底盤。任務一旦需要真正的多步推理或高難度的工具路由,就升到Terra。

在Okou上使用GPT 5.6 Luna

如果工作區已啟用 GPT 5.6 Luna,可在聊天的模型選擇器中選擇它。可用的服務商連線和計費方式請查看模型設定。

積分與$價格檔

內建模型的相對 credits 成本。實際費用取決於用量和設定,最新價格請以產品內顯示為準。

自July 2026 (preview)起在Okou上可用。