← Alla modeller

GPT 5.6 Luna: aktuell resonemangsmodell på Okou

En aktuell resonemangsmodell med inbyggd åtkomst via Okou.

400K tokens · Text / Vision / Code · Prompt cache

En aktuell resonemangsmodell från OpenAI, tillgänglig i Okou:s offentliga modellkatalog.

Vad är GPT 5.6 Luna?

Juli 2026 förhandsvisning (ekonomisk nivå av GPT-5.6-familjen)

Okou erbjuder för närvarande GPT 5.6 Luna i sin offentliga katalog över resonemangsmodeller. Välj den med modell-ID gpt-5.6-luna; dess relativa inbyggda kostnad är nivå $.

Vad är anmärkningsvärt med GPT 5.6 Luna

Rubrikarkitektur och funktionsfunktioner.

GPT 5.6 Luna behåller 400K-token kontextfönstret, fakturerat till standardinmatningspriser över hela fönstret. Den stöder reasoning_effort-parametern, promptcaching där cachad inmatning faktureras till en tiondel av inmatningspriset (0,02 USD / 1M) plus en cache-skrivningsavgift (0,25 USD / 1M), och Responses API-ytan som codex CLI använder som standard. Verktygsanvändning, strukturerade utdata och datoranvändning matchar resten av GPT-5.6-familjen. Indata är multimodala över text, vision och kod; det finns ingen inbyggd bildgenerering.

Specifikationer i korthet

LeverantörOpenAI
Modell-IDgpt-5.6-luna
ModaliteterText, Code
Okou prisnivå$

GPT 5.6 Luna benchmarks

Förhandsgranskningssiffror från OpenAI:s GPT-5.6-material, visade mot de offentliga GPT-5.4 Mini-siffrorna som Luna lyckas med. Behandla alla procentsatser som riktningsgivande: familjen är i förhandsgranskning och OpenAI har flaggat SWE-bench Verified-kontamination över gränsmodeller.

SWE-bench Verifieradförhandsvisning; ekonominivå
~70%
Terminal-Bench 2.0förhandsgranska verktygsanvändning
~58%
AIME 2025 (inga verktyg)förhandsgranska tävlingsmatematik
~89%
GPQA Diamondförhandsgranska forskarvetenskap
~80%
OSWorld (datoranvändning)förhandsgranska
~62%
MMMU (multimodal)förhandsgranska
Entry GPT-5.6-familjen
Hastighetmedelstor ansträngning, tidig uppskattning
~130 tokens/sek

GPT 5.6 Luna prissättning

Relativ kreditkostnad för inbyggda modeller. Den faktiska kostnaden beror på användning och inställningar; se aktuella priser i appen.

Prisnivå$

Bästa agentuppgifter för GPT 5.6 Luna

Latenskänsliga chattrepliker

För en användarorienterad assistent där svarstiden känns direkt, håller Lunas ~130 tokens/sek svar snabba samtidigt som den hanterar verktygsanrop och strukturerade utdata.

Grundlagret under Terra och Sol

I en skiktad agent hanterar Luna de många billiga, snabba stegen – hämtning, formatering, enkla verktygsanrop – medan Terra kör den vardagliga logiken och Sol tar den svåraste planeringen. Skiktningen håller hela pipelinen prisvärd.

Utkast-sedan-förfina-loopar

Låt Luna producera snabba första utkast – dispositioner, kandidatkod, sammanfattningar – och befordra endast de som behöver putsas till Terra eller Sol. Du betalar gränspriset för en bråkdel av volymen.

Vanliga frågor

Vad är GPT 5.6 Lunas kontextfönster?

400 000 tokens, med upp till 128K tokens utdata per svar. Hela fönstret faktureras till standardpriser.

När ska jag använda Luna istället för Terra?

När hastighet och kostnad är viktigare än resonemangsdjup: högvolymklassificering och extraktion, latenskänslig chatt och det billiga baslagret i en skiktad agent. Gå upp till Terra i samma ögonblick som en uppgift kräver verkligt flerstegsresonemang eller hård verktygsdirigering.

Stöder GPT 5.6 Luna prompt-caching?

Ja. Cachelagrad inmatning debiteras med 0,02 USD per 1 miljon tokens med en cache-skrivningsavgift på 0,25 USD per 1 miljon – den billigaste cachelagringen i familjen. Värt att aktivera på alla agenter med ett stabilt prefix.

Använder GPT 5.6 Luna på Okou

Välj GPT 5.6 Luna i chattens modellväljare om modellen är aktiverad för arbetsytan. Leverantörsanslutningar och fakturering visas i modellinställningarna.

Krediter och $ prisnivå

Relativ kreditkostnad för inbyggda modeller. Den faktiska kostnaden beror på användning och inställningar; se aktuella priser i appen.

Tillgänglig på Okou sedan July 2026 (preview).