← Tous les modèles

GPT 5.6 Luna : modèle de raisonnement actuel sur Okou

Un modèle de raisonnement actuel accessible en Built-in via Okou.

400K tokens · Text / Vision / Code · Prompt cache

Un modèle de raisonnement actuel de OpenAI, disponible dans le catalogue public de Okou.

Qu'est-ce que GPT 5.6 Luna ?

Préversion de juillet 2026 (niveau économique de la famille GPT-5.6)

Okou propose actuellement GPT 5.6 Luna dans son catalogue public de modèle de raisonnement. Sélectionnez-le avec l'identifiant gpt-5.6-luna ; son coût Built-in relatif est de niveau $.

Ce qui distingue GPT 5.6 Luna

Principales caractéristiques d'architecture et de capacités.

GPT 5.6 Luna conserve la fenêtre de contexte de 400K tokens, facturée au tarif d'entrée standard sur l'ensemble de la fenêtre. Il prend en charge le paramètre reasoning_effort, la mise en cache des prompts où l'entrée mise en cache est facturée au dixième du tarif d'entrée (0,02 $ / 1M) plus des frais d'écriture en cache (0,25 $ / 1M), et la surface de l'API Responses que le CLI codex utilise par défaut. L'utilisation d'outils, les sorties structurées et l'utilisation de l'ordinateur correspondent au reste de la famille GPT-5.6. Les entrées sont multimodales : Text, Vision, Code ; il n'y a pas de génération d'images native.

Spécifications en un coup d'œil

FournisseurOpenAI
Identifiant du modèlegpt-5.6-luna
ModalitésText, Code
Niveau de prix Okou$

Benchmarks de GPT 5.6 Luna

Chiffres de préversion issus des documents GPT-5.6 d'OpenAI, présentés face aux chiffres publics de GPT-5.4 Mini auquel Luna succède. Considérez tous les pourcentages comme indicatifs : la famille est en préversion et OpenAI a signalé une contamination de SWE-bench Verified pour l'ensemble des modèles de pointe.

SWE-bench Verifiedpréversion ; niveau économique
~70%
Terminal-Bench 2.0utilisation d'outils en préversion
~58%
AIME 2025 (no tools)mathématiques de compétition en préversion
~89%
GPQA Diamondscience de niveau doctoral en préversion
~80%
OSWorld (computer use)préversion
~62%
MMMU (multimodal)préversion
Entrée de gamme de la famille GPT-5.6
Speedeffort moyen, estimation préliminaire
~130 tokens/sec

Tarification de GPT 5.6 Luna

Coût relatif en crédits Built-in. Le montant dépend de l’utilisation et des réglages ; consultez les tarifs actuels dans l’application.

Niveau de prix$

Meilleures tâches d'agent pour GPT 5.6 Luna

Classification et étiquetage à fort volume

Exécutez Luna sur des milliers de tickets, e-mails ou documents pour étiqueter, aiguiller ou extraire des champs. À 0,20 $ / 1,20 $, le coût par élément reste bas, et l'entrée multimodale couvre les tâches pilotées par captures d'écran et par PDF.

Réponses de chat sensibles à la latence

Pour un assistant destiné aux utilisateurs où le temps de réponse se ressent directement, les ~130 tokens/sec de Luna maintiennent des réponses vives tout en gérant les appels d'outils et les sorties structurées.

La couche de base sous Terra et Sol

Dans un agent stratifié, Luna gère les nombreuses étapes rapides et bon marché — récupération, mise en forme, appels d'outils simples — tandis que Terra exécute la logique au quotidien et que Sol prend la planification la plus difficile. La stratification maintient l'ensemble du pipeline abordable.

Boucles brouillon-puis-affinage

Laissez Luna produire des premiers brouillons rapides — plans, code candidat, résumés — et ne promouvez vers Terra ou Sol que ceux qui nécessitent un peaufinage. Vous payez le tarif de pointe sur une fraction du volume.

Questions fréquentes

Quelle est la fenêtre de contexte de GPT 5.6 Luna ?

400 000 tokens, avec jusqu'à 128K tokens de sortie par réponse. L'ensemble de la fenêtre est facturé au tarif standard.

Quand faut-il utiliser Luna plutôt que Terra ?

Lorsque la vitesse et le coût comptent plus que la profondeur de raisonnement : classification et extraction à fort volume, chat sensible à la latence, et la couche de base bon marché d'un agent stratifié. Passez à Terra dès qu'une tâche nécessite un réel raisonnement en plusieurs étapes ou un routage d'outils difficile.

GPT 5.6 Luna prend-il en charge la mise en cache des prompts ?

Oui. L'entrée mise en cache est facturée à 0,02 $ par 1M de tokens avec des frais d'écriture en cache de 0,25 $ par 1M — la mise en cache la moins chère de la famille. Il vaut la peine de l'activer sur tout agent doté d'un préfixe stable.

Utiliser GPT 5.6 Luna sur Okou

Choisissez GPT 5.6 Luna dans le sélecteur de modèles du chat si votre espace de travail l’a activé. Les connexions aux fournisseurs et la facturation figurent dans les paramètres des modèles.

Crédits et palier tarifaire $

Coût relatif en crédits Built-in. Le montant dépend de l’utilisation et des réglages ; consultez les tarifs actuels dans l’application.

Disponible sur Okou depuis le July 2026 (preview).