← 全部模型

GPT 5.6 Luna:Okou 当前支持的推理模型

Okou 当前支持的推理模型,提供内置访问方式。

400K tokens · Text / Vision / Code · Prompt cache

由 OpenAI 提供的推理模型,收录于 Okou 当前模型目录。

GPT 5.6 Luna是什么?

2026年7月预览版(GPT-5.6家族的经济档)

Okou 当前支持 GPT 5.6 Luna,模型 ID 为 gpt-5.6-luna,内置模型相对成本档位为 $。

规格速览

提供商OpenAI
模型 IDgpt-5.6-luna
模态Text, Code
Okou 价格档位$

GPT 5.6 Luna基准测试

数据来自OpenAI的GPT-5.6预览材料,对照的是Luna所接替的GPT-5.4 Mini公开数字。所有百分比都只作方向性参考:这一家族仍处于预览阶段,OpenAI也提醒过前沿模型普遍存在SWE-bench Verified数据污染。

SWE-bench Verified预览版;经济档
约70%
Terminal-Bench 2.0预览版工具调用
约58%
AIME 2025(不使用工具)预览版竞赛数学
约89%
GPQA Diamond预览版研究生级科学
约80%
OSWorld(计算机操作)预览版
约62%
MMMU(多模态)预览版
GPT-5.6家族入门档
速度中等推理强度,早期估算
约130token/秒

GPT 5.6 Luna价格

内置模型的相对 credits 成本。实际费用取决于用量和设置,最新价格请以产品内显示为准。

价格档位$

GPT 5.6 Luna最适合的智能体任务

对延迟敏感的对话回复

面向用户的助手,响应时间会被直接感知,Luna约130token/秒的速度让回复保持利落,同时还能处理工具调用和结构化输出。

Terra和Sol之下的底层

在分层的智能体里,Luna承担大量便宜又快的步骤——取数据、做格式化、简单的工具调用——Terra跑日常逻辑,Sol接最难的规划。分层让整条流水线的成本压得住。

先出草稿再打磨的循环

让Luna快速产出初稿——大纲、候选代码、摘要——只把真正需要打磨的那些交给Terra或Sol。前沿档的价格只花在一小部分量上。

常见问题

GPT 5.6 Luna的上下文窗口有多大?

40万token,每次回复最多输出12.8万token。整个窗口都按标准价格计费。

什么时候该用Luna而不是Terra?

当速度和成本比推理深度更重要时:大批量分类与信息抽取、对延迟敏感的对话,以及分层智能体里那层便宜的底盘。任务一旦需要真正的多步推理或高难度的工具路由,就升到Terra。

在Okou上使用GPT 5.6 Luna

如果工作区已启用 GPT 5.6 Luna,可在聊天的模型选择器中选择它。可用的服务商连接和计费方式请查看模型设置。

积分与$价格档

内置模型的相对 credits 成本。实际费用取决于用量和设置,最新价格请以产品内显示为准。

自July 2026 (preview)起在Okou上可用。