GPT 5.6 Luna: mô hình lý luận hiện tại trên Okou
Một mô hình lý luận hiện tại với quyền truy cập tích hợp thông qua Okou.
400K tokens · Text / Vision / Code · Prompt cache
Một mô hình suy luận hiện tại từ OpenAI, có sẵn trong danh mục mô hình công khai của Okou.
GPT 5.6 Luna là gì?
Bản xem trước tháng 7 năm 2026 (cấp kinh tế của dòng GPT-5.6)
Okou hiện cung cấp GPT 5.6 Luna trong danh mục mô hình suy luận công khai của mình. Chọn nó với ID mô hình gpt-5.6-luna; chi phí tích hợp tương đối của nó là cấp $.
Thông số kỹ thuật nhanh
Điểm chuẩn GPT 5.6 Luna
Số liệu xem trước từ tài liệu GPT-5.6 của OpenAI, được hiển thị so với số liệu GPT-5.4 Mini công khai mà Luna kế nhiệm. Coi tất cả các tỷ lệ phần trăm là định hướng: dòng sản phẩm đang trong giai đoạn xem trước và OpenAI đã gắn cờ sự nhiễm bẩn SWE-bench Verified trên các mô hình tiên tiến.
Giá GPT 5.6 Luna
Chi phí tín dụng tương đối của mô hình tích hợp. Phí thực tế tùy thuộc mức sử dụng và cài đặt; xem giá hiện tại trong ứng dụng.
Các tác vụ tác nhân tốt nhất cho GPT 5.6 Luna
Trả lời trò chuyện nhạy cảm với độ trễ
Đối với một trợ lý hướng đến người dùng, nơi thời gian phản hồi được cảm nhận trực tiếp, Luna với ~130 token/giây giữ cho các câu trả lời nhanh chóng trong khi vẫn xử lý các cuộc gọi công cụ và đầu ra có cấu trúc.
Lớp cơ sở dưới Terra và Sol
Trong một tác nhân phân lớp, Luna xử lý nhiều bước rẻ, nhanh — tìm nạp, định dạng, gọi công cụ đơn giản — trong khi Terra chạy logic hàng ngày và Sol đảm nhận việc lập kế hoạch khó nhất. Việc phân lớp giúp toàn bộ quy trình trở nên phải chăng.
Vòng lặp soạn thảo-sau đó-tinh chỉnh
Hãy để Luna tạo ra các bản nháp đầu tiên nhanh chóng — dàn ý, mã ứng cử viên, tóm tắt — và chỉ quảng bá những bản cần được trau chuốt lên Terra hoặc Sol. Bạn trả mức giá tiên tiến cho một phần nhỏ khối lượng.
Các câu hỏi thường gặp
Cửa sổ ngữ cảnh của GPT 5.6 Luna là gì?
400.000 token, với tối đa 128K token đầu ra cho mỗi phản hồi. Cửa sổ đầy đủ được tính phí theo tỷ lệ tiêu chuẩn.
Khi nào tôi nên sử dụng Luna thay vì Terra?
Khi tốc độ và chi phí quan trọng hơn chiều sâu suy luận: phân loại và trích xuất khối lượng lớn, trò chuyện nhạy cảm với độ trễ và lớp cơ sở rẻ tiền của một tác nhân phân lớp. Nâng cấp lên Terra ngay khi một tác vụ cần suy luận đa bước thực sự hoặc định tuyến công cụ khó.
GPT 5.6 Luna có hỗ trợ bộ nhớ đệm lời nhắc không?
Có. Đầu vào được lưu trong bộ nhớ cache có giá 0,02 đô la cho mỗi 1 triệu token với phí ghi vào bộ nhớ cache là 0,25 đô la cho mỗi 1 triệu — bộ nhớ cache rẻ nhất trong dòng sản phẩm. Nên bật trên bất kỳ tác nhân nào có tiền tố ổn định.
Sử dụng GPT 5.6 Luna trên Okou
Chọn GPT 5.6 Luna trong bộ chọn mô hình của cuộc trò chuyện nếu đã được bật cho không gian làm việc. Kết nối nhà cung cấp và thông tin tính phí có trong phần cài đặt mô hình.
Tín dụng và cấp giá $
Chi phí tín dụng tương đối của mô hình tích hợp. Phí thực tế tùy thuộc mức sử dụng và cài đặt; xem giá hiện tại trong ứng dụng.
Có sẵn trên Okou từ July 2026 (preview).

