GPT 5.6 Luna trên Okou. Cấp GPT-5.6 nhanh, tiết kiệm
Cấp độ tiết kiệm của dòng GPT-5.6 preview của OpenAI. Nhanh, rẻ và đa phương thức — được xây dựng cho việc sử dụng công cụ khối lượng lớn, công việc hàng loạt và các phản hồi nhạy cảm với độ trễ.
400K tokens · Text / Vision / Code · Prompt cache
GPT 5.6 Luna là cấp độ tiết kiệm của thế hệ xem trước GPT-5.6 của OpenAI — thành viên nhanh, rẻ của gia đình được xây dựng cho việc sử dụng công cụ khối lượng lớn, phân loại và trích xuất hàng loạt, và trò chuyện nhạy cảm với độ trễ, nơi tốc độ và chi phí quan trọng hơn chiều sâu suy luận tiên tiến.
Giá niêm yết của nhà cung cấp là 0,20 đô la / 1,20 đô la cho mỗi 1 triệu token với đầu vào được lưu trong bộ nhớ cache ở mức 0,02 đô la / 1 triệu — thấp nhất trong gia đình GPT-5.6. Nó nằm trong dải tín dụng tiết kiệm của Okou, điều này làm cho nó trở thành cấp độ để đạt được trên cơ sở rộng lớn của công việc thường xuyên trong khi GPT 5.6 Terra xử lý tác nhân hàng ngày và Sol chỉ thực hiện các bước khó nhất. GPT-5.6 hiện là một gia đình xem trước; GPT-5.5 vẫn là mô hình OpenAI mặc định cho đến khi nó tốt nghiệp.
GPT 5.6 Luna là gì?
Bản xem trước tháng 7 năm 2026 (cấp kinh tế của dòng GPT-5.6) · Hạng tiết kiệm của dòng GPT-5.6, dưới Sol và Terra. Tùy chọn nhanh, chi phí thấp cho khối lượng lớn và công việc nhạy cảm với độ trễ.
GPT-5.6 được phát hành vào tháng 7 năm 2026 dưới dạng một dòng ba cấp — Sol, Terra và Luna. Luna là cấp tiết kiệm: OpenAI định vị nó cho khối lượng công việc cơ bản, nhạy cảm với độ trễ của tác nhân, vai trò mà GPT-5.4 Mini đã đảm nhiệm trong thế hệ trước. Nó giữ cửa sổ ngữ cảnh 400K token và tham số reasoning_effort của dòng, vì vậy nó có thể được đưa vào các tác nhân Codex hiện có mà không cần thay đổi.
Luna đánh đổi khả năng suy luận cao cấp để lấy tốc độ và chi phí. Với 0,20 đô la / 1,20 đô la cho mỗi 1 triệu token, sau khi OpenAI giảm giá 80% vào ngày 30 tháng 7 năm 2026, nó chỉ bằng một phần nhỏ giá của Sol và là cấp GPT-5.6 được hỗ trợ rẻ nhất trên Okou. Trong các tài liệu xem trước của OpenAI, nó hoạt động tốt trong việc sử dụng công cụ, phân loại và trích xuất đơn giản, và chỉ tụt lại đáng kể trong các tác vụ suy luận khó và vòng lặp dài mà dù sao cũng thuộc về Terra hoặc Sol.
Cũng như phần còn lại của dòng sản phẩm xem trước, các con số còn sớm và mang tính định hướng. Điều ổn định là vai trò của Luna: đó là cấp độ bạn chạy ở phần rộng của một đường ống — nhiều cuộc gọi rẻ, nhanh — trong khi thúc đẩy một phần nhỏ các bước thực sự khó khăn lên Terra và Sol. Việc phân lớp đó là điều giúp một tác nhân GPT-5.6 vừa có khả năng vừa có giá cả phải chăng.
Điều gì đáng chú ý về GPT 5.6 Luna
Kiến trúc tiêu đề và các tính năng khả năng.
GPT 5.6 Luna giữ cửa sổ ngữ cảnh 400K-token, được tính phí theo giá đầu vào tiêu chuẩn trên toàn bộ cửa sổ. Nó hỗ trợ tham số reasoning_effort, bộ nhớ đệm lời nhắc nơi đầu vào được lưu trong bộ nhớ đệm được tính phí bằng một phần mười tỷ lệ đầu vào ($0.02 / 1M) cộng với phí ghi bộ nhớ đệm ($0.25 / 1M), và API Responses hiển thị codex CLI sử dụng theo mặc định. Sử dụng công cụ, đầu ra có cấu trúc và sử dụng máy tính phù hợp với phần còn lại của dòng GPT-5.6. Đầu vào là đa phương thức trên văn bản, hình ảnh và mã; không có tạo hình ảnh gốc.
Thông số kỹ thuật nhanh
Điểm chuẩn GPT 5.6 Luna
Số liệu xem trước từ tài liệu GPT-5.6 của OpenAI, được hiển thị so với số liệu GPT-5.4 Mini công khai mà Luna kế nhiệm. Coi tất cả các tỷ lệ phần trăm là định hướng: dòng sản phẩm đang trong giai đoạn xem trước và OpenAI đã gắn cờ sự nhiễm bẩn SWE-bench Verified trên các mô hình tiên tiến.
Giá GPT 5.6 Luna
Giá niêm yết của nhà cung cấp, trên 1 triệu token.
Cách GPT 5.6 Luna hoạt động trong thực tế
Hành vi được quan sát từ các lần chạy tác nhân sản xuất.
Tốc độ
Cấp độ nhanh nhất trong dòng GPT-5.6 — khoảng 130 token/giây với nỗ lực trung bình trong các thử nghiệm ban đầu. Đây là lý do để chọn Luna: các phản hồi tương tác và các đường ống thông lượng cao vẫn phản hồi nhanh.
Định tuyến công cụ
Đáng tin cậy trên các cuộc gọi công cụ đơn giản và có cấu trúc vừa phải. Nó thua Terra về lựa chọn có điều kiện và thua Sol về các cuộc gọi công cụ được gửi sau lý luận dài – hãy giữ các bước đó ở các cấp cao hơn.
Phân loại và trích xuất hàng loạt
Cấp phù hợp để chạy cùng một lời nhắc có cấu trúc trên hàng nghìn mục. Đầu vào đa phương thức có nghĩa là nó xử lý việc trích xuất dựa trên ảnh chụp màn hình và tài liệu, không chỉ văn bản.
Độ sâu lý luận
Nhẹ hơn Terra và Sol về suy luận đa bước khó và các vòng lặp tác nhân dài. Sử dụng nó cho chiều rộng, không phải chiều sâu: nhiều cuộc gọi nhanh rẻ tiền, với các bước khó được đẩy lên trên.
Hồ sơ chi phí
0,20 đô la / 1,20 đô la cho mỗi 1 triệu và dải tín dụng kinh tế làm cho Luna trở thành cấp GPT-5.6 rẻ nhất — mô hình bạn chạy ở phần đáy rộng của một đường ống nơi khối lượng, chứ không phải suy luận tiên tiến, thúc đẩy hóa đơn.
Các tác vụ tác nhân tốt nhất cho GPT 5.6 Luna
Phân loại và gắn thẻ khối lượng lớn
Chạy Luna trên hàng nghìn vé, email hoặc tài liệu để gắn nhãn, định tuyến hoặc trích xuất các trường. Với $0,20 / $1,20, chi phí mỗi mục vẫn thấp và đầu vào đa phương thức bao gồm các công việc dựa trên ảnh chụp màn hình và PDF.
Trả lời trò chuyện nhạy cảm với độ trễ
Đối với một trợ lý hướng đến người dùng, nơi thời gian phản hồi được cảm nhận trực tiếp, Luna với ~130 token/giây giữ cho các câu trả lời nhanh chóng trong khi vẫn xử lý các cuộc gọi công cụ và đầu ra có cấu trúc.
Lớp cơ sở dưới Terra và Sol
Trong một tác nhân phân lớp, Luna xử lý nhiều bước rẻ, nhanh — tìm nạp, định dạng, gọi công cụ đơn giản — trong khi Terra chạy logic hàng ngày và Sol đảm nhận việc lập kế hoạch khó nhất. Việc phân lớp giúp toàn bộ quy trình trở nên phải chăng.
Vòng lặp soạn thảo-sau đó-tinh chỉnh
Hãy để Luna tạo ra các bản nháp đầu tiên nhanh chóng — dàn ý, mã ứng cử viên, tóm tắt — và chỉ quảng bá những bản cần được trau chuốt lên Terra hoặc Sol. Bạn trả mức giá tiên tiến cho một phần nhỏ khối lượng.
Khi nào nên bỏ qua GPT 5.6 Luna
Bỏ qua Luna trong các trường hợp tái cấu trúc đa tệp khó nhất, các vòng lặp điều phối dài và suy luận cấp độ sau đại học, nơi Terra và đặc biệt là Sol hoạt động tốt hơn đáng kể. Khi chất lượng bản vá lần đầu hoặc suy luận sâu là điểm mấu chốt, cấp độ tiết kiệm là một sự tiết kiệm sai lầm.
GPT 5.6 Luna so với các mô hình khác
GPT 5.6 Luna so với GPT 5.6 Terra
Terra là mặc định cân bằng hàng ngày; Luna là cấp độ tiết kiệm bên dưới nó. Luna nhanh hơn và bằng một phần mười giá niêm yết của Terra, nhưng từ bỏ độ sâu suy luận và định tuyến công cụ cứng. Chạy Luna cho khối lượng và độ trễ; nâng cấp lên Terra ngay khi một tác vụ cần suy luận thực sự.
GPT 5.6 Luna so với GPT-5.4 Mini
Luna là phiên bản kế nhiệm GPT-5.6 của GPT-5.4 Mini trong phân khúc tiết kiệm, với hành vi sử dụng công cụ và đầu vào đa phương thức của thế hệ mới hơn. Hiện tại, nó có giá thấp hơn nhiều (0,20 đô la / 1,20 đô la so với 0,75 đô la / 4,50 đô la), khoảng một phần tư giá, và mang lại những cải tiến của GPT-5.6 cho phân khúc giá rẻ, nhanh chóng.
GPT 5.6 Luna so với Claude Sonnet 4.6
Các dòng khác nhau, vai trò kinh tế đến cân bằng chồng chéo. Sonnet 4.6 mang đến cửa sổ ngữ cảnh 1M mã thông báo và hệ sinh thái Anthropic; Luna mang đến khung Codex, tạo nhanh hơn và giá thấp hơn. Chọn theo khung, độ dài ngữ cảnh và mức độ bạn coi trọng tốc độ hơn độ sâu lý luận.
Điểm mấu chốt: bạn có nên sử dụng GPT 5.6 Luna không?
GPT 5.6 Luna là nền tảng nhanh, rẻ của dòng GPT-5.6: chạy nó cho các công việc có khối lượng lớn và nhạy cảm với độ trễ, và nâng cấp các bước thực sự khó lên Terra và Sol.
Các câu hỏi thường gặp
Cửa sổ ngữ cảnh của GPT 5.6 Luna là gì?
400.000 token, với tối đa 128K token đầu ra cho mỗi phản hồi. Cửa sổ đầy đủ được tính phí theo tỷ lệ tiêu chuẩn.
Khi nào tôi nên sử dụng Luna thay vì Terra?
Khi tốc độ và chi phí quan trọng hơn chiều sâu suy luận: phân loại và trích xuất khối lượng lớn, trò chuyện nhạy cảm với độ trễ và lớp cơ sở rẻ tiền của một tác nhân phân lớp. Nâng cấp lên Terra ngay khi một tác vụ cần suy luận đa bước thực sự hoặc định tuyến công cụ khó.
GPT-5.6 có sẵn rộng rãi trên Okou không?
Nó đang trong giai đoạn xem trước. Cả ba cấp đều có thể chọn được, nhưng GPT-5.5 vẫn là mô hình OpenAI mặc định cho đến khi dòng GPT-5.6 ra mắt, và các con số điểm chuẩn xem trước vẫn còn sớm.
GPT 5.6 Luna có hỗ trợ bộ nhớ đệm lời nhắc không?
Có. Đầu vào được lưu trong bộ nhớ cache có giá 0,02 đô la cho mỗi 1 triệu token với phí ghi vào bộ nhớ cache là 0,25 đô la cho mỗi 1 triệu — bộ nhớ cache rẻ nhất trong dòng sản phẩm. Nên bật trên bất kỳ tác nhân nào có tiền tố ổn định.
Khung công tác nào GPT 5.6 Luna sử dụng trên Okou?
Codex. Okou định tuyến GPT-5.6 thông qua bề mặt Phản hồi API của khung Codex. Các tác nhân khung Claude Code không tương thích với các mô hình GPT-5 trên Okou.
Các lựa chọn thay thế
Sử dụng GPT 5.6 Luna trên Okou
Hai cách truy cập GPT 5.6 Luna trên Okou
Okou hỗ trợ GPT 5.6 Luna dưới dạng mô hình tích hợp được tính phí bằng tín dụng Okou, và thông qua việc tự mang theo với OpenAI API key. Đường dẫn tích hợp sử dụng định tuyến được quản lý Okou và cấp giá được giải thích bên dưới; đường dẫn tự mang theo sẽ tính phí trực tiếp cho bạn với nhà cung cấp thượng nguồn và bỏ qua hoàn toàn việc chuyển đổi tín dụng Okou.
Đề xuất của Okou
Okou định vị GPT 5.6 Luna như một lựa chọn tiết kiệm chi phí cho việc phân loại hàng loạt, bộ lọc trước, phản hồi nhạy cảm với độ trễ và các công việc khối lượng lớn khác.
Tín dụng và cấp giá $
Okou định giá mọi mô hình Tích hợp theo thang tín dụng bốn bước — $, $$, $$$, $$$$ — được hiển thị dưới dạng huy hiệu trong bộ chọn mô hình và trên dòng price tier của zero model ls. GPT 5.6 Luna nằm ở $. Cấp đó là số tiền bạn chi tiêu từ số dư tín dụng Okou của mình; giá niêm yết của nhà cung cấp trong bảng trên là số tiền nhà cung cấp thượng nguồn tính trước khi Okou chuyển đổi nó thành tín dụng.
Có sẵn trên Okou từ July 2026 (preview).

