GPT-5.4: Mô hình lý luận OpenAI
Con ngựa thồ của OpenAI trong dòng GPT-5. Nằm ở mức cơ bản tín dụng ×1 cùng với Claude Sonnet 4.6 và là mặc định phù hợp cho hầu hết các tác nhân khung Codex.
400K tokens · Text / Vision / Code · Prompt cache
Okou không còn chạy GPT-5.4. Trang này được giữ lại làm tài liệu tham khảo cho các thông số kỹ thuật, giá cả và điểm chuẩn của nó. Đối với cùng loại công việc, hãy sử dụng GPT 5.6 Luna.
Xem GPT 5.6 LunaGPT-5.4 là công cụ chính trong dòng GPT-5 của OpenAI — mô hình bạn tiếp tục chạy ở mọi nơi theo mặc định. SWE-bench Verified do nhà cung cấp báo cáo ở mức 74,9% đặt nó vào cùng phạm vi với Claude Sonnet 4.6 về mã hóa, và độ chính xác sử dụng công cụ của nó là điều mà hầu hết các tác nhân khung Codex sản xuất được điều chỉnh theo.
GPT-5.4 là gì?
Tháng 4 năm 2026 · Con ngựa làm việc của dòng GPT-5. Mặc định được khuyến nghị cho hầu hết các tác nhân khung Codex.
GPT-5.4 là công cụ chính của thế hệ GPT-5 của OpenAI, được phát hành vào tháng 4 năm 2026 cùng với GPT-5.5 hàng đầu và GPT-5.4 Mini được tối ưu hóa chi phí. OpenAI định vị nó là mặc định phổ biến cho các tác nhân trên khung Codex — mô hình bạn tiếp tục chạy ở mọi bước trừ khi một bước cụ thể cần nâng cấp lên 5.5.
Về mặt kiến trúc, GPT-5.4 chia sẻ cửa sổ ngữ cảnh 400K token, tham số reasoning_effort, bộ nhớ đệm lời nhắc và bề mặt API Responses với phần còn lại của dòng GPT-5. Sự khác biệt so với GPT-5.5 là đầu tư tính toán trên mỗi token: 5.4 chạy nhanh hơn và rẻ hơn, 5.5 đầu tư nhiều hơn vào chiều sâu lý luận. Sự khác biệt so với GPT-5.4 Mini là ngược lại — 5.4 mang lại chất lượng cao hơn cho các bước thực sự quyết định quá trình chạy của tác nhân.
Điều gì đáng chú ý về GPT-5.4
Kiến trúc tiêu đề và các tính năng khả năng.
GPT-5.4 sử dụng cùng kiến trúc với phần còn lại của dòng GPT-5: cửa sổ ngữ cảnh 400K token, tham số reasoning_effort ở bốn cấp độ (tối thiểu, thấp, trung bình, cao), bộ nhớ đệm lời nhắc nơi đầu vào được lưu trong bộ nhớ đệm được tính phí bằng một phần mười tỷ lệ đầu vào và bề mặt API Responses mà codex CLI sử dụng theo mặc định. Sử dụng công cụ, đầu ra có cấu trúc và sử dụng máy tính được hỗ trợ. Đầu vào là đa phương thức trên văn bản, thị giác và mã.
Thông số kỹ thuật nhanh
Điểm chuẩn GPT-5.4
Điểm số do nhà cung cấp báo cáo từ tài liệu phát hành GPT-5 của OpenAI, với các thay đổi được hiển thị so với thế hệ OpenAI trước đó. Các đánh giá độc lập đặt GPT-5.4 trong cùng dải chất lượng mã hóa với Claude Sonnet 4.6. Coi các tỷ lệ phần trăm tuyệt đối là định hướng.
Giá GPT-5.4
Giá niêm yết của nhà cung cấp, trên 1 triệu token.
Cách GPT-5.4 hoạt động trong thực tế
Hành vi được quan sát từ các lần chạy tác nhân sản xuất.
Định tuyến công cụ
Độ chính xác cơ bản vững chắc trên danh mục công cụ khung Codex tiêu chuẩn. Điểm mà 5.5 vượt trội là ở các trường hợp khó (lựa chọn công cụ có điều kiện, đối số lồng sâu) — đối với các trường hợp thông thường, 5.4 định tuyến chính xác với độ trễ thấp hơn đáng kể.
Chỉnh sửa mã
Chất lượng bản vá tương đương với Claude Sonnet 4.6 trên các tác vụ tái cấu trúc và sửa lỗi tiêu chuẩn. Điểm mà 5.5 bắt đầu vượt trội là ở các thay đổi đa tệp, nơi bản vá phải được áp dụng sạch sẽ ngay từ lần thử đầu tiên.
Tốc độ
Nhanh hơn đáng kể so với 5.5 — khoảng 110 token/giây ở mức nỗ lực trung bình theo Phân tích Nhân tạo. Đây là một phần lý do tại sao 5.4 vẫn là mặc định cho các phản hồi trò chuyện tương tác và các vòng lặp tác nhân ngắn nơi độ trễ hiển thị cho người dùng quan trọng.
Hiệu quả chi phí
Tín dụng ×1 với hành vi đầu ra trong dải chất lượng Sonnet 4.6. Đối với các nhóm đã sử dụng khung Codex, đây là điểm tối ưu về chi phí/chất lượng — chỉ nâng cấp lên 5.5 ở các bước cần thiết rõ ràng.
Hành vi ảo giác
Thừa hưởng những cải tiến về hiệu chuẩn mà OpenAI đã cung cấp cùng với thế hệ GPT-5. Ít có khả năng đưa ra những câu trả lời sai một cách tự tin hơn so với dòng GPT-4, đặc biệt là đối với những câu hỏi nằm ngoài phạm vi đào tạo của nó.
Các tác vụ tác nhân tốt nhất cho GPT-5.4
Bước tác nhân mặc định trên khung Codex
Nếu tác nhân của bạn đã được xây dựng trên codex CLI hoặc bất kỳ tích hợp khung Codex nào, GPT-5.4 là lựa chọn mặc định tự nhiên ở mọi nơi. ×1 tín dụng, đủ nhanh để sử dụng tương tác, đủ chính xác cho các lệnh gọi công cụ thông thường chiếm ưu thế trong hầu hết các lần chạy tác nhân.
Khi nào nên bỏ qua GPT-5.4
Bỏ qua GPT-5.4 đối với các tác vụ suy luận khó nhất, sử dụng máy tính hoặc chỉnh sửa mã đa tệp mà 5.5 dẫn đầu rõ rệt, và đối với các tác vụ phân loại hàng loạt hoặc tiền lọc khối lượng lớn mà 5.4 Mini rẻ hơn bốn lần ở cấp độ nhà cung cấp.
GPT-5.4 so với các mô hình khác
GPT-5.4 so với GPT-5.5
Cùng một dòng, định vị khác nhau. 5.5 (×2) mang lại cho bạn khả năng suy luận, sử dụng máy tính và chất lượng mã lần đầu mạnh nhất; 5.4 (×1) mang lại cho bạn cùng cửa sổ ngữ cảnh và bộ tính năng với một nửa chi phí tín dụng và tốc độ nhanh hơn đáng kể. Mặc định là 5.4; chỉ nâng cấp lên 5.5 ở những bước rõ ràng cần thiết.
GPT-5.4 so với Claude Sonnet 4.6
Hai đường cơ sở ×1, mỗi đường trong một hệ sinh thái. Sonnet 4.6 chạy trên khung Claude Code; GPT-5.4 chạy trên Codex. Chọn theo khung mà các tác nhân và định nghĩa công cụ hiện có của bạn nhắm đến. Về chất lượng đầu ra thô, chúng đủ gần để thử nghiệm A/B trên khối lượng công việc của bạn là lựa chọn đúng đắn.
GPT-5.4 so với GPT-5.4 Mini
Cùng một dòng sản phẩm, định vị khác nhau. 5.4 (×1) mang lại chất lượng suy luận cao hơn trên mỗi token; 5.4 Mini (×0.3) cung cấp cho bạn một tùy chọn rẻ hơn nhiều cho công việc hàng loạt và tiền lọc. Sử dụng 5.4 Mini để phân loại phân tán và 5.4 cho các bước quyết định chạy tác nhân.
Các câu hỏi thường gặp
Cửa sổ ngữ cảnh của GPT-5.4 là gì?
400.000 token, với tối đa 128K token đầu ra cho mỗi phản hồi. Cửa sổ đầy đủ được tính phí theo tỷ lệ tiêu chuẩn.
GPT-5.4 có thể xử lý hình ảnh không?
Có. GPT-5.4 là đa phương thức. Nó chấp nhận đầu vào hình ảnh cùng với văn bản và mã gốc.
Khi nào tôi nên chọn GPT-5.4 thay vì Claude Sonnet 4.6?
Khi tác nhân của bạn đã được xây dựng trên khung Codex hoặc bạn cần hệ sinh thái OpenAI (danh mục công cụ, đầu ra có cấu trúc, Phản hồi API). Cả hai đều ở mức ×1 tín dụng, vì vậy chi phí là như nhau và lựa chọn phụ thuộc vào khung và sự phù hợp về hành vi.
GPT-5.4 có hỗ trợ bộ nhớ đệm lời nhắc không?
Có. Đầu vào được lưu trong bộ nhớ cache được tính phí 0,25 đô la cho mỗi 1 triệu token — giảm giá 10 lần cho phần được lưu trong bộ nhớ cache.
Các lựa chọn thay thế
Khả dụng của GPT-5.4 trên Okou
GPT-5.4 đã bị xóa khỏi danh sách Okou, vì vậy không thể chọn nó trong trò chuyện hoặc trong quy trình làm việc, và nó không khả dụng với khóa API của riêng bạn. GPT 5.6 Luna bao gồm cùng một cấp tiết kiệm chi phí.

