GPT-5.4 Mini: Mô hình lý luận nhỏ gọn của OpenAI
Thành viên tối ưu hóa chi phí của OpenAI trong dòng GPT-5. ×0,3 tín dụng, tầm nhìn đa phương tiện và đủ nhanh cho việc định tuyến, phân loại và lọc trước khối lượng lớn.
400K tokens · Text / Vision / Code · Prompt cache
Okou không còn chạy GPT-5.4 Mini. Trang này được giữ lại làm tài liệu tham khảo cho các thông số kỹ thuật, giá cả và điểm chuẩn của nó. Đối với cùng loại công việc, hãy sử dụng GPT 5.6 Luna.
Xem GPT 5.6 LunaGPT-5.4 Mini là thành viên tiết kiệm chi phí của dòng GPT-5 của OpenAI — mô hình bạn tìm đến khi chi phí đơn vị quan trọng hơn chất lượng lý luận cao nhất. Nó giữ nguyên cửa sổ ngữ cảnh 400K và đầu vào đa phương thức của các thành viên khác trong dòng nhưng cắt giảm tính toán trên mỗi token, điều này dẫn đến giá thấp hơn (0,75 đô la / 4,5 đô la cho mỗi 1 triệu) và tốc độ nhanh hơn đáng kể.
GPT-5.4 Mini là gì?
Tháng 4 năm 2026 · Biến thể tiết kiệm chi phí của dòng GPT-5. Đồng cấp OpenAI của Kimi K2.7 Code.
GPT-5.4 Mini là thành viên được tối ưu hóa chi phí của thế hệ GPT-5 của OpenAI, được phát hành vào tháng 4 năm 2026 cùng với GPT-5.5 và GPT-5.4. OpenAI định vị nó là cấp độ thông lượng cao — mô hình bạn tiếp tục chạy trên các bước phân loại, định tuyến và lọc trước, nơi mà 5.4 hoặc 5.5 lớn hơn sẽ bị lãng phí vào các quyết định thường xuyên.
Về mặt kiến trúc, nó chia sẻ cửa sổ ngữ cảnh 400K token của dòng GPT-5, tham số reasoning_effort, bộ nhớ đệm lời nhắc và bề mặt API Responses mà CLI codex sử dụng theo mặc định. Sự đánh đổi so với 5.4 là độ sâu lý luận: Mini xử lý tốt các lệnh gọi công cụ tiêu chuẩn, tóm tắt ngắn gọn và khối lượng công việc đầu ra có cấu trúc, nhưng bắt đầu lạc đề trong các kế hoạch nhiều bước khó hơn mà 5.4 vẫn duy trì. Sự đánh đổi so với các đối thủ cạnh tranh ở cùng mức giá là hệ sinh thái — nếu bạn đã sử dụng Codex, việc duy trì trong bề mặt OpenAI giúp các định nghĩa công cụ và lược đồ đầu ra có cấu trúc nhất quán.
Điều gì đáng chú ý về GPT-5.4 Mini
Kiến trúc tiêu đề và các tính năng khả năng.
GPT-5.4 Mini sử dụng cùng kiến trúc với phần còn lại của dòng GPT-5: cửa sổ ngữ cảnh 400K token, tham số reasoning_effort ở bốn cấp độ, bộ nhớ đệm lời nhắc nơi đầu vào được lưu trong bộ nhớ đệm được tính phí bằng một phần mười tỷ lệ đầu vào và bề mặt API Responses. Sử dụng công cụ, đầu ra có cấu trúc và đầu vào thị giác đa phương thức được hỗ trợ. Mô hình này là một phiên bản nhỏ hơn, nhanh hơn — ít tham số hơn trên mỗi token, thông lượng cao hơn trên mỗi đô la.
Thông số kỹ thuật nhanh
Điểm chuẩn GPT-5.4 Mini
Điểm số do nhà cung cấp báo cáo từ tài liệu phát hành GPT-5 Mini của OpenAI. Các đánh giá độc lập đặt 5.4 Mini vào cùng nhóm tiết kiệm chi phí với Kimi K2.7 Code trên hầu hết các điểm chuẩn tác nhân. Coi các tỷ lệ phần trăm tuyệt đối là định hướng.
Giá GPT-5.4 Mini
Giá niêm yết của nhà cung cấp, trên 1 triệu token.
Cách GPT-5.4 Mini hoạt động trong thực tế
Hành vi được quan sát từ các lần chạy tác nhân sản xuất.
Tốc độ
Mô hình nhanh nhất trong dòng GPT-5 — khoảng 165 token/giây với nỗ lực trung bình theo Phân tích nhân tạo. Đây là thuộc tính làm cho nó khả thi cho các phản hồi trò chuyện tương tác và các cuộc gọi công cụ phân tán ngắn, nơi độ trễ hiển thị cho người dùng chiếm ưu thế.
Các cuộc gọi công cụ thường xuyên
Chính xác trên danh mục công cụ khung Codex tiêu chuẩn. Nơi 5.4 vượt trội là trong các trường hợp khó (lựa chọn công cụ có điều kiện, đối số lồng sâu) — đối với các trường hợp thông thường, Mini xử lý định tuyến công cụ một cách sạch sẽ với chi phí bằng một phần ba.
Phân loại hàng loạt & lọc trước
Vị trí chi phí/chất lượng mạnh nhất trong dòng GPT-5 cho công việc phân tán. Phân loại PR hàng loạt, phân loại phiếu hỗ trợ, phân loại tài liệu theo cấp độ — tất cả các khối lượng công việc mà trước đây bạn phải tự viết regex giờ đây đều có giá cả phải chăng trong một cuộc gọi mô hình thực tế.
Hiệu quả chi phí
×0.3 tín dụng bao gồm tầm nhìn đa phương thức. Mini và Kimi K2.7 Code nằm trong cùng một dải, trong khi DeepSeek V4 Pro nằm thấp hơn ở mức ×0.1 — lựa chọn thường phụ thuộc vào sự phù hợp của khung và hành vi trên khối lượng công việc cụ thể của bạn.
Khi nào cần leo thang
Mini bị trôi dạt trong các kế hoạch đa bước dài, lý luận khó khăn và chỉnh sửa mã đa tệp lần đầu. Xây dựng tác nhân để người điều phối quyết định khi nào cần leo thang lên 5.4 hoặc 5.5, chứ không phải để Mini cố gắng thực hiện toàn bộ vòng lặp.
Các tác vụ tác nhân tốt nhất cho GPT-5.4 Mini
Bộ phân loại fan-out chạy trên mọi sự kiện
Vé hỗ trợ đến, bình luận PR, bản ghi cuộc gọi bán hàng, tải lên tài liệu — Mini đọc từng cái và định tuyến nó đến tác nhân hạ nguồn hoặc người đánh giá phù hợp. Tín dụng ×0,3 và 165 token/giây có nghĩa là chi phí cho mỗi sự kiện đủ nhỏ để chạy nó trên mọi sự kiện (không chỉ các lô mẫu) thực sự khả thi.
Bước tiền lọc trước mô hình đắt tiền
Ghim Mini ở đầu cuộc gọi công cụ của tác nhân để nó quyết định liệu yêu cầu có cần leo thang hay không. Hầu hết các yêu cầu đều nhận được câu trả lời nhanh chóng, rẻ tiền; chỉ một số ít còn lại phải trả toàn bộ chi phí GPT-5.4 hoặc 5.5. Đây là nơi việc xếp chồng các cấp tiết kiệm chi phí và cấp cốt lõi thực sự thay đổi những gì có thể chi trả được.
Trả lời trò chuyện tương tác
Các lượt đa phương thức ngắn, nơi độ trễ hiển thị cho người dùng chi phối trải nghiệm. Mini trả lời đủ nhanh để việc phát trực tuyến cảm thấy tức thì, và hỗ trợ đa phương thức có nghĩa là một ảnh chụp màn hình trong cuộc trò chuyện hoạt động ngay lập tức.
Khi nào nên bỏ qua GPT-5.4 Mini
Bỏ qua GPT-5.4 Mini đối với các lý luận khó nhất, điều phối tác nhân đa bước, các chuỗi sử dụng máy tính và các chỉnh sửa mã đa tệp lần đầu tiên — nâng cấp lên 5.4 cho các phiên bản thông thường của các tác vụ đó và 5.5 cho các tác vụ khó nhất.
GPT-5.4 Mini so với các mô hình khác
GPT-5.4 Mini so với GPT-5.4
Cùng một dòng, định vị khác nhau. 5.4 Mini (×0.3) thắng về chi phí và tốc độ; 5.4 (×1) thắng về chất lượng lý luận và độ chính xác định tuyến công cụ trong các trường hợp khó. Mẫu tiêu chuẩn là lọc trước bằng Mini và chuyển các trường hợp còn lại lên 5.4.
GPT-5.4 Mini so với Claude Sonnet 4.6
Claude Sonnet 4.6 là mục tiêu so sánh danh mục hiện tại cho mô hình này.
Điểm mấu chốt: bạn có nên sử dụng GPT-5.4 Mini không?
GPT-5.4 Mini là mặc định tiết kiệm chi phí ở phía OpenAI. Lọc trước bằng Mini, nâng cấp lên GPT-5.4 cho các bước thông thường, nâng cấp lên GPT-5.5 chỉ cho những lý luận khó nhất.
Các câu hỏi thường gặp
Cửa sổ ngữ cảnh của GPT-5.4 Mini là gì?
400.000 token, với tối đa 128K token đầu ra cho mỗi phản hồi — giống như phần còn lại của dòng GPT-5.
GPT-5.4 Mini có thể xử lý hình ảnh không?
Có. Giống như phần còn lại của dòng GPT-5, nó chấp nhận đầu vào hình ảnh cùng với văn bản và mã.
Khi nào tôi nên chọn GPT-5.4 Mini thay vì Kimi K2.7 Code?
Khi tác nhân của bạn đã được xây dựng trên khung Codex hoặc bạn cần hệ sinh thái đầu ra có cấu trúc / gọi công cụ OpenAI. Cả hai đều ở mức ×0.3 tín dụng, vì vậy chi phí là như nhau và lựa chọn phụ thuộc vào khung và hành vi.
GPT-5.4 Mini có hỗ trợ bộ nhớ đệm lời nhắc không?
Có. Đầu vào được lưu trong bộ nhớ cache được tính phí 0,075 đô la cho mỗi 1 triệu token — giảm giá 10 lần cho phần được lưu trong bộ nhớ cache.
Các lựa chọn thay thế
Khả dụng của GPT-5.4 Mini trên Okou
GPT-5.4 Mini đã bị xóa khỏi danh sách Okou, vì vậy không thể chọn nó trong trò chuyện hoặc trong quy trình làm việc, và nó không khả dụng với khóa API của riêng bạn. GPT 5.6 Luna bao gồm cùng một cấp tiết kiệm chi phí.

