Tất cả các mô hình

GPT-5.5 trên Okou. Mô hình lý luận hàng đầu của OpenAI

Sản phẩm chủ lực của OpenAI trong dòng GPT-5. Lựa chọn mạnh nhất cho mã hóa tác nhân, lý luận sâu sắc và các vòng lặp sử dụng máy tính ở cấp OpenAI.

400K tokens · Text / Vision / Code · Prompt cache

GPT-5.5 là mô hình bạn tìm đến khi công việc cần cả lý luận sâu sắc và sử dụng công cụ đáng tin cậy: điều phối các vòng lặp tác nhân nhiều bước, chỉnh sửa mã phải thành công ngay từ lần thử đầu tiên và các quy trình làm việc sử dụng máy tính trải rộng nhiều hành động GUI. Các điểm chuẩn của nhà cung cấp (SWE-bench Verified, AIME 2025, GPQA Diamond) đưa ra các con số cụ thể về những cải tiến so với GPT-5.4.

GPT-5.5 là gì?

Tháng 4 năm 2026 (kế nhiệm GPT-5.4) · Cấp cao nhất của dòng GPT-5. Flagship của OpenAI cho mã hóa và suy luận tác nhân.

GPT-5.5 là sản phẩm chủ lực của thế hệ GPT-5 của OpenAI, được phát hành vào tháng 4 năm 2026 dưới dạng bản nâng cấp được khuyến nghị từ GPT-5.4. OpenAI coi đây là một bước nhảy vọt về việc sử dụng công cụ tác nhân và các tác vụ sử dụng máy tính chứ không phải là một bản làm mới trên bề mặt API. Cửa sổ ngữ cảnh 400K token và tham số reasoning_effort được giới thiệu với GPT-5 vẫn giữ nguyên, vì vậy các tác nhân Codex hiện có có thể sử dụng mà không cần viết lại.

Các bảng xếp hạng độc lập (Artificial Analysis, Vellum) xác nhận thứ tự tương đối so với GPT-5.4 và đặt GPT-5.5 trong vòng vài điểm so với Claude Opus 4.7 trên hầu hết các tác vụ mã hóa tác nhân. Các con số tuyệt đối thay đổi hàng tuần và bản thân OpenAI đã gắn cờ ô nhiễm dữ liệu đào tạo trên SWE-bench Verified trên các mô hình tiên tiến. Hãy coi các điểm số công khai là định hướng hơn là có thẩm quyền; các khác biệt hành vi có cấu trúc (độ chính xác của cuộc gọi công cụ, độ tin cậy của việc sử dụng máy tính, chất lượng bản vá lần đầu) là tín hiệu bền vững hơn.

Điều gì đáng chú ý về GPT-5.5

Kiến trúc tiêu đề và các tính năng khả năng.

GPT-5.5 giữ cửa sổ ngữ cảnh 400K token từ GPT-5.4, được tính phí theo giá đầu vào tiêu chuẩn trên toàn bộ cửa sổ. Nó hỗ trợ tham số reasoning_effort ở bốn cấp độ (tối thiểu, thấp, trung bình, cao), bộ nhớ đệm lời nhắc nơi đầu vào được lưu trong bộ nhớ đệm được tính phí bằng một phần mười tỷ lệ đầu vào, và bề mặt Responses API mà codex CLI sử dụng theo mặc định. Sử dụng công cụ, đầu ra có cấu trúc và sử dụng máy tính không thay đổi so với 5.4. Đầu vào là đa phương thức trên văn bản, thị giác và mã; mô hình không có khả năng tạo hình ảnh gốc (sử dụng Images API cho việc đó).

Thông số kỹ thuật nhanh

Gia đìnhTạo GPT-5
Phương thứcVăn bản, thị giác, mã
Ngôn ngữƯu tiên tiếng Anh, đa ngôn ngữ
Bộ nhớ đệm lời nhắcĐược hỗ trợ (OpenAI)
Cửa sổ ngữ cảnh400K token
Đầu ra tối đaLên đến 128K token
Nỗ lực lý luậnTối thiểu / Thấp / Trung bình / Cao
Giá niêm yết của nhà cung cấpĐầu vào 5 đô la / đầu ra 30 đô la cho mỗi 1 triệu

Điểm chuẩn GPT-5.5

Điểm số do nhà cung cấp báo cáo từ tài liệu phát hành GPT-5.5 của OpenAI, với các thay đổi được hiển thị so với các con số GPT-5.4 công khai. Các đánh giá độc lập đặt 5.5 trong vòng vài điểm so với Claude Opus 4.7 trên các tác vụ mã hóa tác nhân. Coi các tỷ lệ phần trăm tuyệt đối là định hướng; OpenAI đã gắn cờ ô nhiễm dữ liệu đào tạo trên SWE-bench Verified trên tất cả các mô hình tiên tiến.

Đã xác minh SWE-benchdo nhà cung cấp báo cáo; tăng từ 74,9% của 5.4
~82%
Terminal-Bench 2.0sử dụng công cụ do nhà cung cấp báo cáo
~69%
AIME 2025 (không có công cụ)toán học cạnh tranh do nhà cung cấp báo cáo
~96%
GPQA Diamondkhoa học sau đại học do nhà cung cấp báo cáo
~89%
OSWorld (sử dụng máy tính)do nhà cung cấp báo cáo
~74%
MMMU (đa phương thức)do nhà cung cấp báo cáo
Dẫn đầu dòng GPT-5
Tốc độPhân tích nhân tạo, nỗ lực trung bình
~70 token/giây

Giá GPT-5.5

Giá niêm yết của nhà cung cấp, trên 1 triệu token.

Đầu vào$5.00
Đầu ra$30.00
Đọc bộ nhớ cache$0.50
Ghi bộ nhớ cacheKhông tính phí

Cách GPT-5.5 hoạt động trong thực tế

Hành vi được quan sát từ các lần chạy tác nhân sản xuất.

Định tuyến công cụ

Tỷ lệ gọi công cụ sai đường thấp nhất trong dòng GPT-5. Khoảng cách so với 5.4 mở rộng trên các trường hợp khó như lựa chọn công cụ có điều kiện, các đối số lồng sâu và các cuộc gọi công cụ được gửi sau thời gian lý luận dài.

Chỉnh sửa mã lần đầu

Chất lượng bản vá mạnh nhất trong dòng GPT-5. Lựa chọn đúng đắn khi một tác nhân phải sửa đổi mã phải tiếp tục biên dịch và vượt qua các bài kiểm tra, đặc biệt khi bản vá trải dài nhiều tệp. SWE-bench Verified do nhà cung cấp báo cáo phản ánh trực tiếp điều này.

Sử dụng máy tính

Đáng tin cậy hơn đáng kể so với 5.4 trên các chuỗi GUI đa bước, đó là những gì delta OSWorld nắm bắt. Hãy sử dụng nó khi tác nhân đang điều khiển trình duyệt hoặc ứng dụng máy tính để bàn qua hàng chục bước và chi phí của một sự cố giữa chừng là cao.

Tốc độ

Chậm hơn 5.4 và chậm hơn đáng kể so với 5.4 Mini. Khoảng 70 token/giây ở mức nỗ lực trung bình theo Phân tích Nhân tạo. Dành nó cho các bước thực sự cần độ sâu lý luận bổ sung và chạy các cấp độ nhẹ hơn song song.

Hành vi ảo giác

GPT-5.5 mang theo sự hiệu chỉnh nghiêm ngặt hơn của OpenAI từ thế hệ GPT-5 và có xu hướng thừa nhận sự không chắc chắn hơn là bịa đặt, đó là lý do tại sao các nhóm sản xuất tiếp tục trả phí bảo hiểm cho lý luận có tính rủi ro cao mặc dù các lựa chọn thay thế rẻ hơn như DeepSeek V4 Pro hiện đã sánh ngang với nó trên các điểm chuẩn.

Các tác vụ tác nhân tốt nhất cho GPT-5.5

Người điều phối đang chạy một kế hoạch đa công cụ

Sử dụng GPT-5.5 làm công cụ lập kế hoạch chia yêu cầu của khách hàng thành mười bước, gửi mỗi bước cho một tác nhân phụ cấp GPT-5.4 hoặc 5.4 Mini và ghép nối các kết quả lại với nhau. Chạy 5.5 chỉ ở lớp lập kế hoạch (và các cấp rẻ hơn ở mọi nơi khác) tốn một phần nhỏ chi phí so với chạy 5.5 từ đầu đến cuối, với hầu hết chất lượng được giữ nguyên.

Các chỉnh sửa mã thử nghiệm đầu tiên không lãng phí một lần chạy CI

Yêu cầu GPT-5.5 di chuyển một cơ sở mã 50 tệp từ một ORM sang một ORM khác, tái cấu trúc một mô-đun phức tạp hoặc áp dụng một bản vá bảo mật trên toàn bộ kho lưu trữ. Bản vá được áp dụng sạch sẽ ngay lần thử đầu tiên thường xuyên hơn bất kỳ mô hình nào khác trong dòng, và đó chính xác là điều mà hóa đơn CI của bạn sẽ phản ánh.

Tác nhân sử dụng máy tính phải hoàn thành quy trình làm việc

Khi tác nhân đang điều khiển trình duyệt thông qua một luồng đặt chỗ nhiều bước, một ứng dụng máy tính để bàn hoặc một giao diện người dùng quản trị cũ, điểm OSWorld mạnh hơn của 5.5 giúp giảm thiểu các sự cố giữa chừng và giảm số lần con người phải can thiệp. Chi phí cao hơn sẽ tự bù đắp ngay lần đầu tiên một phiên làm việc dài không phải khởi động lại.

Bước nghiên cứu toán học khó hoặc khoa học khó

Đưa vào một bộ bài toán cấp độ thi đấu hoặc một phép dẫn xuất vật lý sau đại học và 5.5 sẽ giải quyết nó mà không mắc phải những lỗi nhỏ như bạn thấy ở 5.4. AIME 2025 và GPQA Diamond chính xác là những gì cần loại hành vi này.

Khi nào nên bỏ qua GPT-5.5

Bỏ qua GPT-5.5 trong các công việc thường ngày có khối lượng lớn mà GPT-5.4 đạt được cùng chất lượng với chi phí tín dụng chỉ bằng một nửa, trong các phản hồi trò chuyện nhạy cảm về độ trễ mà GPT-5.4 Mini nhanh hơn nhiều, và trong các công việc phân loại hoặc trích xuất hàng loạt mà GPT-5.4 Mini là tùy chọn hàng loạt được hỗ trợ rẻ hơn.

GPT-5.5 so với các mô hình khác

GPT-5.5 so với GPT-5.4

GPT-5.4 là mô hình mặc định chủ lực trong dòng GPT-5 và là lựa chọn phù hợp cho hầu hết các tác nhân. Chỉ nâng cấp lên GPT-5.5 khi 5.4 rõ ràng thất bại trong lý luận khó, các vòng lặp tác nhân dài hoặc chỉnh sửa mã lần đầu, thường là với vai trò điều phối viên ủy quyền xuống các tác nhân phụ cấp 5.4 hoặc 5.4 Mini.

GPT-5.5 so với Claude Opus 4.7

Cùng vai trò trong các dòng khác nhau: người điều phối có rủi ro cao và mô hình bạn nâng cấp lên khi cấp thấp hơn thất bại. Opus 4.7 có cửa sổ ngữ cảnh 1M token và hồ sơ an toàn của Anthropic; GPT-5.5 có điểm sử dụng máy tính mạnh hơn và là lựa chọn tự nhiên cho các nhóm đã sử dụng khung Codex. Chọn theo khung và hệ sinh thái mà các tác nhân hiện có của bạn nhắm đến.

GPT-5.5 so với Gemini 3 Pro

Gemini 3 Pro dẫn đầu về lý luận ngữ cảnh dài thô (cửa sổ 2M token) và trên một số tiêu chuẩn đa phương thức. GPT-5.5 dẫn đầu về mã hóa tác nhân (SWE-bench Verified, Terminal-Bench) và sử dụng máy tính. Chọn GPT-5.5 khi tác nhân chỉnh sửa mã hoặc điều khiển giao diện người dùng; chọn Gemini 3 Pro khi khối lượng công việc là tài liệu nặng hoặc hiểu video.

Điểm mấu chốt: bạn có nên sử dụng GPT-5.5 không?

GPT-5.5 là cấp độ leo thang ở phía OpenAI. Mặc định là GPT-5.4; chỉ nâng cấp lên 5.5 ở các bước cụ thể mà 5.4 rõ ràng thất bại.

Các câu hỏi thường gặp

Cửa sổ ngữ cảnh của GPT-5.5 là gì?

400.000 token, với tối đa 128K token đầu ra cho mỗi phản hồi. Cửa sổ đầy đủ được tính phí theo tỷ lệ tiêu chuẩn.

GPT-5.5 có thể xử lý hình ảnh không?

Có. GPT-5.5 là đa phương thức. Nó chấp nhận đầu vào hình ảnh cùng với văn bản và mã, vì vậy các tác nhân điều khiển bằng ảnh chụp màn hình và nhận dạng tài liệu hoạt động nguyên bản. Để tạo hình ảnh, hãy sử dụng OpenAI Images API.

Khi nào tôi nên chọn GPT-5.5 thay vì GPT-5.4?

Khi (a) tác nhân là người lập kế hoạch / điều phối và các quyết định được đưa ra theo chuỗi, (b) quá trình chạy đủ dài để 5.4 bắt đầu định tuyến sai các lệnh gọi công cụ, hoặc (c) đầu ra phải áp dụng sạch sẽ ngay lần thử đầu tiên (chỉnh sửa mã, tải trọng có cấu trúc, quy trình làm việc sử dụng máy tính).

GPT-5.5 có hỗ trợ bộ nhớ đệm lời nhắc không?

Có. Đầu vào được lưu trong bộ nhớ cache được tính phí 0,50 đô la cho mỗi 1 triệu token — giảm giá 10 lần cho phần được lưu trong bộ nhớ cache. Nên sử dụng bất cứ khi nào lời nhắc hệ thống hoặc lược đồ công cụ của bạn ổn định qua các cuộc gọi.

GPT-5.5 sử dụng khung nào trên Okou?

Codex. Okou định tuyến GPT-5.5 thông qua bề mặt Phản hồi API của khung Codex, đây là những gì mã CLI sử dụng theo mặc định. Các tác nhân khung Claude Code không tương thích với các mô hình GPT-5 trên Okou.

Các lựa chọn thay thế

Sử dụng GPT-5.5 trên Okou

Hai cách truy cập GPT-5.5 trên Okou

Okou hỗ trợ GPT-5.5 dưới dạng mô hình tích hợp được tính phí bằng tín dụng Okou, và thông qua việc tự mang theo với OpenAI API key. Đường dẫn tích hợp sử dụng định tuyến được quản lý Okou và cấp giá được giải thích bên dưới; đường dẫn tự mang theo sẽ tính phí trực tiếp cho bạn với nhà cung cấp thượng nguồn và bỏ qua hoàn toàn việc chuyển đổi tín dụng Okou.

Đề xuất của Okou

Okou định vị GPT-5.5 là một mô hình tác nhân cốt lõi cho việc điều phối, công việc liên quan đến mã và các bước khác mà một câu trả lời sai sẽ tốn kém.

Tín dụng và cấp giá $$$

Okou định giá mọi mô hình Tích hợp theo thang tín dụng bốn bước — $, $$, $$$, $$$$ — được hiển thị dưới dạng huy hiệu trong bộ chọn mô hình và trên dòng price tier của zero model ls. GPT-5.5 nằm ở $$$. Cấp đó là số tiền bạn chi tiêu từ số dư tín dụng Okou của mình; giá niêm yết của nhà cung cấp trong bảng trên là số tiền nhà cung cấp thượng nguồn tính trước khi Okou chuyển đổi nó thành tín dụng.

Có sẵn trên Okou từ April 2026.