Tất cả các mô hình

Claude Opus 4.7: Mô hình lý luận Anthropic

Mô hình Claude 4 hàng đầu của Anthropic. Lựa chọn mạnh nhất trong dòng sản phẩm cho các vòng lặp tác nhân dài hạn, suy luận khó và chỉnh sửa mã lần đầu.

1M tokens · Text / Vision / Code · Prompt cache

Okou không còn chạy Claude Opus 4.7. Trang này được giữ lại làm tài liệu tham khảo cho các thông số kỹ thuật, giá cả và điểm chuẩn của nó. Đối với cùng loại công việc, hãy sử dụng GPT 5.6 Luna.

Xem GPT 5.6 Luna

Claude Opus 4.7 là mô hình bạn tìm đến khi công việc phải đúng ngay từ đầu: mã biên dịch sạch sẽ, các kế hoạch nhiều bước không bị mất mạch trong các chuỗi công cụ dài, các câu đố trừu tượng mà các mô hình nhỏ hơn gặp khó khăn. Các điểm chuẩn của nhà cung cấp (SWE-bench Verified, Terminal-Bench 2.0, ARC AGI 2, OSWorld, BrowseComp) đưa ra các con số cụ thể về những cải tiến so với Opus 4.6.

Giá niêm yết của nhà cung cấp là 5 đô la / 25 đô la cho mỗi 1M token với đầu vào được lưu trong bộ nhớ cache là 0.50 đô la / 1M, cao nhất trong dòng Claude. Mô hình hiệu quả về chi phí là giữ Sonnet 4.6 làm mặc định và chỉ chuyển các bước khó nhất cho Opus.

Claude Opus 4.7 là gì?

Tháng 4 năm 2026 (kế nhiệm Opus 4.6) · Cấp cao nhất của dòng Claude 4. Nâng cấp được Anthropic khuyến nghị cho người dùng Opus 4.6.

Claude Opus 4.7 là sản phẩm chủ lực của dòng Claude 4 của Anthropic, được phát hành vào tháng 4 năm 2026 dưới dạng bản nâng cấp được khuyến nghị từ Opus 4.6. Anthropic coi đây là một bước nhảy vọt về mã hóa tác nhân và lý luận trừu tượng chứ không phải là một bản làm mới trên bề mặt API. Cửa sổ ngữ cảnh 1M token và các cấp độ nỗ lực suy nghĩ thích ứng được giới thiệu trong 4.6 vẫn giữ nguyên, vì vậy mã tác nhân hiện có có thể sử dụng mà không cần viết lại.

So với Sonnet 4.6 (công cụ chính trong cùng dòng), Opus đầu tư nhiều tính toán hơn cho mỗi token. Hiệu quả hành vi thể hiện ở ba điểm: ít bỏ sót hướng dẫn hơn trong các vòng lặp tác nhân dài, các bản vá mã lần đầu tốt hơn đáng kể và khả năng nhớ lại mạnh mẽ hơn khi lịch sử cuộc trò chuyện vượt quá 100K token. Đánh đổi là giá niêm yết cao nhất trong dòng Claude (5 đô la / 25 đô la cho mỗi 1 triệu token) và tốc độ đầu ra mỗi token chậm hơn, đó là lý do tại sao bản thân Anthropic định vị Opus là người điều phối hoặc cấp độ leo thang chứ không phải là mặc định ở mọi nơi.

Các bảng xếp hạng độc lập (Artificial Analysis, Vellum) xác nhận thứ tự tương đối so với Opus 4.6, nhưng các con số tuyệt đối thay đổi hàng tuần và OpenAI đã gắn cờ ô nhiễm dữ liệu đào tạo trên SWE-bench Verified trên tất cả các mô hình tiên tiến. Hãy coi các điểm số công khai là định hướng chứ không phải là có thẩm quyền; sự khác biệt hành vi có cấu trúc (tính nhất quán vòng lặp dài, chất lượng bản vá lần đầu, độ tin cậy định tuyến đa công cụ) là tín hiệu bền vững hơn.

Thông số kỹ thuật nhanh

Gia đìnhThế hệ Claude 4
Phương thứcVăn bản, thị giác, mã
Ngôn ngữƯu tiên tiếng Anh, đa ngôn ngữ
Bộ nhớ đệm lời nhắcĐược hỗ trợ (Anthropic)
Cửa sổ ngữ cảnh1M token
Đầu ra tối đaLên đến 64K token
Mức độ nỗ lựcThấp / Trung bình / Cao / Tối đa
Giá niêm yết của nhà cung cấpĐầu vào 5 đô la / đầu ra 25 đô la cho mỗi 1 triệu

Điểm chuẩn Claude Opus 4.7

Điểm số do nhà cung cấp báo cáo từ tài liệu phát hành Opus 4.7 của Anthropic, với các sai lệch được hiển thị so với số Opus 4.6 công khai. Các đánh giá độc lập đặt 4.7 vượt trội hơn GPT-5.2 trong hầu hết các tác vụ mã hóa tác nhân và trong vòng vài điểm so với Gemini 3 Pro về lý luận trừu tượng. Coi các tỷ lệ phần trăm tuyệt đối là định hướng; OpenAI đã gắn cờ ô nhiễm dữ liệu đào tạo trên SWE-bench Verified trên tất cả các mô hình tiên tiến.

Đã xác minh SWE-benchdo nhà cung cấp báo cáo; tăng từ 80,8% của Opus 4.6
~83.5%
SWE-bench Prodo nhà cung cấp báo cáo
Dẫn đầu dòng Claude khi phát hành
Terminal-Bench 2.0do nhà cung cấp báo cáo; tăng từ 65,4% của Opus 4.6
~71%
τ2-bench Bán lẻsử dụng công cụ do nhà cung cấp báo cáo
~93%
OSWorld (sử dụng máy tính)do nhà cung cấp báo cáo; tăng từ 72,7% của Opus 4.6
~76%
BrowseCompcác tác vụ web do nhà cung cấp báo cáo
~88%
ARC AGI 2do nhà cung cấp báo cáo; tăng từ 68,8% của Opus 4.6
~75%
Kỳ thi cuối cùng của nhân loại (có công cụ)do nhà cung cấp báo cáo
Dẫn đầu dòng Claude
GPQA Diamondkhoa học cấp độ sau đại học do nhà cung cấp báo cáo
~92%
MRCR v2 (1M, 8 kim)khả năng nhớ ngữ cảnh dài
Cải thiện so với 76% của 4.6
MMMU Pro (đa phương thức)do nhà cung cấp báo cáo
Dẫn đầu dòng Claude

Giá Claude Opus 4.7

Giá niêm yết của nhà cung cấp, trên 1 triệu token.

Đầu vào$5.00
Đầu ra$25.00
Đọc bộ nhớ cache$0.50
Ghi bộ nhớ cache$6.25

Cách Claude Opus 4.7 hoạt động trong thực tế

Hành vi được quan sát từ các lần chạy tác nhân sản xuất.

Định tuyến công cụ

Tỷ lệ cuộc gọi công cụ bị định tuyến sai thấp nhất trong dòng Claude. Khoảng cách so với Sonnet 4.6 mở rộng trong các trường hợp khó như lựa chọn công cụ có điều kiện, đối số lồng sâu và các cuộc gọi công cụ được gửi sau thời gian dài suy luận.

Khả năng nhớ ngữ cảnh dài

Đồng nhất trên hơn 200K bản ghi tác nhân mã thông báo. Cửa sổ 1M mã thông báo giữ vững tốt hơn nhiều so với các phiên bản trước nhờ các cải tiến về xoay vòng ngữ cảnh mà Anthropic đã giới thiệu trong Opus 4.6 và tinh chỉnh thêm cho 4.7. MRCR v2 do nhà cung cấp báo cáo ở 1M cho thấy một sự cải thiện đáng kể so với 76% của Opus 4.6.

Chỉnh sửa mã lần đầu

Chất lượng bản vá mạnh nhất trong dòng Claude. Lựa chọn đúng đắn khi một tác nhân phải sửa đổi mã phải tiếp tục biên dịch và vượt qua các bài kiểm tra, đặc biệt khi bản vá trải dài nhiều tệp. Kết quả Terminal-Bench 2.0 của Anthropic phản ánh trực tiếp điều này.

Tốc độ

Chậm hơn Sonnet 4.6 và chậm hơn đáng kể so với Kimi K2.7 Code. Anthropic xuất bản ~41 token/giây ở mức nỗ lực tối đa cho Opus 4.6, và 4.7 nằm trong phạm vi tương tự. Dành nó cho các bước thực sự cần độ sâu lý luận bổ sung và chạy các cấp nhẹ hơn song song.

Hành vi ảo giác

Opus 4.7 giữ nguyên lập trường từ chối thận trọng của Anthropic và có xu hướng thừa nhận sự không chắc chắn hơn là bịa đặt, đó là lý do tại sao các nhóm sản xuất tiếp tục trả phí bảo hiểm cho lý luận có tính rủi ro cao mặc dù các lựa chọn thay thế mã nguồn mở rẻ hơn như Kimi K2.7 Code và DeepSeek V4 Pro hiện đã sánh ngang với nó trên các tiêu chuẩn.

Các tác vụ tác nhân tốt nhất cho Claude Opus 4.7

Đánh giá PR phát hiện những gì con người bỏ lỡ

Khi một yêu cầu kéo thay đổi 30 tệp, Opus 4.7 giữ toàn bộ thay đổi trong bộ nhớ làm việc và viết một đánh giá liên kết những gì đã thay đổi trong auth/middleware.ts với kiểm thử mà nó đã phá vỡ trong routes/admin.test.ts. Các nhà đánh giá cấp dưới nhận được loại phản hồi đa tệp mà các kỹ sư cấp cao thường phát hiện trong lần kiểm tra thứ hai, và nhóm phát hành ít bản vá hơn vượt qua CI nhưng bị lỗi trong sản xuất.

Chạy nghiên cứu đọc toàn bộ tài liệu

Thả một bản nháp hợp đồng dài 200 trang, ba đề xuất của đối thủ cạnh tranh và các ý kiến pháp lý của quý trước vào cửa sổ ngữ cảnh 1M token, sau đó yêu cầu Opus gắn cờ mọi điều khoản chặt chẽ hơn thị trường và liệt kê các điểm đàm phán có thể xảy ra. Các mô hình nhỏ hơn bắt đầu bỏ qua các phần trước đó sau 100K token; Opus giữ toàn bộ bức tranh trong tầm nhìn và tham chiếu chính xác đoạn văn mà nó đang trích dẫn.

Người điều phối đang chạy một kế hoạch đa công cụ

Sử dụng Opus 4.7 làm công cụ lập kế hoạch chia yêu cầu của khách hàng thành mười bước, gửi mỗi bước cho một tác nhân phụ Sonnet hoặc tiết kiệm chi phí và ghép nối các kết quả lại với nhau. Chạy Opus chỉ ở lớp lập kế hoạch (và các cấp rẻ hơn ở mọi nơi khác) tốn một phần nhỏ chi phí so với chạy Opus từ đầu đến cuối, với hầu hết chất lượng được giữ nguyên.

Các chỉnh sửa mã thử nghiệm đầu tiên không lãng phí một lần chạy CI

Yêu cầu Opus 4.7 di chuyển một cơ sở mã 50 tệp từ ORM này sang ORM khác, tái cấu trúc một mô-đun phức tạp hoặc áp dụng một bản vá bảo mật trên toàn bộ kho lưu trữ. Bản vá được áp dụng sạch sẽ ngay lần thử đầu tiên thường xuyên hơn bất kỳ mô hình nào khác trong dòng, điều mà Terminal-Bench 2.0 do nhà cung cấp báo cáo phản ánh, và hóa đơn CI của bạn cũng sẽ phản ánh điều đó.

Khi nào nên bỏ qua Claude Opus 4.7

Bỏ qua Opus 4.7 trong các công việc thường ngày có khối lượng lớn mà Sonnet 4.6 đạt được cùng chất lượng với chi phí chỉ bằng một phần nhỏ, trong các phản hồi trò chuyện nhạy cảm về độ trễ mà Kimi K2.7 Code nhanh hơn nhiều, và trong các công việc phân loại hoặc trích xuất hàng loạt mà GPT-5.4 Mini là tùy chọn hàng loạt được hỗ trợ rẻ hơn.

Claude Opus 4.7 so với các mô hình khác

Claude Opus 4.7 so với Claude Sonnet 4.6

Sonnet 4.6 là mô hình mặc định chủ lực trong dòng Claude và là lựa chọn phù hợp cho hầu hết các tác nhân. Chỉ nâng cấp lên Opus 4.7 khi Sonnet rõ ràng thất bại trong lý luận khó, ngữ cảnh dài hoặc chỉnh sửa mã lần đầu, thường là với vai trò điều phối viên ủy quyền xuống các tác nhân phụ cấp Sonnet hoặc tiết kiệm chi phí.

Claude Opus 4.7 so với Claude Opus 4.6

Cùng cửa sổ ngữ cảnh (1M token), cùng giá nhà cung cấp và cùng kiến trúc tư duy thích ứng. Opus 4.7 là thế hệ mới hơn với các cải tiến được nhà cung cấp báo cáo trên SWE-bench Verified, Terminal-Bench 2.0, ARC AGI 2 và OSWorld. Chọn 4.7 cho các tác nhân mới; chỉ ghim 4.6 khi một tác nhân hiện có đã được xác thực với phiên bản đó và bạn cần sự ổn định về hành vi.

Điểm mấu chốt: bạn có nên sử dụng Claude Opus 4.7 không?

Opus 4.7 là cấp độ leo thang. Mặc định là Sonnet 4.6; chỉ nâng cấp lên Opus ở các bước cụ thể khi Sonnet thất bại rõ rệt.

Các câu hỏi thường gặp

Cửa sổ ngữ cảnh của Claude Opus 4.7 là gì?

1 triệu token, với tối đa 64K token đầu ra cho mỗi phản hồi. Cửa sổ đầy đủ tính phí theo tỷ lệ tiêu chuẩn. Yêu cầu 900K token có cùng tỷ lệ mỗi token với yêu cầu 9K token.

Claude Opus 4.7 có thể xử lý hình ảnh không?

Có. Opus 4.7 là đa phương thức. Nó chấp nhận đầu vào hình ảnh cùng với văn bản và mã, vì vậy các tác nhân dựa trên ảnh chụp màn hình và tầm nhìn tài liệu hoạt động nguyên bản.

Khi nào tôi nên chọn Opus 4.7 thay vì Sonnet 4.6?

Khi (a) tác nhân là người lập kế hoạch / điều phối và các quyết định được đưa ra theo tầng, (b) quá trình chạy đủ dài để Sonnet bắt đầu bỏ qua các hướng dẫn, hoặc (c) đầu ra phải áp dụng sạch sẽ ngay từ lần thử đầu tiên (chỉnh sửa mã, tải trọng có cấu trúc).

Opus 4.7 có hỗ trợ bộ nhớ đệm nhắc nhở không?

Có. Đầu vào được lưu trong bộ nhớ cache được tính phí 0,50 đô la cho mỗi 1 triệu token. Giảm giá 10 lần cho phần được lưu trong bộ nhớ cache. Đáng để sử dụng bất cứ khi nào lời nhắc hệ thống hoặc lược đồ công cụ của bạn ổn định trên các cuộc gọi.

Các lựa chọn thay thế

Khả dụng của Claude Opus 4.7 trên Okou

Claude Opus 4.7 đã bị xóa khỏi danh sách Okou, vì vậy không thể chọn nó trong trò chuyện hoặc trong quy trình làm việc, và nó không khả dụng với khóa API của riêng bạn. GPT 5.6 Luna bao gồm cùng một cấp tiết kiệm chi phí.