Tất cả các mô hình

DeepSeek V4 Pro: một mô hình lý luận 1M token

Mô hình lý luận hàng đầu V4 của DeepSeek. Trong vòng 0,2 điểm so với Claude Opus 4.6 trên SWE-bench Verified với chi phí bằng một phần bảy của nhà cung cấp. Claude-tương thích API.

1M tokens · Text / Code · Prompt cache

DeepSeek V4 Pro là sản phẩm chủ lực của thế hệ V4 của DeepSeek — một mô hình MoE 1.6T tham số mã nguồn mở theo giấy phép MIT. Điểm nổi bật là tỷ lệ giá-chất lượng: SWE-bench Verified do nhà cung cấp báo cáo là 80,6%, chỉ kém một phần nhỏ so với Claude Opus 4.6, với chi phí của nhà cung cấp chỉ bằng khoảng một phần bảy của Anthropic. Điều đó làm cho các tác nhân nặng về suy luận — đánh giá PR hàng loạt, phân tích tài liệu hàng loạt, tóm tắt theo lịch trình — trở nên phải chăng với khối lượng lớn.

Giá niêm yết của nhà cung cấp là 1,74 đô la / 3,48 đô la cho mỗi 1 triệu token với đọc bộ nhớ cache ở mức 0,028 đô la / 1 triệu và ghi bộ nhớ cache miễn phí (độc đáo trong danh mục). Ngữ cảnh 1 triệu token, Anthropic tương thích API. Hãy chọn Sonnet 4.6 khi độ tin cậy định tuyến công cụ sản xuất là yếu tố quyết định, và GPT-5.4 Mini hoặc Kimi K2.7 Code khi công việc hàng loạt một lần không cần chiều sâu suy luận của V4 Pro.

DeepSeek V4 Pro là gì?

Ngày 24 tháng 4 năm 2026 · Biến thể suy luận của dòng DeepSeek V4, tập trung vào chất lượng suy luận tối đa.

DeepSeek V4 Pro là sản phẩm chủ lực của thế hệ V4 của DeepSeek, được phát hành vào ngày 24 tháng 4 năm 2026 theo Giấy phép MIT. Đây là một mô hình Mixture-of-Experts có trọng lượng mở với tổng số 1.6T tham số và 49B tham số hoạt động trên mỗi token.

V4 Pro hỗ trợ cửa sổ ngữ cảnh 1M token, đầu ra tối đa 384K, ba chế độ nỗ lực suy luận (tiêu chuẩn, suy nghĩ, suy nghĩ tối đa), đầu ra JSON, gọi công cụ và hoàn thành FIM ở chế độ không suy nghĩ. Mô hình Pro bổ sung kiến trúc chú ý lai (Chú ý thưa thớt nén + Chú ý nén mạnh) để cải thiện đáng kể hiệu quả ngữ cảnh dài. 27% FLOP suy luận một token và 10% bộ nhớ đệm KV so với DeepSeek V3.2 ở ngữ cảnh 1M.

Điều gì đáng chú ý về DeepSeek V4 Pro

Kiến trúc tiêu đề và các tính năng khả năng.

V4 Pro là một mô hình Mixture-of-Experts với tổng cộng 1.6T tham số và 49B hoạt động trên mỗi token, được hỗ trợ bởi một ngăn xếp chú ý lai (Compressed Sparse Attention cộng với Heavily Compressed Attention) giúp suy luận ngữ cảnh dài rẻ. Nó hỗ trợ cửa sổ ngữ cảnh 1M token với tối đa 384K đầu ra, ba chế độ nỗ lực suy luận (tiêu chuẩn, suy nghĩ và suy nghĩ tối đa), và sử dụng Manifold-Constrained Hyper-Connections để truyền tín hiệu ổn định. Mô hình được đào tạo trên 32T+ token với bộ tối ưu hóa Muon và được phát hành theo Giấy phép MIT với trọng số mở.

Thông số kỹ thuật nhanh

Gia đìnhDòng DeepSeek V4
Tham sốTổng 1.6T / 49B hoạt động (MoE)
Phương thứcVăn bản, mã
Ngôn ngữĐa ngôn ngữ
Cửa sổ ngữ cảnh1M token
Đầu ra tối đa384K token
Giấy phépMIT (trọng số mở)

Điểm chuẩn DeepSeek V4 Pro

Điểm số do nhà cung cấp báo cáo từ bản phát hành V4 Pro của DeepSeek. Các đánh giá độc lập (Geeky Gadgets, Code Arena) xếp V4 Pro thứ ba trên Code Arena sau GLM-5.1 và Kimi K2.7 Code. Các tuyên bố về điểm chuẩn mạnh nhất đến từ tài liệu của DeepSeek. Hãy xem xét theo hướng chứ không phải là sự thật tuyệt đối.

Đã xác minh SWE-benchdo nhà cung cấp báo cáo; trong vòng 0,2 điểm so với Opus 4.6
80.6%
Terminal-Bench 2.0do nhà cung cấp báo cáo; dẫn đầu Opus 4.6
67.9%
LiveCodeBenchdo nhà cung cấp báo cáo
93.5%
Xếp hạng Codeforcesdo nhà cung cấp báo cáo
3206
MMLU-Prodo nhà cung cấp báo cáo
Phù hợp với GPT-5.4
Chỉ số trí tuệ phân tích nhân tạonỗ lực tối đa
52
Tốc độPhân tích nhân tạo
~36 token/giây

Giá DeepSeek V4 Pro

Giá niêm yết của nhà cung cấp, trên 1 triệu token.

Đầu vào$1.74
Đầu ra$3.48
Đọc bộ nhớ cache$0.14
Ghi bộ nhớ cacheKhông tính phí

Cách DeepSeek V4 Pro hoạt động trong thực tế

Hành vi được quan sát từ các lần chạy tác nhân sản xuất.

Lý luận

Lý luận sub-Sonnet mạnh nhất trong dòng sản phẩm của chúng tôi. Giữ vững trong công việc nhiều bước nơi các mô hình rẻ hơn bắt đầu trôi dạt. MMLU-Pro do nhà cung cấp báo cáo khớp với GPT-5.4.

Điểm chuẩn mã hóa

Nhà cung cấp báo cáo SWE-bench Đã xác minh 80,6% (trong vòng 0,2 của Opus 4.6), Terminal-Bench 2.0 67,9% (dẫn đầu Opus 4.6), LiveCodeBench 93,5%.

Hiệu quả chi phí

Cấp độ $ Built-in làm cho V4 Pro trở thành một lựa chọn lập luận tiết kiệm chi phí trong khi vẫn giữ được tính cạnh tranh với Sonnet 4.6.

Tốc độ

Khoảng 36 token/giây ở mức tối đa theo Artificial Analysis. Chậm hơn Kimi K2.7 Code, hơi chậm hơn Opus 4.6.

Các tác vụ tác nhân tốt nhất cho DeepSeek V4 Pro

Tác nhân đánh giá PR chạy trên mỗi lần commit

Độ chính xác cấp Sonnet với một phần nhỏ chi phí nhà cung cấp của Sonnet là điều khiến "xem xét mọi commit, không chỉ các PR lớn" thực sự khả thi. V4 Pro đọc diff, các tệp liên quan và vấn đề được liên kết, sau đó viết một bình luận có cấu trúc — và giá mỗi cuộc gọi đủ thấp để chạy nó như một bước CI trên mỗi lần đẩy không xuất hiện như một mục đáng chú ý.

Bộ tóm tắt theo lịch trình chạy mỗi đêm

Kéo các cuộc trò chuyện của khách hàng, phiếu hỗ trợ hoặc cuộc gọi bán hàng của ngày hôm qua và viết một bản tóm tắt. Lời nhắc hệ thống và lược đồ công cụ không thay đổi giữa các lần chạy, và DeepSeek không tính phí ghi vào bộ nhớ đệm — vì vậy tiền tố cố định dài được thanh toán một lần và việc đọc từ bộ nhớ đệm chỉ tốn một phần nhỏ so với đầu vào thông thường. Đây là lúc mô hình định giá của V4 Pro thực sự thay đổi những gì có thể chi trả được.

Tác nhân mã toàn bộ kho lưu trữ có chi phí thấp hơn Opus

Ngữ cảnh 1M token với sự chú ý lai (Compressed Sparse Attention cộng với Heavily Compressed Attention) có nghĩa là một cơ sở mã cỡ trung bình có thể nằm gọn trong một lời nhắc và chi phí suy luận vẫn có thể quản lý được khi cửa sổ đầy lên. Đối với các lần tái cấu trúc đa tệp và đánh giá cấp kiến trúc, đây là nơi bạn có được quy trình làm việc kiểu Opus "xem mọi thứ cùng một lúc" mà không phải trả hóa đơn kiểu Opus.

Khi nào nên bỏ qua DeepSeek V4 Pro

Bỏ qua V4 Pro trong các trường hợp khó nhất về định tuyến công cụ mà Sonnet 4.6 vẫn dẫn đầu, và trong công việc một lần hàng loạt mà GPT-5.4 Mini hoặc Kimi K2.7 Code là đủ với chi phí thấp hơn.

DeepSeek V4 Pro so với các mô hình khác

DeepSeek V4 Pro so với Claude Sonnet 4.6

Sonnet 4.6 vẫn là lựa chọn đáng tin cậy hơn cho các trường hợp khó định tuyến công cụ. V4 Pro có chi phí thấp hơn và cạnh tranh trên các điểm chuẩn mã hóa do nhà cung cấp báo cáo. A/B-test cả hai trên một tác nhân thực tế trước khi tiêu chuẩn hóa.

Điểm mấu chốt: bạn có nên sử dụng DeepSeek V4 Pro không?

Lọc trước bằng GPT-5.4 Mini hoặc Kimi K2.7 Code, nâng cấp lên V4 Pro để suy luận, chỉ nâng cấp lên Sonnet 4.6 khi V4 Pro bị kẹt ở các trường hợp biên định tuyến công cụ.

Các câu hỏi thường gặp

DeepSeek V4 Pro được phát hành khi nào?

DeepSeek phát hành V4 Pro vào ngày 24 tháng 4 năm 2026 theo Giấy phép MIT với trọng số mở.

Tại sao việc ghi vào bộ nhớ đệm lại miễn phí?

DeepSeek không tính phí phần ghi vào bộ nhớ cache. Chỉ các lần đọc bộ nhớ cache mới tính phí, ở mức 0,145 đô la cho mỗi 1 triệu token. Các lời nhắc hệ thống ổn định và các ngữ cảnh tham chiếu lớn không tốn thêm chi phí để lưu vào bộ nhớ cache.

Cửa sổ ngữ cảnh của V4 Pro là gì?

1 triệu token với tối đa 384K token đầu ra. Kiến trúc chú ý lai làm cho toàn bộ cửa sổ có thể sử dụng được với chi phí suy luận thấp hơn nhiều so với V3.2.

V4 Pro so sánh với Claude Opus 4.6 như thế nào?

SWE-bench Verified do nhà cung cấp báo cáo nằm trong khoảng 0,2 điểm (80,6 so với 80,8). Terminal-Bench 2.0 ưu tiên V4 Pro (67,9 so với 65,4). Opus 4.6 dẫn đầu về HLE (40,0 so với 37,7) và toán HMMT 2026 (96,2 so với 95,2). Với chi phí nhà cung cấp thấp hơn ~7 lần, V4 Pro là lựa chọn đúng đắn khi chất lượng suy luận là tiêu chuẩn nhưng chi phí lại quan trọng.

Sử dụng DeepSeek V4 Pro trên Okou

Hai cách truy cập DeepSeek V4 Pro trên Okou

Okou hỗ trợ DeepSeek V4 Pro dưới dạng mô hình tích hợp được tính phí bằng tín dụng Okou, và thông qua việc tự mang theo với DeepSeek API key. Đường dẫn tích hợp sử dụng định tuyến được quản lý Okou và cấp giá được giải thích bên dưới; đường dẫn tự mang theo sẽ tính phí trực tiếp cho bạn với nhà cung cấp thượng nguồn và bỏ qua hoàn toàn việc chuyển đổi tín dụng Okou.

Đề xuất của Okou

Okou định vị DeepSeek V4 Pro như một lựa chọn tiết kiệm chi phí cho việc phân loại hàng loạt, bộ lọc trước, phản hồi nhạy cảm với độ trễ và các công việc khối lượng lớn khác.

Tín dụng và cấp giá $

Okou định giá mọi mô hình Tích hợp theo thang tín dụng bốn bước — $, $$, $$$, $$$$ — được hiển thị dưới dạng huy hiệu trong bộ chọn mô hình và trên dòng price tier của zero model ls. DeepSeek V4 Pro nằm ở $. Cấp đó là số tiền bạn chi tiêu từ số dư tín dụng Okou của mình; giá niêm yết của nhà cung cấp trong bảng trên là số tiền nhà cung cấp thượng nguồn tính trước khi Okou chuyển đổi nó thành tín dụng.

Có sẵn trên Okou từ August 12, 2026.