Thông số kỹ thuật
| Mục | DeepSeek-V4-Pro |
|---|---|
| Nhà cung cấp | DeepSeek |
| Tên mô hình API | deepseek-v4-pro |
| Base URLs | https://api.deepseek.com and https://api.deepseek.com/anthropic |
| Loại đầu vào | Text |
| Loại đầu ra | Text, tool calls, reasoning output |
| Độ dài ngữ cảnh | 1,000,000 tokens |
| Đầu ra tối đa | 384,000 tokens |
| Chế độ suy luận | Non-thinking, thinking (default) |
| Mặc định cho tác tử/lập trình | reasoning_effort can be set as high; complex agent requests may use max |
| Tính năng hỗ trợ | JSON Output, Tool Calls, Chat Prefix Completion (beta), FIM Completion (beta in non-thinking mode) |
| Bản phát hành local/open-weights | 1.6T total parameters, 49B activated parameters, FP4 + FP8 mixed precision |
| Giấy phép (thẻ mô hình) | MIT |
| Thẻ mô hình tham chiếu | DeepSeek-V4-Pro preview on Hugging Face |
DeepSeek-V4-Pro là gì?
DeepSeek-V4-Pro là thành viên mạnh hơn trong dòng bản xem trước V4 của DeepSeek. Thẻ mô hình chính thức mô tả đây là mô hình MoE với 1.6T tham số, 49B tham số kích hoạt và cửa sổ ngữ cảnh một triệu token, hướng tới công việc tri thức dài hạn, sinh mã và các tác vụ tác tử. Tài liệu API cung cấp nó qua bề mặt chat-completions chuẩn của DeepSeek và hỗ trợ cả phong cách SDK của OpenAI và Anthropic.
Tính năng chính
- Ngữ cảnh triệu token: DeepSeek ghi nhận độ dài ngữ cảnh 1M token, giúp mô hình phù hợp với bộ tài liệu rất lớn, kho mã, và phiên tác tử nhiều bước.
- Hai chế độ suy luận: API hỗ trợ chế độ không suy luận và suy luận; suy luận là mặc định, và tài liệu lưu ý rằng các yêu cầu tác tử phức tạp như Claude Code hoặc OpenCode có thể tự động dùng nỗ lực
max. - Hỗ trợ gọi công cụ: Chế độ suy luận của DeepSeek hỗ trợ gọi công cụ, điều này quan trọng cho các tác tử cần tìm kiếm, thao tác tệp hoặc chức năng bên ngoài.
- Hiệu quả ngữ cảnh dài: Thẻ mô hình cho biết V4 dùng thiết kế chú ý lai với Compressed Sparse Attention và Heavily Compressed Attention để giảm chi phí tính toán ngữ cảnh dài và bộ nhớ đệm KV so với V3.2. citeturn980363view2
- Tập trung vào lập trình và suy luận: DeepSeek cho biết chế độ suy luận V4-Pro-Max cải thiện các thước đo lập trình và thu hẹp đáng kể khoảng cách với các mô hình đóng hàng đầu về tác vụ suy luận và tác tử. citeturn980363view2
- Linh hoạt về SDK: Có thể truy cập qua chat completions tương thích OpenAI tiêu chuẩn hoặc qua endpoint tương thích Anthropic của DeepSeek cho các quy trình công cụ.
Hiệu năng trên benchmark
Thẻ mô hình chính thức của DeepSeek báo cáo các kết quả đánh giá sau cho dòng mô hình base và bộ so sánh V4-Pro-Max. Trong bảng mô hình base, V4-Pro đạt điểm cao hơn V3.2-Base trên một số benchmark kiến thức và ngữ cảnh dài, bao gồm MMLU-Pro (73.5 so với 65.5), FACTS Parametric (62.6 so với 27.1), và LongBench-V2 (51.5 so với 40.2).
| Benchmark | V3.2-Base | V4-Flash-Base | V4-Pro-Base |
|---|---|---|---|
| MMLU-Pro (EM) | 65.5 | 68.3 | 73.5 |
| FACTS Parametric (EM) | 27.1 | 33.9 | 62.6 |
| HumanEval (Pass@1) | 62.8 | 69.5 | 76.8 |
| LongBench-V2 (EM) | 40.2 | 44.7 | 51.5 |
Cùng thẻ mô hình đó cũng cho thấy V4-Pro-Max vẫn cạnh tranh với các mô hình tiên tiến hàng đầu trên một số tác vụ. Ví dụ, mô hình đạt 87.5 trên MMLU-Pro, 57.9 trên SimpleQA-Verified, 90.1 trên GPQA Diamond, và 67.9 trên Terminal Bench 2.0 trong bảng so sánh đã công bố.
DeepSeek-V4-Pro so với DeepSeek-V4-Flash và DeepSeek-V3.2
| Mô hình | Phù hợp nhất | Ngữ cảnh | Ghi chú |
|---|---|---|---|
| DeepSeek-V4-Pro | Suy luận nặng, lập trình, tác tử, tài liệu lớn | 1M | Mô hình V4 lớn nhất, 49B tham số kích hoạt, năng lực tổng thể mạnh nhất trong dòng. citeturn980363view2turn980363view0 |
| DeepSeek-V4-Flash | Nhanh hơn, nhẹ hơn cho sử dụng chung | 1M | Mô hình nhỏ hơn 284B/13B, vẫn hỗ trợ suy luận và gọi công cụ. citeturn980363view2turn980363view0 |
| DeepSeek-V3.2 | Thế hệ trước cho ngữ cảnh dài | 128K trong tài liệu API trước; V4 dùng thiết kế ngữ cảnh 1M khác | Hữu ích làm mốc tham chiếu cho cải tiến hiệu suất; thẻ mô hình của V4-Pro báo cáo giảm mạnh FLOPs ngữ cảnh dài và bộ nhớ đệm KV so với V3.2. citeturn321011view1turn980363view2 |
Trường hợp sử dụng tốt nhất
- Trợ lý lập trình và công cụ tái cấu trúc ở quy mô kho mã
- Phân tích và tổng hợp tài liệu dài
- Tác tử sử dụng công cụ cần suy luận nhiều lượt
- Quy trình hỗ trợ kỹ thuật hưởng lợi từ bộ nhớ dài và đầu ra có cấu trúc
- Nhiệm vụ tri thức tiếng Trung và đa ngôn ngữ, nơi thẻ mô hình cho thấy hiệu năng benchmark mạnh
Cách truy cập và sử dụng Deepseek v4 pro API
Bước 1: Đăng ký lấy API Key
Đăng nhập vào cometapi.com. Nếu bạn chưa là người dùng, vui lòng đăng ký trước. Đăng nhập vào CometAPI console. Lấy khóa API thông tin xác thực của giao diện. Nhấp “Add Token” tại mục API token trong trung tâm cá nhân, lấy khóa token: sk-xxxxx và gửi.
Bước 2: Gửi yêu cầu tới Deepseek v4 proAPI
Chọn endpoint “deepseek-v4-pro” để gửi yêu cầu API và thiết lập phần thân yêu cầu. Phương thức yêu cầu và phần thân yêu cầu được lấy từ tài liệu API trên trang web của chúng tôi. Trang web cũng cung cấp bài kiểm thử Apifox để bạn tiện sử dụng. Thay thế <YOUR_API_KEY> bằng khóa CometAPI thực tế từ tài khoản của bạn. Where to call it: Anthropic Messages format and Chat format.
Chèn câu hỏi hoặc yêu cầu của bạn vào trường content—đây là nội dung mô hình sẽ phản hồi. Xử lý phản hồi API để lấy câu trả lời được tạo ra.
Bước 3: Nhận và xác minh kết quả
Xử lý phản hồi API để lấy câu trả lời được tạo. Sau khi xử lý, API phản hồi trạng thái tác vụ và dữ liệu đầu ra. Bật các tính năng như streaming, bộ nhớ đệm prompt hoặc xử lý ngữ cảnh dài thông qua các tham số tiêu chuẩn.