DeepSeek: DeepSeek V4 Pro
deepseek-v4-pro- Đầu vào / Đầu ra
- $0.66 / $1.98
- Ngữ cảnh
- 1M
- Ngày phát hành
- 24 thg 4, 2026
- Độ dài đầu ra tối đa
- 384K
- Phương thức
- Trò chuyện
- Khả năng
- Sử dụng công cụBộ nhớ đệm PromptSuy luận
Về DeepSeek V4 Pro
DeepSeek V4 Pro là mô hình lớn hơn trong thế hệ V4 của DeepSeek, một mô hình hỗn hợp chuyên gia (mixture-of-experts) có trọng số mở với tổng cộng 1,6 nghìn tỷ tham số và 49 tỷ tham số hoạt động. DeepSeek hướng nó đến việc lập trình tác nhân, toán học, suy luận STEM và kiến thức thế giới rộng lớn, nơi nó muốn cạnh tranh với các mô hình tiên phong đóng. Nó cung cấp các chế độ tư duy và không tư duy với ba mức độ nỗ lực, gọi công cụ và đầu ra JSON, và chỉ đọc văn bản.
Ưu điểm
- DeepSeek gọi đây là mô hình mã nguồn mở hiện đại nhất trên các tiêu chuẩn lập trình tác nhân và cho biết kiến thức thế giới của nó chỉ đứng sau Gemini 3.1 Pro.
- Chế độ tư duy có các mức nỗ lực thấp, cao và tối đa, vì vậy các bài toán toán học, STEM và gỡ lỗi khó có thể được cung cấp nhiều suy luận hơn nhiều so với các bài toán thông thường.
- Hỗ trợ gọi công cụ, đầu ra JSON và bộ nhớ đệm câu lệnh (prompt caching), vì vậy nó phù hợp với các vòng lặp tác nhân lặp lại một câu lệnh hệ thống dài.
- Trọng số là mở, vì vậy các nhóm tự lưu trữ có thể đánh giá cùng một dòng mô hình trước khi cam kết.
Khi nào nên chọn model khác
- Nó chỉ đọc văn bản; công việc với ảnh chụp màn hình và sơ đồ cần deepseek-v4.1-flash hoặc biến thể Flash vision-exp.
- Đây là mô hình V4 nặng hơn, vì vậy V4 Flash trả lời nhanh hơn khi tác vụ không cần thêm chiều sâu suy luận.
- Nỗ lực tối đa tạo ra suy luận dài làm tăng độ trễ và số token, và các cuộc hội thoại công cụ phải truyền văn bản suy luận qua lại mỗi lượt.
Bắt đầu
Tạo API key
Tạo API key trong Console để dùng cho mọi mô hình trên nền tảng.
Gửi yêu cầu đầu tiên của bạn
Sao chép ví dụ cho ngôn ngữ của bạn và chạy nó với endpoint.
Văn bản sang văn bảnResponses APIPOST/v1/responsesĐịnh dạng API:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "deepseek-v4-pro", "input": "Hello!" }'
Giá
Giá TokenLab áp dụng cho Verified, giúp tiết kiệm chi phí trên hầu hết các model. Giá Official là giá niêm yết từ nhà phát triển, áp dụng cho luồng Official ổn định hơn. Auto sẽ tính phí dựa trên luồng thực hiện thành công yêu cầu.
Khung giờ tính giá · Giờ thấp điểm
mỗi 1M token- Giá niêm yết
- Đầu vào $0.66 / Đầu ra $1.98 / Đọc bộ nhớ đệm $0.022 / Ghi bộ nhớ đệm $0.66
- Official
- Đầu vào $0.66 / Đầu ra $1.98 / Đọc bộ nhớ đệm $0.022 / Ghi bộ nhớ đệm $0.66
- Giảm giá
- —
Khung giờ tính giá · Giờ cao điểm
mỗi 1M token- Giá niêm yết
- Đầu vào $1.32 / Đầu ra $3.96 / Đọc bộ nhớ đệm $0.044 / Ghi bộ nhớ đệm $1.32
- Official
- Đầu vào $1.32 / Đầu ra $3.96 / Đọc bộ nhớ đệm $0.044 / Ghi bộ nhớ đệm $1.32
- Giảm giá
- —
Đọc bộ nhớ đệm
- Giá niêm yết
- $0.022
- Official
- $0.022
- Giảm giá
- —
Ghi bộ nhớ đệm
- Giá niêm yết
- $0.66
- Official
- $0.66
- Giảm giá
- —
| Giá niêm yếtmỗi 1M token | Officialmỗi 1M token | Giảm giá | |
|---|---|---|---|
| Khung giờ tính giá · Giờ thấp điểm | Đầu vào $0.66 / Đầu ra $1.98 / Đọc bộ nhớ đệm $0.022 / Ghi bộ nhớ đệm $0.66 | Đầu vào $0.66 / Đầu ra $1.98 / Đọc bộ nhớ đệm $0.022 / Ghi bộ nhớ đệm $0.66 | — |
| Khung giờ tính giá · Giờ cao điểm | Đầu vào $1.32 / Đầu ra $3.96 / Đọc bộ nhớ đệm $0.044 / Ghi bộ nhớ đệm $1.32 | Đầu vào $1.32 / Đầu ra $3.96 / Đọc bộ nhớ đệm $0.044 / Ghi bộ nhớ đệm $1.32 | — |
| Giá cache của prompt | |||
| Đọc bộ nhớ đệm | $0.022 | $0.022 | — |
| Ghi bộ nhớ đệm | $0.66 | $0.66 | — |
Sử dụng & hoạt động
Tỷ lệ thành công là tỷ lệ yêu cầu hoàn tất. Độ trễ là thời gian của một phản hồi đầy đủ; P95 nghĩa là 95% yêu cầu hoàn thành trong khoảng thời gian đó.
Mức sử dụng & tình trạng
24 giờ qua- Yêu cầu
- Tỷ lệ thành công
- Độ trễ P95
- Tổng token
- Tỷ lệ thành công 30 ngày
- 99,9%
- Lượt yêu cầu 30 ngày
- 100+
- Hoạt động gần nhất
- 3 giờ trước
Dữ liệu dựa trên các yêu cầu tổng hợp của người dùng, không bao gồm các kiểm tra trạng thái.
Mở trong Console
Mở DeepSeek V4 Pro trong Console để chỉnh sửa và gửi prompt ngay.
Giúp tôi thử deepseek-v4-pro với tin nhắn ngắn tại /v1/responses. Hiển thị phản hồi, độ trễ và chi phí.
Tình huống sử dụng
Phù hợp cho- Suy luận
Tác nhân lập trình tự động
Chạy nó như một trình lập kế hoạch trong thiết bị đầu cuối hoặc tác nhân IDE để chỉnh sửa nhiều tệp, chạy kiểm thử và phản ứng với các lỗi trong một phiên dài.
Suy luận kỹ thuật khó
Cung cấp cho nó các bằng chứng, thiết kế thuật toán, suy luận khoa học hoặc các lỗi đồng thời phức tạp và đặt nỗ lực suy luận ở mức tối đa cho lần chạy cuối cùng.
Trả lời câu hỏi nặng về kiến thức
Đặt các câu hỏi cần khả năng nhớ lại thực tế rộng rãi trên các lĩnh vực, chẳng hạn như so sánh các tiêu chuẩn hoặc giải thích cách hai công nghệ tương tác với nhau.
Tầng leo thang phía sau Flash
Gửi các yêu cầu thông thường đến V4 Flash và chỉ chuyển những yêu cầu không vượt qua kiểm tra hoặc cần phân tích sâu hơn cho Pro.
Ví dụ prompt
Phần phụ trợ này bị bế tắc (deadlock) khi chịu tải. Bản kết xuất luồng (thread dump) và hai mô-đun lấy khóa được đính kèm. Hãy tìm vấn đề thứ tự và viết bản vá.
Chứng minh rằng thuật toán dưới đây kết thúc và nêu độ phức tạp trường hợp xấu nhất của nó, sau đó chỉ ra bất kỳ đầu vào nào phá vỡ lập luận đó.
Lập kế hoạch di chuyển từ các trình xử lý REST của chúng tôi sang cổng mới, liệt kê các mô-đun bị ảnh hưởng theo thứ tự và chạy các bài kiểm tra sau mỗi bước bằng công cụ shell.
Mô hình này có giá theo điều kiện. Chỉ tổng token hàng tháng không thể tạo ước tính đáng tin cậy; hãy dùng bảng giá chi tiết theo thông số yêu cầu, bộ nhớ đệm và khung giờ áp dụng.
FAQ
Khi nào tôi nên sử dụng DeepSeek V4 Pro thay vì V4 Flash?
Sử dụng Pro cho lập trình tác nhân, suy luận khó và các câu hỏi cần kiến thức thực tế rộng. DeepSeek cho biết Flash gần đạt được hiệu quả về suy luận và công việc tác nhân đơn giản, vì vậy Pro quan trọng nhất khi Flash thực hiện sai tác vụ hoặc khi một sai lầm phải trả giá đắt.
Các mức nỗ lực tư duy trên DeepSeek V4 Pro hoạt động như thế nào?
Bạn bật tư duy và chọn thấp, cao hoặc tối đa. Cao là mặc định và phù hợp với các tác vụ tác nhân hàng ngày, thấp phù hợp với các tác vụ đơn giản và tối đa dành cho các vấn đề phức tạp nhất. Nỗ lực cao hơn đồng nghĩa với nhiều văn bản suy luận hơn và thời gian chờ đợi lâu hơn trước khi có câu trả lời.
DeepSeek V4 Pro có phải là mã nguồn mở không?
DeepSeek đã phát hành thế hệ V4 với trọng số mở, và mô hình Pro có tổng cộng 1,6 nghìn tỷ tham số với 49 tỷ tham số hoạt động mỗi token. Việc gọi nó thông qua API không yêu cầu lưu trữ bất cứ thứ gì; bản phát hành mở quan trọng nếu bạn muốn đánh giá hoặc tự lưu trữ cùng một dòng mô hình.
DeepSeek V4 Pro có chấp nhận hình ảnh không?
Không. Nó chỉ đọc và viết văn bản. DeepSeek cung cấp khả năng hiểu hình ảnh trong các mô hình dựa trên Flash riêng biệt, vì vậy quy trình làm việc cần cả ảnh chụp màn hình và suy luận khó phải chia nhỏ các bước giữa hai mô hình.
DeepSeek V4 Pro có hoạt động với OpenAI SDK hoặc Anthropic SDK không?
Cả hai. DeepSeek ghi lại khả năng tương thích với các định dạng API của OpenAI và Anthropic, vì vậy bạn có thể giữ ứng dụng khách hiện tại của mình và thay đổi tên mô hình cũng như URL cơ sở.
DeepSeek V4 Pro có giá bao nhiêu?
Trên TokenLab, DeepSeek V4 Pro có giá Đầu vào $0.66 / Đầu ra $1.98 mỗi 1M token. Bảng giá phía trên cho thấy chi tiết đầy đủ. Giá phụ thuộc vào đơn vị tính phí, thông số và mức sử dụng. Hãy so sánh các điều kiện tương đương trong bảng giá chi tiết của mô hình; một mức giá đơn lẻ không quyết định tổng chi phí.
Giới hạn ngữ cảnh và đầu ra của DeepSeek V4 Pro là bao nhiêu?
DeepSeek V4 Pro hỗ trợ tối đa 1.000.000 token ngữ cảnh và trả về tối đa 384.000 token mỗi phản hồi.
DeepSeek V4 Pro nên dùng endpoint nào?
Dùng https://api.tokenlab.sh/v1/responses làm mặc định cho DeepSeek V4 Pro. Nếu mô hình hỗ trợ định dạng native của nhà cung cấp, API workbench cũng hiển thị endpoint đó.
DeepSeek V4 Pro hỗ trợ những thao tác nào?
DeepSeek V4 Pro hỗ trợ Văn bản sang văn bản. Chọn một thao tác trong API workbench phía trên để xem endpoint và mã ví dụ tương ứng.
So sánh DeepSeek V4 Pro
Hướng dẫn sử dụng DeepSeek V4 Pro
- Giải pháp thay thế Venice AI API: Quyền riêng tư, Quyền truy cập mô hình và Mức độ phù hợp với nhà phát triển
- Giải pháp thay thế Together AI: Khi bạn cần sự đơn giản của Gateway, không phải hạ tầng
- Các mô hình AI tốt nhất để lập trình năm 2026: So sánh GPT-5.5, Claude Sonnet 5, Gemini 3.5 Flash và DeepSeek V4
Nguồn
Đánh giá ngày 2 thg 10, 2026