Bài viết


DeepSeek đã chính thức đưa DeepSeek V4 Pro 0813 ra khỏi giai đoạn preview sau gần bốn tháng thử nghiệm. Theo bài phân tích của Unite.AI, phiên bản này xuất hiện trên OpenRouter ngày 12/08/2026 và hiện phục vụ qua endpoint deepseek-v4-pro trên API của hãng. Khác biệt được xác nhận rõ nhất không phải một tuyên bố “đột phá” mới, mà là trạng thái sẵn sàng cho production.
Về cấu hình, đây là model MoE quy mô lớn: 1,6 nghìn tỷ tham số tổng cộng, nhưng chỉ kích hoạt 49 tỷ tham số mỗi token. DeepSeek công bố cửa sổ ngữ cảnh tới 1 triệu token, đầu ra tối đa 384.000 token. API vẫn hỗ trợ tool calling, JSON output, chuẩn OpenAI ChatCompletions và Anthropic Messages — các mảnh ghép thiết yếu nếu đội ngũ muốn cắm model vào Workflow hiện có.
Mức giá cũng khiến các đội làm sản phẩm phải để mắt: 0,435 USD/triệu token đầu vào khi cache miss, 0,003625 USD khi cache hit và 0,87 USD/triệu token đầu ra. Với tác vụ lặp lại system prompt dài hoặc bộ tài liệu dùng chung, chênh lệch cache hit có thể thay đổi đáng kể hóa đơn hạ tầng.
DeepSeek đưa ra bộ số liệu mạnh cho dòng V4-Pro-Max: 80,6% trên SWE-bench Verified, 67,9% trên Terminal Bench 2.0, 90,1% trên GPQA Diamond, 93,5% trên LiveCodeBench và điểm 3.206 trên Codeforces. Nếu các chỉ số ấy phản ánh ổn định khi dùng thật, V4 Pro có tiềm năng rất lớn cho coding agent và chuỗi tự động hóa cần suy luận nhiều bước.
Điểm cần giữ cái đầu lạnh: các benchmark hiện chủ yếu do DeepSeek tự báo cáo. Bài nguồn không có bảng đối chiếu độc lập, đầy đủ giữa bản 0813 và V4 Pro Preview; hãng cũng chưa nói rõ bản GA đổi trọng số ở mức nào hay tập trung vào hậu huấn luyện, serving và độ ổn định. Vì thế, dùng các con số trên để khẳng định 0813 vượt Preview bao nhiêu phần trăm là suy diễn.
Dẫu vậy, việc rời nhãn preview vẫn có giá trị riêng. Doanh nghiệp mua một API không chỉ mua điểm benchmark; họ mua khả năng vận hành lặp lại, tích hợp chuẩn và một cam kết sản phẩm rõ ràng hơn từ nhà cung cấp.
Nhóm xây coding agent có thể dùng V4 Pro 0813 cho vòng lặp đọc repository, gọi công cụ, sửa mã rồi tạo báo cáo thay đổi. Context 1 triệu token mở cửa cho các kho tài liệu kỹ thuật lớn, log dài hoặc nhiều file code liên quan, thay vì phải cắt nhỏ dữ liệu quá gắt. Song context lớn là năng lực đầu vào, không phải bảo chứng model sẽ luôn nhớ đúng chi tiết ở cuối tài liệu.
Giá input thấp tạo lợi thế cho các Workflow nặng ngữ cảnh. Cache hit rẻ hơn rất nhiều cache miss, nên kiến trúc prompt cần ưu tiên phần chỉ dẫn và tri thức dùng lặp lại. Đừng gửi lại nguyên bộ policy, schema và tài liệu cố định ở mọi lượt gọi rồi than API đắt.
Trước khi đưa vào luồng quan trọng, đội kỹ thuật nên đo bốn thứ: độ trễ theo kích thước prompt, tỷ lệ tool calling đúng schema, tỷ lệ hoàn thành tác vụ không cần người sửa, và chi phí trên mỗi ticket hoàn tất. Cũng cần hỏi rõ giới hạn concurrency, hành vi khi quá tải cùng phương án dự phòng nếu giá API hoặc quota thay đổi.
Tôi đánh giá DeepSeek V4 Pro 0813 là bước chuyển sản phẩm tốt, nhưng chưa phải bằng chứng đủ mạnh cho một cú nhảy hiệu năng. DeepSeek làm đúng việc cần làm: đưa model flagship từ preview sang endpoint production, giữ chuẩn tích hợp phổ biến và công bố mức giá có tính cạnh tranh. Với người làm sản phẩm, đó thực dụng hơn nhiều khẩu hiệu về AI tổng quát.
Phần tôi chê là khoảng trống xác thực. Benchmark agentic coding rất hấp dẫn, song chưa có đánh giá độc lập và chưa có phép so sánh cùng điều kiện với Preview. Đội ngũ nào đổi toàn bộ stack chỉ vì một bảng điểm sẽ tự biến mình thành phòng thí nghiệm miễn phí cho nhà cung cấp.
Khuyến nghị cụ thể: hãy A/B test 0813 với V4 Pro Preview bằng một dự án có tiêu chí nghiệm thu rõ ràng, chẳng hạn xử lý 10 issue tồn đọng trong repository nội bộ. Ghi lại tỷ lệ PR được merge, số lần kỹ sư can thiệp, token tiêu thụ và thời gian hoàn tất. Nếu 0813 thắng trên các chỉ số đó trong vài chu kỳ liên tiếp, lúc ấy mới đáng mở rộng sang production.
Khác biệt chắc chắn nhất là 0813 đã rời trạng thái preview và DeepSeek định vị model này cho production qua endpoint deepseek-v4-pro. Nguồn chưa xác nhận chi tiết mức thay đổi trọng số so với Preview.
Giá công bố là 0,435 USD/triệu token đầu vào khi cache miss, 0,003625 USD/triệu token đầu vào khi cache hit và 0,87 USD/triệu token đầu ra.
Có thể thử ở phạm vi kiểm soát được, nhất là tác vụ có tiêu chí nghiệm thu rõ. Chưa nên thay thế toàn bộ model hiện hữu trước khi kiểm tra độ ổn định, tool calling, độ trễ và chi phí trên dữ liệu thật của đội ngũ.
Nguồn tham khảo: DeepSeek V4 Pro 0813: Bản nâng cấp đáng giá?
Bài viết là góc nhìn cá nhân của tác giả, mang tính tham khảo — không phải tin tức báo chí.
Đừng bỏ lỡ bài viết tiếp theo. Đăng ký để nhận trong inbox.

Tác giả
Tôi là Cường Nguyễn - Founder của AI Ops Solutions.
Tôi từng là Logistics Operations Manager và đồng sáng lập thương hiệu CATCA - #1 Shopee ngành Pet Care.