Bài viết

Theo VentureBeat, tin đồn về DeepSeek V5 đang nóng lên, nhưng dữ kiện cứng lại khá lạnh: DeepSeek chưa công bố roadmap hay thời điểm phát hành V5. Sản phẩm cần nhìn vào lúc này vẫn là dòng DeepSeek V4, gồm V4 Flash 284B và V4 Pro 1.6T MoE; bản V4 Pro mới ra mắt GA ngày 13/08/2026.

Ngày 16/08/2026, DeepSeek cũng áp dụng bảng giá API mới. Theo tài liệu pricing chính thức, mức giá tăng từ 51% đến hơn 370%, đi kèm cơ chế giá theo giờ Peak và Off-peak. Trong khi đó, thị trường dự đoán trên Polymarket phản ánh sự quan tâm tới model kế tiếp, chứ không phải một xác nhận từ DeepSeek.
Điểm đáng ngại hơn nằm ở V4 Flash. Thử nghiệm độc lập của Composio chạy 30 tác vụ đa công cụ qua 8 agent harness, bao gồm các luồng làm việc với GitHub, Gmail và Slack. Kết quả: DeepSeek-V4 Flash hoàn thành 129/240 lượt chạy, tương đương 53,8%.
Câu chuyện này đập thẳng vào thói quen đánh giá LLM bằng benchmark. DeepSeek-V4 Flash có điểm ECI 153, ngang GLM 5.2 theo dữ liệu được nêu trong báo cáo. Nhưng khi phải đọc trạng thái, chọn tool, gọi API, xử lý lỗi và quay lại đúng luồng công việc, model chỉ vượt qua hơn một nửa số lần chạy.
Đó là khoảng cách giữa model thông minh và hệ thống làm được việc. Một AI Agent doanh nghiệp không sống trong bài thi tĩnh. Nó phải hoạt động qua nhiều công cụ, chịu giới hạn quyền truy cập, gặp dữ liệu thiếu, API chậm và các thao tác có hậu quả thật. Chỉ cần một bước điều phối sai, toàn bộ workflow có thể hỏng dù câu trả lời của model nghe rất thuyết phục.
Kết quả của Composio cũng cho thấy hiệu năng phụ thuộc mạnh vào agent harness, caching và tầng orchestration. Vì vậy, doanh nghiệp mua API không nên tự huyễn hoặc rằng thay model là xong. Prompt tốt không cứu được một workflow thiết kế cẩu thả.
Việc tăng giá buộc đội ngũ kỹ thuật bỏ tư duy “DeepSeek là lựa chọn rẻ mặc định”. Chi phí phải được tính theo tỷ lệ tác vụ hoàn thành, số lần retry, thời gian xử lý lỗi và rủi ro từ hành động sai. Một API rẻ trên mỗi token có thể đắt nếu Agent liên tục gọi lại tool hoặc cần người can thiệp.
Mặt tích cực là cơ chế Off-peak mở ra cửa tối ưu vận hành. DeepSeek có 17/24 giờ giá Off-peak, phù hợp để chạy batch evaluation, tạo synthetic data và các công việc không cần phản hồi tức thì. Các job này cần được xếp lịch rõ ràng thay vì ném toàn bộ lưu lượng vào giờ Peak.
Với Agent đa công cụ, hướng thực dụng là Multi-Model Routing. Có thể dùng V4 Flash cho subagent xử lý phân loại, tóm tắt, trích xuất hoặc tác vụ nền ít rủi ro. Những bước liên quan gửi email, sửa code, cập nhật GitHub hay Slack cần model chuyên sâu hơn, rule-based guardrail và cơ chế phê duyệt của con người. Đừng trao quyền ghi dữ liệu cho một Agent chỉ vừa đạt 53,8% trong bài thử tương tự.
Tôi chê cơn sốt V5 vì nó đang đi trước dữ liệu. DeepSeek có quyền điều chỉnh giá để đầu tư tầng serving và thoát mác “LLM giá rẻ”, nhưng mức tăng mạnh chỉ thuyết phục khi độ tin cậy production cải thiện tương ứng. Benchmark cao là tài liệu marketing tốt; orchestration ổn định mới là thứ bộ phận vận hành cần mua.
DeepSeek V4 Flash vẫn đáng thử nếu đội ngũ hiểu giới hạn của nó. Nhưng gọi nó là nền tảng Agent tự động hóa doanh nghiệp ở thời điểm này là quá tay. Khuyến nghị cụ thể: trước khi gia hạn hay mở rộng ngân sách API, hãy dựng một evaluation suite gồm chính các workflow GitHub, Gmail, Slack của công ty, chạy tối thiểu theo mô hình nhiều lần lặp như Composio và đo tỷ lệ hoàn thành, retry lẫn chi phí thực tế theo Peak/Off-peak.
Chưa có ngày phát hành chính thức. DeepSeek chưa công bố roadmap hay mốc thời gian cho V5, vì vậy mọi dự đoán hiện nay vẫn là đồn đoán thị trường.
DeepSeek áp dụng bảng giá mới với mức tăng từ 51% đến hơn 370% và phân tách Peak/Off-peak. Công ty chưa đưa ra trong dữ liệu này một lời giải thích chi tiết hơn về động cơ của từng mức giá.
Có thể dùng cho tác vụ nền, ít rủi ro và có kiểm soát. Với workflow đa công cụ có hành động ghi dữ liệu hoặc giao tiếp ra ngoài, cần benchmark trên dữ liệu nội bộ, thêm guardrail và duy trì bước phê duyệt phù hợp.
Nguồn tham khảo: VentureBeat
Bài viết là góc nhìn cá nhân của tác giả, mang tính tham khảo — không phải tin tức báo chí.
Đừng bỏ lỡ bài viết tiếp theo. Đăng ký để nhận trong inbox.

Tác giả
Tôi là Cường Nguyễn - Founder của AI Ops Solutions.
Tôi từng là Logistics Operations Manager và đồng sáng lập thương hiệu CATCA - #1 Shopee ngành Pet Care.