Ngày 15/08, DeepSeek chính thức phát hành DeepSeek-V4-Pro ở bản GA (Generally Available), đưa gia đình model V4 hoàn tất hành trình từ preview sang phiên bản thương mại. Model này đã xuất hiện trên app/web qua chế độ “Expert Mode” và có sẵn qua API — tên model được giữ nguyên, chỉ điều chỉnh bên trong.

Điểm nhấn đầu tiên của bản phát hành nằm ở mảng agent. DeepSeek mô tả V4-Pro mang đến “các nâng cấp agent lớn” hướng tới hiệu quả vận hành thực tế (production). Kèm theo là cơ chế reasoning effort linh hoạt, áp dụng cho cả V4-Pro lẫn V4-Flash, cho phép người dùng chọn mức suy luận: low cho các tác vụ đơn giản, high cho workflow agent hằng ngày, max cho những bài toán phức tạp cần suy luận sâu.

Điểm nhấn thứ hai là khả năng tương thích hệ sinh thái. V4-Pro hỗ trợ native OpenAI Responses API, được DeepSeek tối ưu sẵn cho Codex với thao tác cài đặt một chạm — động thái giúp đội ngũ phát triển quen thuộc với chuẩn OpenAI có thể chuyển sang dùng mà gần như không cần sửa đổi code.

Về chi phí, DeepSeek cập nhật lại giá API và giới thiệu cơ chế peak/off-peak, có hiệu lực từ 16:00 UTC ngày 16/08. Khung giờ cao điểm (peak) là 01:00–04:00 và 06:00–10:00 UTC; ngoài các khung giờ đó là thấp điểm và giá rẻ hơn 50%. Cụ thể:

  • DeepSeek-V4-Flash: ở giờ cao điểm, input (cache miss) $0.44, cache hit $0.014, output $1.32 cho 1 triệu token; vào giờ thấp điểm lần lượt là $0.22, $0.007 và $0.66.
  • DeepSeek-V4-Pro: ở giờ cao điểm, input $1.32, cache hit $0.044, output $3.96; vào giờ thấp điểm lần lượt là $0.66, $0.022 và $1.98.

Với mức giảm đến một nửa, cơ chế off-peak mang lại lợi ích rõ nhất cho những nhóm dùng chạy khối lượng lớn nhưng không khắt khe về độ trễ, điển hình là các pipeline agent nền ngầm, batch xử lý dữ liệu hay job định kỳ. Doanh nghiệp có thể dời các tác vụ loại này vào khung giờ thấp điểm để cắt gần một nửa ngân sách API mà hiệu quả không đổi.

Nhìn chung, bản phát hành V4-Pro cho thấy DeepSeek cùng lúc theo đuổi hai mục tiêu: đẩy mạnh năng lực agent ở tầm production và làm giá API linh hoạt hơn cho nhóm khách hàng doanh nghiệp. Cơ chế peak/off-peak tuy mới xuất hiện ở DeepSeek nhưng đang dần trở thành xu hướng chung của nhiều nhà cung cấp model nhằm cân bằng tải hạ tầng trong giờ cao điểm.