Hôm nay (24 tháng 4), DeepSeek chính thức phát hành V4.
Tiêu đề của Bloomberg là "Một năm sau, lại một lần nữa làm đảo lộn Thung lũng Silicon". Có phóng đại hay không còn tùy quan điểm, nhưng lần này quả thực có hai sản phẩm được công bố cùng lúc:
- V4-Pro: 1,6 nghìn tỷ tham số tổng, kích hoạt 49B, hỗ trợ ngữ cảnh 1 triệu token
- V4-Flash: 284 tỷ tham số tổng, kích hoạt 13B, cũng hỗ trợ 1 triệu token
Được phát hành theo giấy phép MIT, trọng số đã được đưa lên HuggingFace.
Điểm chuẩn
Trong lập trình thi đấu Codeforces, V4-Pro đạt 3206. GPT-5.4 đạt 3168 – mô hình độc quyền vừa bị thay thế bởi GPT-5.5 hôm qua.
Mô hình mã nguồn mở đã bắt kịp trong lập trình thi đấu.
Các con số khác:
| Bài kiểm tra | Điểm V4-Pro |
|---|---|
| LiveCodeBench | 93,5% |
| HMMT 2026 (Toán) | 95,2% |
| IMOAnswerBench | 89,8% |
| MMLU-Pro | 87,5% |
Tuy nhiên, có một hạng mục chưa thắng: SWE-bench Pro (tác vụ kỹ thuật phần mềm thực tế) đạt 55,4%, trong khi Kimi K2.6 đạt 58,6%. Thắng lập trình thi đấu nhưng thua 3 điểm ở tác vụ thực chiến.
DeepSeek chính thức tuyên bố: "DeepSeek-V4-Pro-Max đạt được bước đột phá đáng kể về năng lực tri thức trong các mô hình mã nguồn mở, củng cố vững chắc vị thế mô hình mã nguồn mở mạnh nhất hiện nay."
Định giá: Chênh lệch theo cấp số nhân
Đây mới là điều khiến người ta phải chú ý.
| Phiên bản | Đầu vào tiêu chuẩn | Đầu vào cache hit | Đầu ra |
|---|---|---|---|
| V4-Flash | 0,14 USD/triệu | 0,028 USD/triệu | 0,28 USD/triệu |
| V4-Pro | 1,74 USD/triệu | 0,145 USD/triệu | 3,48 USD/triệu |
GPT-5.5 phát hành hôm qua có giá đầu ra bản tiêu chuẩn 30 USD/triệu, bản Pro 180 USD/triệu. Claude Opus 4.7 có giá đầu ra 75 USD/triệu.
Đầu ra V4-Pro chỉ 3,48 USD/triệu.
Rẻ hơn 8,6 lần so với GPT-5.5 tiêu chuẩn và 21 lần so với Claude Opus 4.7.
Đây không phải là ưu đãi giá, mà là chênh lệch theo cấp số nhân. Với những đội ngũ có khối lượng gọi API lớn, khoảng cách này có thể quyết định liệu sản phẩm có khả năng sinh lời hay không.
Giá rẻ nhờ kiến trúc
V4 giới thiệu Cơ chế chú ý hỗn hợp (CSA + HCA): Compressed Sparse Attention xử lý phụ thuộc toàn cục, Heavily Compressed Attention xử lý thông tin cục bộ, kết hợp sử dụng.
Trong kịch bản ngữ cảnh dài 1 triệu token, V4-Pro chỉ cần 27% sức mạnh tính toán suy luận và 10% bộ nhớ đệm KV so với V3.2.
Đồng thời sử dụng ba cải tiến:
- Huấn luyện hỗn hợp độ chính xác FP4 + FP8: lớp chuyên gia dùng FP4, các tham số khác dùng FP8
- Siêu kết nối có ràng buộc Manifold, tăng cường truyền tín hiệu phần dư
- Bộ tối ưu Muon, cải thiện tốc độ hội tụ và độ ổn định huấn luyện
Dữ liệu tiền huấn luyện vượt quá 32 nghìn tỷ token.
Hiệu quả này không đến từ việc tinh chỉnh tham số, mà từ thiết kế kiến trúc nén khối lượng tính toán, từ đó chi phí mới có thể được phản ánh vào giá thành.
Thời điểm đáng chú ý
GPT-5.5 ra mắt hôm qua, DeepSeek V4 ra mắt hôm nay.
Hai sự kiện chồng lên nhau sẽ buộc khách hàng doanh nghiệp phải tính toán lại. Khoảng cách về hiệu năng vẫn còn, nhưng khoảng cách về giá đã đủ lớn để phải xem xét nghiêm túc. Đặc biệt:
- Với đội ngũ có khối lượng gọi lớn: chi phí đầu ra 3,48 USD so với 30 USD là con số có thể quyết định lựa chọn giải pháp
- Với nhu cầu mã nguồn mở: giấy phép MIT, trọng số công khai, triển khai riêng tư không rào cản
- Với khách hàng doanh nghiệp Trung Quốc: DeepSeek ít vướng mắc hơn về tuân thủ và chủ quyền dữ liệu
Tháng trước có tin Tencent và Alibaba đang đàm phán đầu tư vào DeepSeek, định giá trên 20 tỷ USD. Một công ty đã từ chối VC suốt ba năm nay bắt đầu bàn chuyện tiền bạc. Việc phát hành V4 có lẽ không chỉ là cột mốc sản phẩm, mà còn là động thái chứng minh năng lực trước khi gọi vốn.
Liệu lợi thế giá có thể chuyển hóa thành quy mô hay không, câu trả lời sẽ có sau sáu tháng nữa.
Nguồn tham khảo: DeepSeek-V4-Pro Model Card (HuggingFace, deepseek-ai, 24 tháng 4 năm 2026); DeepSeek V4 Released: Open-Source 1.6T MoE, 1M Context (ofox.ai, 24 tháng 4 năm 2026); CocoLoop; DeepSeek Unveils Newest Flagship AI Model a Year after Upending Silicon Valley (Bloomberg, 24 tháng 4 năm 2026)