DeepSeek giảm 75% giá V4-Pro chỉ 72 giờ sau khi ra mắt

Bản xem trước của V4-Pro được ra mắt vào sáng sớm thứ Sáu tuần trước.

Sáng nay, DeepSeek đã đăng thông báo trên bảng điều khiển API: giảm 75% giá V4-Pro, áp dụng trực tiếp đến ngày 5 tháng 5. Đồng thời, giá cache hit đầu vào cho toàn bộ API bị cắt giảm xuống còn một phần mười so với giá gốc.

Từ khi phát hành đến khi giảm giá mạnh, chỉ chưa đầy 72 giờ.

Nhìn vào con số

Giá gốc của DeepSeek-V4-Pro:

Hạng mục Giá gốc (trên 1 triệu token)
Đầu vào $0,145
Đầu ra $3,48
Cache hit 0,025 NDT/triệu token (đã là giá sau giảm, bằng 1/10 giá gốc)

Trong thời gian khuyến mãi, giá đầu vào của V4-Pro trực tiếp giảm xuống còn khoảng $0,036/triệu token, rẻ hơn bất kỳ ai – mức giá này thấp đến mức nhiều người nghi ngờ liệu nó có đang bán lỗ để chạy số lượng người dùng hay không.

So sánh ngang với giá niêm yết của các mô hình flagship đóng nguồn hiện tại:

  • GPT-5.5: Phiên bản tiêu chuẩn $1,5/triệu đầu vào, $10/triệu đầu ra
  • Gemini 3.1 Pro: Khoảng $1,25/triệu đầu vào, $10/triệu đầu ra
  • Claude Opus 4.7: $15/triệu đầu vào, $75/triệu đầu ra

Có nghĩa là, giá gốc của V4-Pro đã đánh bại GPT-5.5 xuống dưới một phần mười, và đánh bại Claude Opus 4.7 xuống dưới một phần trăm. Thêm một đợt giảm 75%, khoảng cách càng được nới rộng.

Sát thương thực sự nằm ở đòn cache

Nếu chỉ nhìn vào đơn giá token của V4-Pro, nó đã đủ rẻ. Nhưng đòn mạnh hơn là DeepSeek đã cắt giảm giá cache hit đầu vào của toàn bộ dòng sản phẩm API xuống còn một phần mười so với giá gốc.

Giá cache hit dùng để làm gì:

  • Các ứng dụng dạng agent chạy đi chạy lại cùng một system prompt – phần lớn nội dung bị lặp lại
  • Trong kịch bản RAG, thường xuyên đưa cùng một context cho mô hình
  • Trong hội thoại nhiều lượt, tin nhắn lịch sử bị gửi lặp lại

Trong những kịch bản này, giá cache hit mới là khoản tiền thực tế mà doanh nghiệp phải trả. Cắt giảm 90% có nghĩa là – rào cản chi phí để các nhà phát triển chuyển từ GPT và Claude sang DeepSeek gần như bị san phẳng.

Tại sao lại hành động vào thời điểm này

Sau khi bản xem trước của V4-Pro được phát hành vào sáng sớm thứ Sáu (24 tháng 4), phản ứng thị trường hơi tế nhị. Tiêu đề của Bloomberg ngày hôm đó là "Mô hình mới được chờ đợi từ lâu của DeepSeek không thu hẹp được khoảng cách với Mỹ trong AI" – "không thu hẹp được khoảng cách với Mỹ". Fortune nói rằng V4-Pro vẫn thua kém Gemini 3.1 Pro trên các benchmark kiến thức thế giới.

Nói đơn giản: về mặt kỹ thuật chưa tạo ra khoảng cách, nhưng về mặt giá cả vẫn có thể đánh.

Nước đi của DeepSeek rất rõ ràng – vì không thể đối đầu trực diện với GPT-5.5 và Claude Opus về khả năng đỉnh cao trong ngắn hạn, họ đi theo một con đường khác: đè chi phí chuyển đổi của nhà phát triển xuống mức không thể bỏ qua. Dùng thử mô hình miễn phí không có gì lạ, nhưng giảm 75% chỉ 72 giờ sau khi phát hành mới là một tuyên bố – nói với tất cả các nhà phát triển đang chờ xem: tôi giúp bạn tiết kiệm chi phí chuyển đổi.

Những ai quen thuộc với giới này đều biết, khi DeepSeek ra mắt R1 vào tháng 1 năm ngoái, họ cũng dùng bộ chiêu này: hiệu năng đủ dùng, giá cả áp đảo. Đợt đó trực tiếp kích hoạt làn sóng giảm giá của các mô hình mở nguồn Trung Quốc, và OpenAI, Anthropic, Google sau đó đều đã điều chỉnh giá nhiều lần.

Lần này, có vẻ lại là cùng một kịch bản.

Ai sẽ chịu không nổi trước

Các đối thủ trong nước đã có phản ứng trước. Cổ phiếu của MiniMax trên sàn Hong Kong đã giảm 9% trong phiên, và công ty mô hình nền tảng nổi tiếng Knowledge Atlas (Zhipu) cũng giảm cùng mức. Đây không phải vì mô hình không tốt, mà vì không gian định giá của chúng bị giá khuyến mãi của V4-Pro đè bẹp trực tiếp.

Nói thẳng ra là: hôm nay bạn vẫn muốn bán mô hình nội địa của mình với giá $1/triệu token? Nhà phát triển mở bảng điều khiển DeepSeek ra thấy 0,036 đô la Mỹ cho một triệu token – bạn giải thích thế nào vì sao phải đắt hơn 27 lần?

OpenAI và Anthropic có thể sẽ không theo kịp trong ngắn hạn. Chiến lược của họ luôn là "chất lượng cao giá cao" – khách hàng sẵn sàng trả thêm cho độ tin cậy, SLA, tuân thủ, hỗ trợ doanh nghiệp. Nhưng những kẻ ở tầng giữa mới thực sự khó chịu:

  • Mistral, Cohere – những người chơi đóng nguồn nhưng giá trung bình
  • Zhipu, MiniMax, Moonshot trong nước
  • Một loạt các nhà sản xuất nhỏ "giá trị đồng tiền"

Chúng không thể nói mình rẻ hơn DeepSeek, cũng không thể nói mình mạnh hơn GPT-5.5. Áp lực này làm mờ đi định vị của chúng.

Tác dụng phụ của chiêu này

Cách đánh của DeepSeek có một cái giá rõ ràng: lợi nhuận gộp có thể âm.

V4-Pro là mô hình MoE với 1,6 nghìn tỷ tham số, mỗi lần suy luận kích hoạt 49 tỷ tham số. Với quy mô này chạy trên Huawei Ascend 950PR, chi phí biên trên mỗi token sẽ không cao hơn nhiều so với Gemini Flash hay GPT-5.4-Nano – nhưng so với giá khuyến mãi, gần như chắc chắn là lỗ.

Vậy tại sao vẫn làm? Câu trả lời có lẽ là – DeepSeek đang coi "số lượng người dùng" và "tần suất sử dụng" như các điểm dữ liệu cốt lõi cho vòng gọi vốn và IPO tiếp theo. Vài ngày trước có tin rằng Liang Wenfeng bắt đầu tiếp xúc với các nhà đầu tư bên ngoài – lần đầu tiên nới lỏng sau ba năm từ chối VC. Chất lượng mô hình đã đuổi kịp nhóm thứ hai, bước tiếp theo cần kể câu chuyện về "thị phần nhà phát triển".

Rẻ một mình không phải là rào cản. Rẻ + chất lượng đủ dùng + trọng số mở nguồn + API ổn định mới là. Nếu trong tháng tới, lượt tải xuống trên Hugging Face và lượng gọi API thực tế của V4-Pro tiếp tục bùng nổ, thì đòn này đáng giá.

Còn những người khác có theo kịp không? Trước tháng 6 chắc sẽ có câu trả lời.

Nguồn tham khảo: DeepSeek Slashes Fees for New AI Model in Chinese Price War (Bloomberg); DeepSeek slashes AI model costs, reignites price war in sector (Investing.com / Reuters); DeepSeek V4-Pro Price Cut: 75% (TheNextWeb); China's DeepSeek Slashes AI Prices With 75% Discount on V4-Pro Model (Republic World); CocoLoop, DeepSeek's Long-Awaited New Model Fails to Narrow US Lead in AI (Bloomberg)