Cuối năm 2025, CEO NVIDIA Jensen Huang xác nhận một điều khiến mọi công ty muốn mua Blackwell phải đau đầu: các rack B200 và GB200 NVL72 đã được bán hết cho đến giữa năm 2026.
Trong số các đơn đặt hàng tồn đọng từ các nhà cung cấp dịch vụ đám mây toàn cầu, chỉ riêng một vài công ty lớn nhất đã vượt quá 3,6 triệu đơn vị.
Chuỗi cung ứng bị tắc nghẽn ở đâu
Vấn đề của Blackwell không phải là một khâu duy nhất, mà là toàn bộ chuỗi cung ứng đồng thời báo động:
Đóng gói CoWoS: TSMC đã khóa gần như toàn bộ công suất liên quan cho giai đoạn 2026-2027 cho NVIDIA, các khách hàng khác chỉ còn cách chờ đợi.
Bộ nhớ HBM3e: Toàn bộ công suất năm 2025 của SK Hynix và Micron đã kín, và họ đang lên kế hoạch tăng giá 20% vào đầu năm 2026. Kế hoạch mở rộng sản xuất của SK Hynix và Samsung đều đang gấp rút.
Lắp ráp rack: Các OEM như Dell, Foxconn, Inventec, Wistron trước đây gặp vấn đề kỹ thuật (chủ yếu là thách thức kỹ thuật với rack làm mát bằng chất lỏng), gần đây mới lần lượt giải quyết xong và bắt đầu tăng tốc sản xuất hàng loạt.
Khi các khâu này bị tắc nghẽn, dù chip đã được thiết kế xong cũng không thể xuất xưởng. Tin tốt là vấn đề OEM cơ bản đã được giải quyết, tin xấu là hai khâu đầu tiên vẫn là nút thắt cổ chai.
Thế hệ tiếp theo: Blackwell Ultra (GB300)
NVIDIA, không chờ đợi, không có ý định để người mua phải chờ đợi mãi.
Blackwell Ultra (B300/GB300) đang trên đường ra mắt, dự kiến vào nửa đầu năm 2026. Nâng cấp chính: bộ nhớ HBM3e trên mỗi GPU tăng từ 192GB trên B200 lên 288GB, rất hữu ích cho việc suy luận các mô hình siêu lớn.
Dự báo: Sản lượng rack dòng GB300 trong năm 2026 có thể tăng gấp đôi so với cùng kỳ năm trước.
Xa hơn nữa, kiến trúc Rubin dự kiến sẽ thâm nhập thị trường vào nửa cuối năm 2026, đã được giới thiệu trước tại GTC.
Điều này có ý nghĩa gì đối với các công ty AI
Các công ty không thể có được GPU mới nhất có một số lựa chọn:
Sử dụng H100/H200: NVIDIA đang thảo luận về việc mở rộng sản xuất trở lại H200, vì các công ty Trung Quốc như Alibaba và ByteDance đã đặt hàng hơn 2 triệu chip H200. Hàng hóa kiến trúc Hopper thực tế dễ kiếm hơn một chút so với Blackwell.
Xếp hàng chờ: Những người mua siêu lớn như Microsoft, Google, AWS có hàng đợi ưu tiên, nhưng thời gian chờ vẫn tính theo quý.
Chuyển sang đối thủ cạnh tranh: AMD MI300X vẫn còn hàng, và nhiều công ty đang thử nghiệm – nhưng về hệ sinh thái phần mềm quy mô lớn, CUDA vẫn trưởng thành hơn.
Tự phát triển: Lộ trình Google TPU, AWS Trainium, Azure Maia của Microsoft, nhưng chu kỳ xây dựng dài hơn.
Tình hình này cho thấy điều gì
Tốc độ tăng trưởng nhu cầu về hạ tầng AI đã vượt quá tốc độ phản ứng của chuỗi cung ứng toàn cầu, và khoảng cách này khó có thể lấp đầy trong ngắn hạn. Không phải NVIDIA không muốn bán, mà là chuỗi công nghiệp chỉ lớn như vậy.
Từ TSMC đến các nhà cung cấp HBM, mỗi khâu đều là độc quyền hoặc độc quyền nhóm, không có không gian để mở rộng nhanh chóng.
Tình hình hiện tại là: Các công ty muốn mua hàng mới nhất của Blackwell hoặc đã ký thỏa thuận mua hàng dài hạn từ sớm, hoặc phải chờ đợi.
Nguồn tham khảo: CocoLoop, Nvidia's Blackwell Dynasty: B200 and GB200 Sold Out Through Mid-2026 (FinancialContent/TokenRing); NVIDIA's Blackwell Ultra GB300 AI Servers to Lead the AI Infrastructure Race (WCCFTech); Nvidia server makers solve Blackwell technical issues (Data Center Dynamics)