AMD MI400 trang bị 432GB HBM4 thách thức NVIDIA

AMD năm nay sẽ ra mắt dòng tăng tốc AI MI400, với phiên bản cao cấp MI455X trang bị 432GB bộ nhớ HBM4, băng thông bộ nhớ 19,6TB/s, và hiệu năng tính toán ở độ chính xác FP4 đạt 40 PFLOPS.

Nhìn vào thông số kỹ thuật, quả thực rất ấn tượng.

Nhưng vấn đề là: AMD đã kể câu chuyện "thông số phần cứng đẹp hơn NVIDIA" trong vài năm nay rồi.

Thông số của MI400

Trước hết, hãy xem các thông số:

Chỉ số AMD MI400 (MI455X) AMD MI350 NVIDIA Vera Rubin (H2 2026)
Bộ nhớ 432GB HBM4 288GB HBM3E 288GB HBM4
Băng thông bộ nhớ 19,6 TB/s 8 TB/s 13 TB/s
Hiệu năng FP4 40 PFLOPS - -
Hiệu năng FP8 20 PFLOPS 10 PFLOPS -
Thời điểm ra mắt 2026 Đã ra mắt Nửa cuối 2026

Dung lượng bộ nhớ nhiều hơn 50% so với MI350, băng thông tăng gấp đôi. So với NVIDIA Vera Rubin sắp ra mắt, AMD tuyên bố dung lượng bộ nhớ vượt trội 1,5 lần và băng thông vượt trội 1,5 lần.

Nếu số liệu so sánh này là chính xác, lần này AMD đã vượt qua NVIDIA về thông số phần cứng.

Kiến trúc: CDNA 5 + giải pháp khung Helios

Dòng MI400 dựa trên kiến trúc CDNA 5, với giải pháp cấp khung có tên Helios. Kết nối sử dụng UALoE (Ultra Accelerator Link over Ethernet) – AMD đang thúc đẩy các tiêu chuẩn mở, cố gắng xây dựng một giải pháp kết nối cụm không phụ thuộc vào NVLink của NVIDIA.

Băng thông scale-out của mỗi GPU là 300GB/s, dựa trên các tiêu chuẩn UAL và UEC (Ultra Ethernet Consortium).

Dòng sản phẩm được chia làm hai hướng:

  • MI455X: Huấn luyện + suy luận, phiên bản cao cấp
  • MI430X: Biến thể cho tình huống HPC

Các nhà phân tích tính toán

Các nhà phân tích của S&P Global Market Intelligence ước tính AMD có thể xuất xưởng khoảng 258.000 chip dòng MI400 trong năm 2026, với giá bán trung bình khoảng 30.926 USD:

258.000 × 30.926 USD ≈ 7,2 tỷ USD

Con số này chiếm khoảng 25% doanh thu mảng trung tâm dữ liệu của AMD.

Không phải con số nhỏ, nhưng doanh thu mảng trung tâm dữ liệu của NVIDIA đã vượt quá 100 tỷ USD vào năm 2025. Thị trường không được chia đều, mà là ai đến trước và hệ sinh thái bị khóa chặt.

CUDA: Bức tường AMD luôn không thể vượt qua

Tại sao NVIDIA có thể duy trì vị thế thống trị thị trường, ngay cả khi thông số phần cứng của AMD đôi khi đẹp hơn?

Câu trả lời là CUDA.

CUDA không chỉ là một framework lập trình, nó là:

  • Hàng chục năm tích lũy hướng dẫn, câu trả lời trên Stack Overflow, dự án mã nguồn mở
  • PyTorch, TensorFlow, JAX mặc định được xây dựng trên CUDA
  • Hầu như tất cả các nhóm nghiên cứu AI đều xây dựng công cụ dựa trên CUDA
  • Đầu tư kỹ thuật của NVIDIA vào hệ sinh thái phần mềm vượt xa AMD ROCm

Chi phí chuyển đổi sang AMD không chỉ là thay đổi phần cứng, mà còn là viết lại mã, chạy lại benchmark, xác nhận lại độ ổn định. Đối với một nhóm đang huấn luyện mô hình hàng chục tỷ tham số, chi phí chuyển đổi này gần như không thể chấp nhận được.

ROCm (nền tảng tính toán GPU của AMD) đã tiến bộ rất nhiều trong hai năm qua, hỗ trợ PyTorch khá hoàn chỉnh, nhưng trong các chi tiết như tối ưu hóa suy luận, thư viện toán tử, công cụ gỡ lỗi, vẫn còn khoảng cách khá xa so với độ chín của CUDA.

Chip là chiến trường phần cứng, nhưng công việc kinh doanh huấn luyện AI được quyết định trong hệ sinh thái phần mềm.

AMD thắng gì, chưa thắng gì

AMD trong cuộc chơi chip AI không còn chỉ đang cố gắng bắt kịp, mà đã bước vào trạng thái cạnh tranh thực sự. MI300X đã giúp AMD đưa mảng trung tâm dữ liệu từ gần như bằng không lên hàng chục tỷ USD vào năm 2024, MI400 là sự tiếp nối trên con đường này.

AMD đã thắng:

  • Cạnh tranh về thông số bộ nhớ và băng thông
  • Tiêu chuẩn kết nối mở, cung cấp cho các nhà cung cấp đám mây một lựa chọn chống khóa chặt
  • Đã có được những khách hàng lớn thực sự (Microsoft Azure, Meta và các hãng khác đang sử dụng AMD)

Chưa thắng:

  • Độ sâu của hệ sinh thái phần mềm
  • Sự lựa chọn mặc định của công cụ huấn luyện mô hình lớn
  • Hào CUDA

258.000 chip so với hàng triệu chip của NVIDIA – khoảng cách này không phải do hiệu năng chip quyết định, mà là do tích lũy lịch sử.

Trong ngắn hạn, AMD MI400 là một lựa chọn đáng cân nhắc cho các trung tâm dữ liệu mới xây dựng, các nhà cung cấp đám mây không có gánh nặng lịch sử. Nhưng muốn lay chuyển nền tảng của NVIDIA, chỉ dựa vào lợi thế thông số của một thế hệ chip là không đủ.

Điều mỉa mai là: Lần này AMD thắng trên giấy tờ. Nhưng thị trường AI chưa bao giờ chỉ nhìn vào giấy tờ.

Nguồn tham khảo: CocoLoop, AMD confirms Instinct MI400 series AI GPUs drop in 2026, next-gen Instinct MI500 in 2027 (Tweaktown); AMD's next-generation AI chips set to power 2026 data center growth (S&P Global Market Intelligence); NVIDIA vs AMD 2026: AI Chip Showdown (IBTimes Australia); AMD's next-gen Instinct MI400 GPU confirmed: rocks 432GB of HBM4 at 19.6TB/sec (Tweaktown)