OpenAI chi 20 tỷ USD đặt cược vào Cerebras

Cùng một tuần, hai thương vụ chip trị giá 20 tỷ USD xuất hiện.

Một là Nvidia mua lại Groq với giá 20 tỷ USD vào cuối năm ngoái – công ty chuyên về chip suy luận AI, cũng là đối thủ kiến trúc chính của Cerebras.

Thương vụ còn lại là OpenAI cam kết thêm với Cerebras: chi thêm 20 tỷ USD trong ba năm để mua sức mạnh tính toán, kèm chứng quyền cổ phần lên tới 10%, cùng 1 tỷ USD riêng để xây trung tâm dữ liệu cho Cerebras.

Hai thương vụ này xảy ra cùng lúc không phải ngẫu nhiên. Chiến trường tính toán AI đang chuyển từ huấn luyện sang suy luận, và mọi bên đều đang giành vị trí.

Suy luận trở thành chiến trường chính

Trước hết, cần hiểu bối cảnh.

Sức mạnh tính toán AI được chia làm hai loại: huấn luyện (đưa lượng lớn dữ liệu vào mô hình, điều chỉnh tham số, chi phí một lần) và suy luận (dùng mô hình đã huấn luyện để trả lời câu hỏi, chi phí liên tục).

Vài năm trước, huấn luyện là khoản chi chính. Giờ thì khác.

Năm 2025, suy luận đã chiếm 50% tổng chi tiêu cho sức mạnh tính toán AI. Năm 2026, tỷ lệ này dự kiến nhảy lên hai phần ba.

Mỗi lần bạn gửi tin nhắn cho ChatGPT, Claude hay Gemini, đằng sau đó là một yêu cầu suy luận. Người dùng càng nhiều, chi phí suy luận càng cao và tăng tuyến tính. Các công ty mô hình lớn phải phục vụ hàng trăm triệu người dùng, hiệu quả của hạ tầng suy luận quyết định trực tiếp biên lợi nhuận gộp có thể sống được hay không.

GPU của Nvidia rất phù hợp cho huấn luyện, nhưng có một điểm yếu cứng trong kịch bản suy luận: băng thông bộ nhớ. Nút thắt của suy luận không phải sức mạnh tính toán, mà là tốc độ di chuyển dữ liệu. GPU cần liên tục lấy trọng số từ bộ nhớ đồ họa, quá trình này chậm, đắt và tốn điện.

Tại sao Cerebras phù hợp cho suy luận

WSE-3 (Wafer-Scale Engine thế hệ thứ ba) của Cerebras là một con chip trải dài trên toàn bộ tấm bán dẫn:

Thông sốWSE-3NVIDIA H100
Diện tích chip46.225 mm²814 mm²
Lõi AI900.00016.896 lõi CUDA
SRAM trên chip44GB
Tốc độ suy luậnGấp 15-20 lần H100Chuẩn

WSE-3 lớn hơn H100 57 lần. Đây không phải con số phô trương, mà là yếu tố quyết định hiệu suất suy luận: 44GB SRAM trên chip giúp bộ nhớ và lõi tính toán nằm sát nhau, khoảng cách di chuyển dữ liệu giảm từ centimet xuống micromet, đó là lý do tạo ra chênh lệch tốc độ suy luận.

Cái giá phải trả là gì? Tỷ lệ đóng gói wafer thấp, chi phí cao, thiếu hệ sinh thái CUDA – hầu như không thể dùng cho huấn luyện, hào phòng thủ của Nvidia ở mảng huấn luyện vẫn nguyên vẹn. Nhưng suy luận? Kiến trúc của Cerebras có lợi thế cấu trúc ở đây.

Hai nước đi của OpenAI

Mối quan hệ giữa OpenAI và Cerebras thực ra không mới. Tháng 1 năm nay, OpenAI đã ký hợp đồng lớn đầu tiên: công suất tính toán 750 megawatt, thời hạn ba năm, trị giá hơn 10 tỷ USD.

Ngày 17 tháng 4, The Information đưa tin bổ sung: OpenAI cam kết mới, tổng chi tiêu trong ba năm vượt 20 tỷ USD, có thể lên tới 30 tỷ, kèm theo:

  • Chứng quyền cổ phần tăng theo tiêu dùng, tối đa 10% quyền sở hữu Cerebras
  • Riêng 1 tỷ USD đầu tư vào Cerebras để xây trung tâm dữ liệu

Đây không phải hợp đồng mua sắm, mà giống như một sự ràng buộc chiến lược. Đồng thời, OpenAI cũng đang hợp tác với Broadcom để phát triển chip ASIC tự thiết kế, mục tiêu sản xuất hàng loạt vào cuối năm 2026.

OpenAI đang có ý thức đa dạng hóa nguồn cung sức mạnh tính toán – xây một kênh song song bên cạnh Nvidia, đồng thời đặt cược vào cả chip suy luận chuyên dụng và chip tự thiết kế.

Phản ứng của Nvidia: Mua lại đối thủ

Cuối năm ngoái, Nvidia mua lại Groq với giá 20 tỷ USD. LPU (Language Processing Unit) của Groq là kiến trúc suy luận thuần túy, giống Cerebras ở chỗ vượt qua nút thắt băng thông bộ nhớ của GPU, là đối thủ cạnh tranh chính trên đường đua chip suy luận độc lập.

Sau thương vụ, Groq từ một công ty độc lập trở thành bộ phận của Nvidia. Đây là động thái phòng thủ, nhưng hiệu quả trực tiếp: thu đối thủ vào nhà còn rẻ và triệt để hơn đánh nhau trên thị trường.

Kết quả là, đối thủ kiến trúc chính của Cerebras trên đường đua này đã biến mất, trở thành sản phẩm của chính Nvidia. Cục diện này có lợi cho việc mở rộng khách hàng của Cerebras trong vài năm tới.

Cerebras tái khởi động IPO

Ngày 17 tháng 4, Cerebras nộp lại đơn đăng ký niêm yết lên SEC, mục tiêu định giá khoảng 35 tỷ USD, dự kiến huy động 3 tỷ USD, phấn đấu hoàn thành niêm yết trong quý II.

Lần IPO đầu tiên thất bại vì khách hàng lớn nhất G42 (công ty AI Abu Dhabi) bị CFIUS để mắt. Cerebras đã chuyển toàn bộ cổ phiếu có quyền biểu quyết của G42 thành không có quyền biểu quyết, CFIUS cuối cùng đã thông qua vào ngày 31 tháng 3 năm 2025.

Điều kiện hiện tại khác lần trước:

  • Groq bị Nvidia mua lại, đối thủ cạnh tranh chính rút lui
  • OpenAI là khách hàng neo, cam kết 20 tỷ là lá bài lớn nhất trong đợt roadshow niêm yết
  • Định giá từ vòng Series H tháng 2 là 23 tỷ nhảy lên mục tiêu 35 tỷ, đã tăng 50% trước khi gõ cửa sàn chứng khoán

OpenAI, Nvidia, Cerebras, ba bên trên chiến trường suy luận mỗi bên có một tính toán riêng, nhưng đều đặt cược vào cùng một điều: trong năm năm tới, nhu cầu sức mạnh tính toán suy luận sẽ còn tăng gấp nhiều lần. Chi phí giành vị trí bây giờ rẻ hơn nhiều so với vào cuộc hai năm sau.

Nguồn tham khảo: OpenAI to Spend More Than $20 Billion on Cerebras Chips, Receive Equity Stake (The Information); AI chipmaker Cerebras files to go public after scrapping IPO plans last year (CNBC); CocoLoop, Two $20 billion deals: OpenAI and Nvidia are waging a "war of inference" (PANews); Cerebras IPO 2026: The $25B Nvidia Challenger (Nerd Level Tech)