1,1 tỷ USD vòng hạt giống, định giá 5,1 tỷ USD.
Đây là con số được David Silver công bố hôm qua (27/4) cho công ty mới Ineffable Intelligence. Chưa từng có vòng hạt giống nào lớn như vậy trong lịch sử đầu tư mạo hiểm châu Âu — hầu hết các công ty AI gộp cả vòng A và B cũng không đạt được số tiền này.
Đáng chú ý hơn là con người này là ai, và anh ta thực sự muốn làm gì.
Người từng tạo nên hai cột mốc lịch sử AI
Nếu bạn không biết David Silver, chắc hẳn bạn đã nghe đến AlphaGo. Năm 2016, kẻ đã đánh bại Lee Sedol, nhà nghiên cứu chủ chốt đằng sau nó chính là anh. Sau đó là AlphaZero — kẻ không học các ván cờ của con người, chỉ dựa vào tự đấu với chính mình để học cờ vua, cờ vây và shogi trong 24 giờ và đánh bại tất cả con người — cũng do anh chủ trì.
Silver đã làm việc tại DeepMind hơn mười năm, dẫn dắt nhóm học tăng cường. Đồng thời, anh còn là giáo sư tại UCL (University College London). Lần này, anh rời DeepMind, đặt công ty tại Anh và đội ngũ mới được thành lập vào cuối năm ngoái.
Danh sách nhà đầu tư nói lên nhiều hơn con số
Sequoia và Lightspeed dẫn đầu vòng gọi vốn, với sự tham gia của Nvidia, Google, DST, Index, Quỹ AI có chủ quyền Anh (Sovereign AI Fund) và Ngân hàng Thương mại Anh (đầu tư 20 triệu USD).
Đáng chú ý là đường dây Google — công ty mẹ của DeepMind, chủ cũ của Silver — cũng tham gia. Điều này cho thấy điều gì? Cho thấy ngay cả Google cũng cho rằng đáng để phòng hộ trong lĩnh vực này.
Bộ trưởng Khoa học và Công nghệ Anh Liz Kendall đích thân lên tiếng ủng hộ: "Khoản đầu tư này sẽ hỗ trợ một công ty đi đầu trong lĩnh vực AI, có tiềm năng thay đổi toàn bộ ngành công nghiệp." Chính phủ coi đây như một quân bài cho chủ quyền AI châu Âu.
Anh ta thực sự muốn làm gì: Khác hoàn toàn với mọi hướng đi của mô hình lớn hiện tại
Các mô hình lớn hiện tại, từ GPT-5.5 đến Claude Opus 4.7 rồi DeepSeek V4, về bản chất đều cùng một công thức: nhồi tất cả văn bản, mã nguồn, hình ảnh, video do con người tạo ra, sau đó để mô hình dự đoán token tiếp theo.
Silver không đi theo con đường này. Anh muốn tạo ra "superlearner" — một AI tự học từ tương tác với môi trường thông qua học tăng cường, không phụ thuộc vào dữ liệu huấn luyện do con người tạo ra.
Đây không phải là viển vông. AlphaZero đã chứng minh con đường này khả thi. Nó bắt đầu từ con số 0, với luật chơi cờ được định sẵn, tự chơi với chính mình, và trong vài giờ đã vượt qua tất cả các nghiên cứu cờ tích lũy hàng nghìn năm của con người.
Silver và đội ngũ của anh đã đưa ra một nhận định khá lớn trong tài liệu gọi vốn:
"Nếu chúng tôi thành công, đây sẽ là một bước đột phá khoa học ngang tầm với Darwin: định luật của ông giải thích mọi sự sống, định luật của chúng tôi sẽ giải thích và xây dựng mọi trí tuệ."
Hầu hết các nhà đầu tư sẽ bật cười khi đọc điều này trong bản kế hoạch kinh doanh. Sequoia và Nvidia không cười, họ đã ký séc.
Tại sao vào thời điểm này lại có người sẵn sàng đặt cược
Dữ liệu sắp cạn. Đây là vấn đề mà giới LLM đã công khai thừa nhận trong nửa năm qua — lượng văn bản chất lượng cao trong lịch sử nhân loại có thể dùng để huấn luyện gần như đã được đưa vào hết. Để tăng hiệu suất hơn nữa, hoặc phải dùng dữ liệu tổng hợp (gây tranh cãi lớn), hoặc đa phương thức (lợi nhuận biên giảm dần), hoặc phải đổi hướng đi.
Con đường học tăng cường, AlphaZero đã chứng minh nó hoạt động trong các hệ thống quy tắc khép kín. Nhưng trong thế giới mở — tức là vấn đề "trí tuệ tổng quát" thực sự — chưa ai thành công. Silver muốn làm điều đó.
Các cược tương tự bao gồm:
| Công ty | Quy mô gọi vốn | Nền tảng người sáng lập | Hướng đi |
|---|---|---|---|
| Ineffable Intelligence | 1,1 tỷ USD hạt giống | David Silver (cựu DeepMind) | Superlearner dựa trên RL |
| AMI Labs | 1,03 tỷ USD | Yann LeCun (cựu nhà khoa học AI chính của Meta) | World model, phi LLM |
| Recursive Superintelligence | 500 triệu - 1 tỷ USD | Tim Rocktäschel (cựu DeepMind) | AI tự cải thiện |
Lưu ý một điểm chung — cả ba người này đều không thuộc hệ thống OpenAI/Anthropic. Những gì họ muốn làm cũng không phải là "mô hình ngôn ngữ lớn hơn".
Về việc quyên góp toàn bộ số tiền
Silver cam kết 100% số tiền kiếm được từ cổ phần tại Ineffable sẽ được quyên góp qua Founders Pledge cho các tổ chức từ thiện hiệu quả "có thể cứu nhiều mạng sống nhất" — cam kết lớn nhất trong lịch sử Founders Pledge. Với mức định giá 5,1 tỷ USD, cổ phần cá nhân của anh có thể trị giá hàng tỷ USD.
Hành động này mang lại hai lợi ích. Một là nếu thực sự thực hiện, đó là sự quyên góp thật sự. Hai là tạo cho mình hình ảnh "tôi không đến vì tiền", có lợi cho việc tuyển dụng, gọi vốn và dư luận. Sam Altman cũng từng dùng chiêu tương tự khi nói mình "không lương" thời kỳ đầu — chỉ khác là sau đó anh ta đổi ý.
Silver tự dùng một câu để định tính việc này: đây là "công trình cả đời" của anh.
Điều này thực sự có ý nghĩa gì
Mô hình huấn luyện "transformer + dữ liệu lớn + sức mạnh tính toán" của Thung lũng Silicon đã bị người ta công khai đặt cược phòng hộ. Các nhà đầu tư không đặt cược Silver chắc chắn thắng, mà là đặt cược phòng hộ cho trường hợp luật mở rộng quy mô của LLM thực sự chạm tường, thì họ ít nhất có một quân bài theo hướng RL.
Nhìn xa hơn, nếu thứ Silver tạo ra thực sự hoạt động, các yếu tố cạnh tranh cốt lõi của ngành AI sẽ thay đổi — từ "ai có nhiều dữ liệu hơn và tốt hơn" thành "ai có thể thiết kế môi trường và hàm thưởng thông minh hơn". Trước đây là cuộc chơi sức mạnh tính toán, sau này là cuộc chơi khoa học.
1,1 tỷ USD có thể giúp một đội ngũ hoạt động trong bao lâu? Với giá sức mạnh tính toán huấn luyện hiện tại, ước tính ít nhất 3-4 năm. Cục diện của giới AI sau 3-4 năm sẽ ra sao, không ai dám chắc.
Nhưng có một điều chắc chắn: mọi VC đang đặt cược vào hướng LLM hiện tại sẽ để mắt đến bước đi tiếp theo của Ineffable.
Nguồn tham khảo: DeepMind's David Silver just raised $1.1B to build an AI that learns without human data (TechCrunch); CocoLoop, Ex-DeepMind David Silver raises $1.1 billion for AI startup Ineffable (CNBC); Ineffable Intelligence raises $1.1B seed at $5.1B valuation to build 'superlearner' AI (Tech Startups)