Le père d'AlphaGo lève 1,1 milliard de dollars pour créer une IA auto-apprenante

1,1 milliard de dollars en amorçage, valorisation de 5,1 milliards.

Ce sont les chiffres annoncés hier (27 avril) par David Silver pour sa nouvelle entreprise, Ineffable Intelligence. Il n'y a jamais eu d'amorçage aussi important dans toute l'histoire du capital-risque européen — la plupart des entreprises d'IA ne réunissent pas cette somme même en cumulant leurs tours A et B.

Plus remarquable encore est de savoir qui est cet homme et ce qu'il veut vraiment faire.

Cet homme a écrit deux fois l'histoire de l'IA

Si vous ne connaissez pas David Silver, vous avez sûrement entendu parler d'AlphaGo. Le type qui a fait pleurer Lee Sedol en 2016 — le chercheur principal derrière tout cela, c'était lui. Puis est venu AlphaZero — celui qui n'apprenait pas les parties humaines, mais par auto-apprentissage, maîtrisant les échecs, le go et le shogi en 24 heures et battant tous les humains — a également été dirigé par lui.

Silver a travaillé chez DeepMind pendant plus de dix ans, dirigeant l'équipe d'apprentissage par renforcement. Parallèlement, il était professeur à l'UCL (University College London). Cette fois, il quitte DeepMind, installe l'entreprise au Royaume-Uni, et l'équipe a été constituée à la fin de l'année dernière.

La liste des investisseurs en dit plus que le montant

Sequoia et Lightspeed mènent le tour, avec la participation de Nvidia, Google, DST, Index, le Sovereign AI Fund britannique et la British Business Bank (avec 20 millions de dollars).

Notez la ligne Google — la société mère de l'ancien employeur de Silver, DeepMind, participe. Qu'est-ce que cela signifie ? Que même Google estime qu'il vaut la peine de se couvrir dans ce secteur.

La ministre britannique de la Technologie, Liz Kendall, a personnellement soutenu le projet : « Cet investissement soutiendra une entreprise à la pointe de l'IA, avec le potentiel de transformer toute l'industrie. » Le gouvernement considère cela comme une carte pour la souveraineté européenne en matière d'IA.

Ce qu'il veut vraiment faire : Différent de tous les grands modèles actuels

Les grands modèles actuels, de GPT-5.5 à Claude Opus 4.7 en passant par DeepSeek V4, suivent essentiellement la même recette : nourrir le modèle avec tout le texte, le code, les images et les vidéos générés par les humains, et prédire le token suivant.

Silver n'emprunte pas cette voie. Il veut créer un « superlearner » — une IA qui apprend par interaction avec l'environnement via l'apprentissage par renforcement, sans dépendre des données d'entraînement générées par les humains.

Ce n'est pas une utopie. AlphaZero a déjà prouvé que cette voie fonctionne. Il a commencé à zéro, avec les règles du jeu données, a joué contre lui-même et, en quelques heures, a surpassé toutes les études d'échecs accumulées par l'humanité pendant des millénaires.

Silver et son équipe ont fait une déclaration assez audacieuse dans les documents de financement :

« Si nous réussissons, ce sera une avancée scientifique du même ordre que celle de Darwin : sa loi expliquait toute vie, notre loi expliquera et construira toute intelligence. »

La plupart des investisseurs riraient en lisant cela dans le business plan. Sequoia et Nvidia n'ont pas ri, ils ont signé les chèques.

Pourquoi quelqu'un est prêt à parier là-dessus maintenant

Les données s'épuisent. C'est un problème que le monde des LLM a publiquement reconnu au cours des six derniers mois — les textes de haute qualité de l'histoire humaine pouvant être utilisés pour l'entraînement sont presque tous consommés. Pour améliorer les performances, les options sont : les données synthétiques (très controversées), la multimodalité (rendements marginaux décroissants) ou changer de direction.

La voie de l'apprentissage par renforcement : AlphaZero a prouvé qu'elle fonctionne dans des systèmes de règles fermés. Mais dans le monde ouvert — c'est-à-dire le véritable problème de l'« intelligence générale » — personne n'a réussi jusqu'à présent. Silver veut faire exactement cela.

Des paris similaires incluent :

Entreprise Volume de financement Formation du fondateur Approche
Ineffable Intelligence 1,1 Md$ amorçage David Silver (ex-DeepMind) Superlearner basé sur RL
AMI Labs 1,03 Md$ Yann LeCun (ex-scientifique en chef IA de Meta) World model, non LLM
Recursive Superintelligence 500 M$ - 1 Md$ Tim Rocktäschel (ex-DeepMind) IA auto-améliorante

Notez un point commun — aucun de ces trois ne vient de l'écosystème OpenAI/Anthropic. Et ce qu'ils veulent faire n'est pas non plus un « modèle de langage plus grand ».

À propos du don de tout l'argent

Silver s'est engagé à donner 100 % de l'argent qu'il gagnera avec ses actions dans Ineffable via Founders Pledge à des organisations caritatives efficaces qui « peuvent sauver le plus de vies » — le plus grand engagement de l'histoire de Founders Pledge. Avec une valorisation de 5,1 milliards de dollars, ses actions personnelles pourraient valoir plusieurs milliards.

Cette manœuvre présente deux avantages. Premièrement, s'il le fait vraiment, c'est un don authentique. Deuxièmement, il se crée une image de « je ne suis pas là pour l'argent », ce qui aide pour le recrutement, le financement et l'opinion publique. Sam Altman a utilisé la même astuce au début en disant avoir un « salaire zéro » — sauf qu'il a ensuite changé d'avis.

Silver lui-même a utilisé une phrase pour qualifier cela : c'est « l'œuvre de sa vie ».

Ce que cela signifie vraiment

Le paradigme d'entraînement « transformer + big data + puissance de calcul » de la Silicon Valley est publiquement contré par un pari de couverture. Les investisseurs ne parient pas que Silver gagnera à coup sûr, mais que si la loi d'échelle des LLM se heurte vraiment à un mur, ils auront au moins une carte dans la voie du RL.

À long terme, si ce que Silver crée fonctionne vraiment, les facteurs centraux de compétition dans l'industrie de l'IA changeront — de « qui a le plus et les meilleures données » à « qui peut concevoir des environnements et des fonctions de récompense plus intelligents ». Le premier est un jeu de puissance de calcul, le second est un jeu de science.

Combien de temps 1,1 milliard de dollars peut-il faire vivre une équipe ? Aux prix actuels de la puissance de calcul pour l'entraînement, on estime au moins 3 à 4 ans. À quoi ressemblera le paysage de l'IA dans 3 à 4 ans, personne ne peut le garantir.

Mais une chose est sûre : chaque VC qui parie actuellement sur la voie des LLM surveillera de près les prochaines étapes d'Ineffable.

Sources de référence : DeepMind's David Silver just raised $1.1B to build an AI that learns without human data (TechCrunch) ; CocoLoop, Ex-DeepMind David Silver raises $1.1 billion for AI startup Ineffable (CNBC) ; Ineffable Intelligence raises $1.1B seed at $5.1B valuation to build 'superlearner' AI (Tech Startups)