Meituan lance LongCat-2.5-Preview pour les tâches longues

L'équipe LongCat de Meituan a mis en ligne le 25 septembre LongCat-2.5-Preview sur sa propre plateforme d'API ouverte. Il s'agit de la génération suivant LongCat-2.0, passé open source fin juin, et Meituan positionne ce nouveau modèle autour de deux mots-clés : tâches de longue portée et multimodalité.

Le lendemain, l'outil de programmation open source international OpenCode a annoncé qu'il proposerait LongCat-2.5-Preview gratuitement pendant deux semaines, en précisant une rétention de données nulle.

Mêmes paramètres, mais avec des « yeux » en plus

LongCat-2.5-Preview conserve l'architecture de mélange d'experts (MoE), avec environ 1,6 billion de paramètres au total, dont près de 48 milliards activés à chaque inférence — un ordre de grandeur identique à celui de la version 2.0. Le modèle prend nativement en charge un contexte de 1 million de tokens, avec une sortie maximale de 128K tokens par requête.

Les changements se concentrent sur deux points. D'abord, l'ajout de la compréhension d'images, qui permet d'analyser le contenu visuel pour des questions-réponses multimodales, des résumés de contenu et du raisonnement visuel. Ensuite, une orientation vers les tâches à « flux long » : Meituan cite comme scénarios le terminal, le navigateur, les logiciels de bureau, les tableurs et les outils de conception, c'est-à-dire faire fonctionner le modèle en continu sur plusieurs interfaces au sein d'une même tâche.

La capacité de programmation est au cœur de cette annonce. Meituan affirme que le modèle se distingue dans la génération de code, la compréhension de code et les tâches de programmation automatisée, et qu'il est compatible avec des outils de programmation courants comme Claude Code, OpenCode, OpenClaw, Hermes et Kilo Code. L'interface API prend en charge simultanément les formats d'OpenAI et d'Anthropic.

Pour l'instant, Meituan n'a publié aucun score de benchmark : on ignore donc dans quelle mesure la manipulation d'interfaces graphiques et les tâches à flux long ont progressé par rapport à la version 2.0, faute de données externes comparables. Cette version porte le nom de Preview, et Meituan n'a pas non plus précisé si les poids seraient publiés en open source comme pour la 2.0.

Ce que cela change pour les développeurs chinois

Le point le plus immédiat est le faible coût d'intégration. Comme l'interface est compatible avec le format Anthropic, les développeurs habitués à Claude Code n'ont qu'à changer l'adresse de l'API et la clé d'accès pour basculer le modèle en arrière-plan vers LongCat, sans réécrire leur flux de travail. Pour les équipes qui ont du mal à accéder aux modèles étrangers depuis la Chine, cela représente une option de backend supplémentaire, déjà prête à l'emploi.

Côté tarifs, Meituan a offert aux utilisateurs existants un quota gratuit de 5 millions de tokens. La grille tarifaire officielle n'a pas encore été publiée, et on ne sait pas encore si le prix de la phase Preview restera identique une fois le modèle passé en version définitive.

La combinaison d'un contexte long et de flux longs vise le travail à l'échelle d'un dépôt de code entier. 1 million de tokens suffit, grosso modo, à contenir le code source principal d'un projet de taille moyenne, ce qui permet au modèle de tout lire d'un coup avant de se mettre à modifier, plutôt que de devoir recoller du contexte par fragments. Quant au nombre d'étapes qu'une opération à plusieurs étapes peut tenir sans dériver, seuls des tests réels par les développeurs pourront le dire.

De Owl Alpha à 2.5

Le parcours de LongCat se laisse retracer. Avant que la version 2.0 ne passe open source, le modèle était déjà disponible gratuitement et anonymement sur OpenRouter sous le nom de code Owl Alpha, où son volume d'appels avait un temps atteint la première place de la plateforme ; ce n'est qu'après la révélation de son identité qu'il a été publié en open source sous licence MIT. Meituan indique que l'entraînement comme l'inférence tournent tous deux sur des clusters de puces nationales.

Avec 2.5-Preview, Meituan reprend la même logique : gratuit d'abord, prix ensuite. Sa propre plateforme distribue un quota d'essai, tandis que l'outil étranger offre deux semaines d'accès gratuit. Le volume d'utilisation réel et les retours des développeurs recueillis pendant ces deux semaines sur OpenCode devraient peser sur la tarification définitive.

Sources : plateforme d'API ouverte LongCat de Meituan, ITHome, compte officiel d'OpenCode, CocoLoop ; vérifiés : le total de 1,6 billion de paramètres, environ 48 milliards de paramètres actifs, le contexte de 1 million de tokens, la sortie maximale de 128K et le quota d'essai de 5 millions de tokens.