DeepSeek publie un aperçu de V4.1 Flash, expire le 10 septembre

DeepSeek a ouvert une version intermédiaire en test de DeepSeek V4.1 Flash. Selon la description officielle, cette version utilise une nouvelle architecture de modèle, prend en charge la multimodalité native, et se veut plus performante, plus rapide et moins coûteuse.

L'accès est pratiquement sans obstacle : la base_url reste identique, il suffit de changer le nom du modèle en deepseek-v4.1-flash-expires-on-0910 pour pouvoir l'appeler. La facturation est identique à celle de deepseek-v4-flash, avec une limite de 20 requêtes simultanées par compte. Le nombre 0910 dans le nom correspond à la date de validité : après le 10 septembre, cet identifiant de modèle ne fonctionnera plus.

La multimodalité native, cœur de ce changement

Auparavant, pour traiter des entrées mixtes image-texte, la série Flash nécessitait un module d'extension visuelle supplémentaire. Dans cette version, cette capacité a été intégrée directement au modèle lui-même.

La différence ne se limite pas à l'absence d'un module supplémentaire. Avec le module d'extension, l'image passe généralement d'abord par un encodeur séparé avant d'être intégrée à la séquence de texte — cette étape intermédiaire coûte à la fois en latence et en précision. La multimodalité native signifie que l'image et le texte sont entraînés et traités au sein d'une même architecture. Pour la gamme Flash, dont l'atout principal est la faible latence, il s'agit d'un ajustement de fond : l'objectif n'est pas de repousser le plafond de compréhension visuelle, mais de ne pas payer de latence supplémentaire pour la multimodalité.

En termes de positionnement, V4.1 Flash se situe entre les V4 Flash et V4 Pro existants : architecture mise à jour, multimodalité native, tout en conservant la faible latence caractéristique de la gamme Flash.

La pratique consistant à inscrire la date d'expiration dans le nom du modèle

Cette convention de nommage n'est pas inédite, mais appliquée à une « version intermédiaire », elle en dit plus que l'annonce elle-même.

Un identifiant de modèle assorti d'une date d'expiration signifie que les utilisateurs qui l'intègrent doivent terminer leurs tests en deux jours, en sachant d'avance qu'ils devront le retirer ensuite. Cela exclut toute utilisation en production ; il ne reste essentiellement qu'un seul objectif : collecter des données de performance de cette nouvelle architecture sous trafic réel. La fenêtre de 48 heures et le plafond de 20 requêtes simultanées par compte en font un test de charge plutôt qu'un lancement.

Pour les développeurs chinois, la marge d'appréciation reste limitée. La taille des paramètres, les modifications de la longueur de contexte et les données d'évaluation n'ont pas été rendues publiques officiellement ; le calendrier de la version officielle de V4.1, ainsi que la question de savoir si cette nouvelle architecture sera synchronisée sur le niveau Pro, restent également sans réponse. L'affirmation « plus rapide, moins cher » ne repose pour l'instant que sur la parole du fournisseur, sans vérification externe possible. La seule chose vérifiable par soi-même est que le prix n'a pas changé : pour le même montant, on fait tourner le modèle pendant deux jours.

Il est intéressant de comparer avec le rythme passé de cette gamme de produits. Le parcours de V4-Flash, de la version d'aperçu à l'ouverture officielle de l'API, le prix promotionnel de V4-Pro devenu prix de catalogue permanent, ainsi que l'ajout d'un tarif double aux heures de pointe pour l'API — toutes ces étapes se sont déroulées en quelques mois. DeepSeek n'a jamais eu pour habitude de prévenir longtemps à l'avance de ses itérations de version, et cette fois, même le calendrier de la version officielle fait défaut.

Sources : communiqué de la plateforme ouverte DeepSeek, IT之家 (IT Home), CocoLoop, 澎湃新闻 (The Paper) ; l'identifiant du modèle, la facturation et la limite de concurrence sont conformes au communiqué officiel de test, la taille des paramètres et les données d'évaluation n'ont pas été divulguées par le fournisseur.