DeepSeek lanza prueba de V4.1 Flash, expira el 10 de septiembre

DeepSeek ha abierto una versión intermedia de prueba de DeepSeek V4.1 Flash. Según la descripción oficial, esta versión utiliza una nueva arquitectura de modelo, admite multimodalidad nativa y es más capaz, más rápida y más económica.

El acceso prácticamente no tiene barreras: la base_url se mantiene igual, basta con cambiar el nombre del modelo a deepseek-v4.1-flash-expires-on-0910 para poder llamarlo. La facturación es idéntica a la de deepseek-v4-flash, con un límite de 20 solicitudes simultáneas por cuenta. El número 0910 en el nombre es la fecha de validez: después del 10 de septiembre, este identificador de modelo dejará de funcionar.

La multimodalidad nativa es el punto central de este cambio

Antes, para procesar entradas mixtas de imagen y texto, la serie Flash necesitaba un paquete de extensión visual adicional. En esta versión, esa capacidad se ha incorporado directamente al propio modelo.

La diferencia no es solo dejar de instalar un paquete. En el método del paquete de extensión, la imagen suele pasar primero por un codificador independiente antes de integrarse en la secuencia de texto; ese paso intermedio consume tanto latencia como precisión. La multimodalidad nativa significa que la imagen y el texto se entrenan y se procesan dentro de la misma arquitectura. Para la línea Flash, cuyo foco principal es la baja latencia, se trata de un ajuste de dirección: no busca elevar el techo de comprensión visual, sino evitar pagar latencia extra por la multimodalidad.

En cuanto a posicionamiento, V4.1 Flash se sitúa entre el V4 Flash y el V4 Pro actuales: arquitectura actualizada, con multimodalidad nativa, manteniendo la característica de baja latencia habitual de la serie Flash.

La práctica de escribir la fecha de expiración en el nombre del modelo

Esta forma de nombrar no es nueva, pero aplicada a una “versión intermedia” transmite más información que el propio anuncio.

Un identificador de modelo con fecha de expiración implica que quien lo integre debe completar la evaluación en dos días y sabe de antemano que tendrá que retirarlo. Esto descarta cualquier uso en producción, y básicamente queda un único propósito: recopilar datos de rendimiento de esta nueva arquitectura bajo tráfico real. La ventana de 48 horas y el límite de 20 solicitudes simultáneas por cuenta lo enmarcan como una prueba de carga, no como un lanzamiento.

Para los desarrolladores chinos, lo que se puede evaluar es limitado. El tamaño de parámetros, los cambios en la longitud de contexto y los datos de evaluación no se han revelado oficialmente; tampoco hay información sobre el calendario de la versión oficial de V4.1 ni sobre si esta nueva arquitectura llegará también al nivel Pro. La afirmación de “más rápido y más económico” proviene, por ahora, solo del proveedor, sin verificación externa posible. Lo único que se puede comprobar por cuenta propia es que el precio no ha cambiado: por el mismo dinero, funciona durante dos días.

Vale la pena comparar con el ritmo anterior de esta línea de productos. El paso de V4-Flash de vista previa a apertura oficial de la API, el precio promocional de V4-Pro que se convirtió en precio de lista permanente, y la incorporación de una tarifa doble en horas pico para la API: todo esto ocurrió en cuestión de meses. DeepSeek no suele dar avisos largos sobre las iteraciones de versión, y esta vez ni siquiera ha ofrecido un calendario para la versión oficial.

Fuentes: comunicado de DeepSeek Open Platform, IT之家 (IT Home), CocoLoop, 澎湃新闻 (The Paper); el identificador del modelo, la facturación y el límite de concurrencia siguen el comunicado oficial de prueba, el tamaño de parámetros y los datos de evaluación no han sido divulgados por el proveedor.