Doubao 2.2 se retrasa; ByteDance prioriza reforzar la programación con IA

ByteDance confirmó el retraso de su gran modelo de lenguaje Doubao 2.2, que estaba previsto para agosto. Según varias personas cercanas a la compañía, el aplazamiento busca dar más tiempo a un preentrenamiento y postentrenamiento más completos para elevar las capacidades de programación, llamada a herramientas y agentes, cambiando un ciclo de desarrollo más largo por una mejora de mayor alcance. En el orden interno de prioridades, la versión 2.2 se plantea como un refuerzo clave entre generaciones, no como un salto de versión mayor.

El punto débil se concentra en la programación

La dirección del refuerzo se plantea sin rodeos: programación, llamada a herramientas y agentes. Las tres capacidades forman parte de una misma cadena: si el modelo no escribe bien código, la llamada a herramientas se vuelve inestable; si la llamada a herramientas es inestable, el agente no puede completar tareas largas.

La capacidad de programación es uno de los objetivos principales del equipo Seed para 2026, con un estándar interno fijado para fin de año: alcanzar una influencia en la industria comparable a la de GLM-5.2 y Kimi-K3. Esta referencia elegida resulta bastante realista, y muestra que ByteDance tiene claro cuál es su posición actual entre los desarrolladores.

La programación es también, ahora mismo, el escenario que mejor se convierte en ingresos. La conversión de pagos en el chat orientado al consumidor final sigue siendo pobre, mientras que los desarrolladores que llaman a la API para escribir código pagan por uso; la mayor parte del crecimiento de ingresos de los modelos chinos este año proviene de esta vía. En el lado del consumidor, ByteDance cuenta con la app Doubao y Douyin como respaldo, pero en esta vía de programación todavía no tiene una posición equivalente.

Para intentar recuperar terreno, ByteDance realizó pequeñas actualizaciones de funciones casi a diario durante julio. Las iteraciones diarias pueden mejorar la experiencia, pero no cambian la capacidad base del modelo; al final, todo pasa por un reentrenamiento completo.

La reestructuración del 20 de agosto

El 20 de agosto, ByteDance llevó a cabo una importante reestructuración de la división de modelos base Seed, dividiéndola en cuatro departamentos de primer nivel: datos de preentrenamiento, aprendizaje por refuerzo, escenarios de oficina y escenarios de consumidor final.

Esta división separa la construcción de capacidades de su aplicación en escenarios reales: los dos primeros departamentos se encargan del modelo en sí, los otros dos de convertirlo en producto. Lanzar una nueva versión justo después de reestructurar la organización nunca ha sido un calendario realista. El retraso del lanzamiento y esta reestructuración parecen ser dos caras de la misma decisión.

La competencia no ha bajado el ritmo

Se pueden repasar los movimientos del bloque de modelos chinos en los últimos dos meses: Zhipu AI lanzó GLM-5.3-Flash, con 18.000 millones de parámetros activados, con un precio reducido a una décima parte de la generación anterior; la versión preliminar Hy4 de Hunyuan, de Tencent, superó ligeramente a GLM-5.3 y Kimi K3 en pruebas ciegas; Kimi y Qwen, de Alibaba, también mantienen una densidad de actualizaciones nada baja. En un mes pueden aparecer dos o tres versiones capaces de alterar la clasificación, y precisamente ByteDance es quien está conteniendo el ritmo.

El costo del retraso también puede estimarse de forma aproximada. Un ciclo de reentrenamiento con postentrenamiento completo suele medirse en meses; al posponerse desde agosto, es probable que el lanzamiento real de 2.2 no llegue hasta el cuarto trimestre. Con el ritmo actual, para entonces probablemente ya esté disponible la siguiente generación de la competencia: el referente con el que 2.2 deba compararse al salir podría no ser ya el GLM-5.2 y el Kimi-K3 que tenía en mente cuando se planteó el proyecto.

El fundador Zhang Yiming había declarado previamente que no seguiría la vía de la destilación de modelos, aunque eso implicara quedarse atrás a corto plazo. El CEO Liang Rubo lo expresó de forma más completa en la reunión general de mitad de año, el 6 de agosto:

"En los modelos de lenguaje grandes, ByteDance seguirá apostando por la investigación y el desarrollo propios, consolidando bien los fundamentos, aceptando quedarse atrás a corto plazo y manteniendo la optimización a largo plazo."

Para una empresa acostumbrada a ganar por la velocidad de iteración de sus productos, incluir la frase "aceptar quedarse atrás a corto plazo" en una reunión general es una formulación poco habitual. Faltar una versión a corto plazo no hará que Doubao pierda usuarios, ya que la distribución está asegurada; pero el mercado de desarrolladores se guía por el ranking de capacidades, un terreno donde no hay dividendo de distribución que aprovechar. Informes públicos también mencionan que ByteDance avanza en paralelo en un modelo de escala aún mayor para la próxima generación, lo que deja más clara la posición de 2.2: debe cubrir el hueco entre ahora y la llegada de esa próxima generación.

Fuentes: Baijing Lab, CocoLoop, IT Home; los motivos del retraso de Doubao 2.2, los cuatro departamentos de la reestructuración de Seed y las declaraciones de Liang Rubo en la reunión general se verificaron a partir de informes públicos.