Kimi K2.6 Code se lanza: 5 veces más barato que Claude Sonnet

El 13 de abril, Moonshot AI lanzó la vista previa del código K2.6 para todos los suscriptores de Kimi Code. Esta versión se implementó ampliamente después de aproximadamente una semana de pruebas cerradas, menos de dos semanas después del lanzamiento de GPT-5.4-Cyber y Anthropic Mythos.

Moonshot no realizó una conferencia de prensa, ni una publicación larga en un blog. Un correo electrónico, y tu Kimi Code se actualizó.

En comparación con K2.5, K2.6 se centra en tres mejoras: cadenas de razonamiento más profundas, planes de Agente de varios pasos más claros y una ejecución de llamadas a herramientas más confiable. El efecto práctico se ve en: al realizar grandes refactorizaciones en varios archivos o descomponer flujos de trabajo complejos de Agentes, la tasa de errores disminuye y la lógica es más coherente.

El precio es la verdadera ventaja

Incluso antes de que se publicaran los puntos de referencia, los precios ya causaron impacto.

Modelo Entrada (por millón de tokens) Salida (por millón de tokens)
Kimi K2.6 $0,60 $2,50
Claude Sonnet 4.6 $3,00 $15,00
GPT-5.4 $2,50 $10,00

La entrada es 5 veces más barata, la salida es 6 veces más barata. Un ejemplo concreto: si un equipo pequeño o mediano procesa 100 millones de tokens de entrada y 10 millones de tokens de salida al mes, puede ahorrar alrededor de $4.380 al año. Para los equipos que consideran los costos de las llamadas a la API como gastos operativos reales, esto no es una cantidad pequeña.

Los puntos de referencia de K2.5 fueron del 76,8 % (SWE-Bench Verified) y del 85 % (LiveCodeBench); esto ya era de primer nivel entre los modelos de pesos abiertos. Los puntos de referencia oficiales de K2.6 aún no se han publicado, pero los desarrolladores en las pruebas cerradas informaron que la salida de K2.6 "tiene un sabor a Opus": cadenas de razonamiento detalladas, procesos de pensamiento estructurados, bastante similares al verbose chain-of-thought de Claude.

Agent Swarm: Paralelismo real

El cambio técnico más sustancial de K2.6 es la reestructuración a nivel de Agent Swarm.

El Agent Swarm de Kimi es el mecanismo que permite que hasta 100 subagentes trabajen en paralelo. K2.5 tenía un problema antiguo: el Orchestrator (orquestador) teóricamente admitía el paralelismo, pero en la práctica la ejecución a menudo degeneraba en procesamiento secuencial. K2.6 se optimizó específicamente para esto; ahora el Orchestrator puede mantener la ejecución paralela real sin degenerar por defecto.

El resultado: en tareas que se pueden paralelizar, la velocidad aumentó hasta 4,5 veces. Si está ejecutando procesamiento por lotes de datos, pruebas de varios pasos o resúmenes de búsqueda paralela, la diferencia será notable.

La generación de código front-end también se ha vuelto más bonita: no solo el código funciona, sino que el diseño y la lógica visual también tienen más sentido.

Pesos abiertos, se puede ejecutar localmente

K2.6 se basa en una arquitectura MoE con billones de parámetros, manteniendo la estrategia consistente de pesos abiertos de Moonshot. Si está realizando una implementación local donde los datos no pueden salir del país, o desea ejecutarlo en su propio clúster de inferencia, teóricamente es compatible.

Sin embargo, la versión completa de pesos abiertos aún no se ha lanzado; se proporciona principalmente a través de la API y la suscripción a Kimi Code. Se espera que los pesos abiertos completos se publiquen alrededor de mayo de 2026.

Para los equipos que necesitan ejecutar grandes Agentes de código en entornos privados, vale la pena anotar este momento.

Algunas limitaciones reales

La realidad es: no todo está resuelto.

  • CLI se retrasó unos días: La API y la interfaz web se actualizaron a K2.6 primero; los usuarios de línea de comandos esperaron unos tres días. Para muchos desarrolladores, la CLI es la puerta de entrada principal
  • Los nombres de las versiones comenzaron a ser confusos: K2, K2.5, K2.6, K2.6-code-preview, K2.6-instruct… es difícil saber qué endpoint está ejecutando qué versión, el version pinning se convirtió en una carga operativa
  • La documentación en inglés aún está rezagada: En comparación con Anthropic y OpenAI, la calidad y la velocidad de actualización de la documentación técnica en inglés de Moonshot aún son inferiores. La experiencia del desarrollador internacional no es buena
  • Límite de frecuencia de llamadas a la API: 300-1200 llamadas cada 5 horas, insuficiente para tareas por lotes de alta concurrencia, requiere cola propia

K3 todavía está en camino

K2.6 se lanzó, pero las discusiones sobre K3 no se detuvieron. Los rumores en la comunidad dicen que la cantidad de parámetros objetivo de K3 estará en el rango de 3-4 billones, rivalizando con los principales modelos de EE. UU. Moonshot confirmó oficialmente a finales de marzo que K3 está en desarrollo, sin revelar características específicas.

La forma de lanzamiento de K2.6 (un correo electrónico y luego la implementación directa) muestra que Moonshot está iterando de manera bastante discreta. Sin grandes anuncios, primero deja que los usuarios lo sientan. Esto no contradice los rumores de que K3 "está preparando algo grande".

Para los desarrolladores, el estado actual es: puedes pagarlo, los puntos de referencia son aceptables, las desventajas son tolerables, así que úsalo por ahora. Cuando salga K3, reevalúa.

Fuentes de referencia: Kimi Code K2.6: Key Takeaways for Developers (BuildFastWithAI); Kimi K2.6 Code Preview Is Here (kimi-k2.org); Moonshot's Kimi K2.5 is open, CocoLoop, 595GB, and built for agent swarms (VentureBeat)