A Moonshot AI anunciou em 11 de setembro, nas notas de atualização do Kimi Code, que o K2.8 Preview já está disponível para todos os usuários. O posicionamento oficial se resume a duas frases: desempenho geral próximo do K3, com eficiência de raciocínio claramente superior à do K2.7 Code; as capacidades de codificação e de agente foram "amplamente aprimoradas".
Essa troca de modelo não veio com troca de nome. O ID do modelo continua sendo kimi-for-coding, então nem o cliente Kimi Code nem as ferramentas de terceiros que usam esse ID precisam mudar a configuração — as requisições já caem direto no novo modelo.
Três mudanças confirmadas
A primeira é o nível de raciocínio. O K2.8 Preview permite ajustar o thinking effort, com os mesmos níveis do K3: low, high e max, com max como padrão.
A segunda é o contexto. Todos os planos de assinatura passam a ter janela de contexto de até 1M de tokens, sem mais distinção por plano.
A terceira é a regra de roteamento. As notas de atualização deixam claro: com o thinking desativado, as requisições tanto da linha K3 quanto do K2.8 Preview são roteadas para o K2.8 Preview sem raciocínio. Ou seja, quem seleciona K3 no Kimi Code mas desliga o thinking está, na prática, usando o K2.8 Preview.
A frase "perto do K3" ainda não veio acompanhada de números. As notas de atualização não trazem tabela de benchmark, não dizem quando o Preview vira versão oficial e não mencionam se o preço ou as cotas dos planos vão mudar. Como comparação, quando o K2.7 Code foi lançado em 12 de junho, a empresa divulgou dois números: alta de 10,4% no Program-Bench e queda de 30% no consumo de tokens de raciocínio. O K3 foi lançado em 16 de julho, com 2,8 trilhões de parâmetros no total e janela de contexto de 1 milhão de tokens.
Mesmo nome de modelo, impacto diferente conforme o uso
kimi-for-coding funciona como um alias fixo; qual modelo está por trás dele é decisão da Moonshot AI. Para desenvolvedores individuais, isso elimina a etapa de alterar a configuração.
Para quem integrou o Kimi Code a pipelines de CI, scripts de automação ou ferramentas de codificação padronizadas da equipe, a situação é diferente: a partir de hoje, a mesma configuração passa a rodar em outro modelo, e o estilo das respostas, o tempo de processamento e o consumo de tokens podem mudar junto. As notas de atualização não dizem se ainda é possível especificar o K2.7 Code.
A corrida das assinaturas de programação com IA na China está concorrida ultimamente. A Zhipu AI lançou em 10 de setembro, em Hangzhou, um programa de Coding para toda a cidade, com subsídios para planos de Coding. Nesta atualização, a Kimi não trouxe nenhum item de preço; o destaque foi o novo modelo e o contexto de 1M em todos os planos.
Modo de permissão mudou duas vezes em dois dias
Além do modelo, o cliente de linha de comando do Kimi Code mudou sua lógica de permissões seguidamente no início deste mês. A versão v0.40.0, de 2 de setembro, renomeou os antigos modos YOLO e Auto para "Totalmente automático" (/never-ask) e "Perguntar quando necessário" (/ask-when-needed), enquanto o Manual passou a se chamar "Sempre perguntar"; ao mesmo tempo, foi adicionada uma proteção embutida: comandos como shutdown, reboot e rm -rf passaram a ser recusados diretamente no modo totalmente automático, e nos demais modos a execução exige confirmação prévia do usuário.
Dois dias depois, a v0.41.0 trouxe esta frase: "Comandos perigosos não são mais bloqueados. O modo de permissão automática não bloqueia mais comandos perigosos nem comandos que não podem ser analisados estaticamente." A documentação não explica o motivo dessa reversão, nem deixa claro se "modo de permissão automática" se refere só ao nível "Totalmente automático" ou também inclui o "Perguntar quando necessário".
A v0.41.0 também trouxe dois novos recursos para a versão web: o Tower, uma colaboração experimental multiagente (iniciada com /tower), e a possibilidade de selecionar trechos de texto para adicionar anotações em mensagens, pré-visualizações de arquivos e diffs. Na versão anterior, o pool de modelos para sub-agentes deixou de ser um recurso experimental e passou a ser oficial, permitindo configurar um grupo de modelos candidatos.
Para equipes que configuram o Kimi Code no modo totalmente automático e o rodam em ambientes sem supervisão, se comandos de exclusão e desligamento serão bloqueados ou não agora depende de teste na versão do cliente instalada. A Moonshot AI ainda não se pronunciou separadamente sobre essa mudança.
Fontes: notas de atualização oficiais do Kimi Code (itens K2.8 Preview, v0.40.0, v0.41.0), IT Home, CocoLoop; parâmetros e números de teste do K3 e do K2.7 Code conforme divulgação oficial da Moonshot AI.