A Thinking Machines lançou o Inkling-Small em 30 de julho. O modelo tem 276B parâmetros totais e 12B ativos, aceita texto, imagem e áudio, e foi publicado com pesos abertos.
Segundo a empresa, ele começou a ser treinado depois do Inkling e recebeu uma mistura de dados e receita de treinamento revisadas. Também passou por on-policy distillation com o Inkling como professor e mais duas semanas de RL para agentic coding.
“Inkling-Small’s combination of broad performance and efficiency will make it easy to experiment with and test in real applications.”
Menor, mas ainda pesado
O model card descreve um Transformer decoder-only de 42 camadas, com MoE esparso: cada token vai para 6 de 256 especialistas, além de 2 especialistas compartilhados. A janela de contexto chega a 1 milhão de tokens e a licença é Apache 2.0.
O vLLM Recipes informa que a variante NVFP4 exige pelo menos 180GB de VRAM agregada, enquanto a BF16 exige 600GB. Ainda não é uma máquina comum, mas fica abaixo do patamar multi-terabyte citado pela 36Kr/Xinzhiyuan para o Inkling original.
O placar é forte, com ressalvas
No quadro oficial, o Inkling-Small marca 80,2% no SWE-bench Verified, 64,7% no Terminal Bench 2.1, 31,6% no HLE text only e 40,1% no ARC-AGI-2. Todos superam o Inkling na mesma tabela.
A Artificial Analysis dá uma leitura mais prudente: 40 pontos no Intelligence Index, contra 41 do Inkling, mas com limitações em conhecimento factual e algumas tarefas agentic.
O teste real começa agora
A entrega inclui pesos, model card, Hugging Face e caminhos de implantação via vLLM e SGLang. O que importa agora é estabilidade em configurações de 180GB/600GB, ajuste fino em bases de código reais e reprodução dos ganhos de coding e multimodal fora dos harnesses oficiais.
Fontes: 36Kr/Xinzhiyuan, comunicado da Thinking Machines, CocoLoop, model card do Inkling-Small, Artificial Analysis, Hugging Face e vLLM Recipes; fontes oficiais verificam marco de lançamento, parâmetros, licença, contexto, treinamento e escopo dos benchmarks, enquanto terceiros verificam requisitos de implantação e pontuações independentes.