Grok 4.7 mantém preço, mas tokens por tarefa dobram

Em 21 de setembro, a SpaceXAI lançou o Grok 4.7, descrito pela empresa como seu "modelo mais capaz para programação e trabalho de conhecimento". O preço e a velocidade da API permanecem iguais aos do Grok 4.6: 2 dólares por milhão de tokens de entrada e 6 dólares por milhão de tokens de saída, além de uma versão rápida com preço e velocidade de saída dobrados. O modelo já está disponível no Cursor, no Grok Build, no console da API e em plataformas de terceiros.

"our most capable model for coding and knowledge work."

É assim que a SpaceXAI posiciona oficialmente o Grok 4.7: um modelo para programação e trabalho de conhecimento.

Segundo a empresa, o novo modelo usa uma base maior que a do 4.6, com treinamento de aprendizado por reforço mais longo, focado em tarefas longas que duram horas, com melhor autoverificação e capacidade de lidar com contextos extensos, além de integração nativa com o Grok Bot.

Resultados oficiais e avaliações de terceiros

Alguns números divulgados pela própria SpaceXAI: DeepSWE v1.1 71,0%, CursorBench 4.0 46,3%, Terminal-Bench 4.0 37,6%, EEBench (engenharia elétrica) 64,0%. Em segurança, a empresa afirma liderar o setor em recusa de respostas e resistência a jailbreak, com taxa de vazamento de alertas de risco de 3,3% no HackerBench v0.3; o acesso de red team é restrito, por convite, a alguns parceiros de segurança cibernética.

Resultados da avaliadora independente Artificial Analysis: índice geral de inteligência de 46 pontos, 2 a mais que o 4.6; índice de agente de codificação combinado com o Grok Build de 56 pontos, 9 a mais que o 4.6. Nos itens individuais, o DeepSWE v1.1 subiu de 65% para 73%, o Terminal-Bench 4.0 de 18% para 33%, e o SWE-Atlas-QnA de 58% para 63%. Segundo essa avaliação, o Grok 4.7 com Grok Build fica em quarto lugar no índice de agente de codificação, atrás de Claude Fable 5.1, GPT-6 Astra e Claude Opus 5. No benchmark de trabalho de conhecimento de longo prazo AA-Briefcase, obteve 1657 pontos Elo, 111 a mais que o 4.6.

A página oficial de lançamento não traz um ranking direto com concorrentes, e a SpaceXAI não respondeu sobre as posições nas avaliações de terceiros.

Fazendo as contas do uso

A tabela de preços não mudou, mas o consumo de tokens registrado pela Artificial Analysis, sim: no nível xhigh, o Grok 4.7 produz em média cerca de 81 mil tokens de saída por tarefa, contra cerca de 38 mil do 4.6 no mesmo nível, um aumento de 125%. A velocidade de saída é de cerca de 188 tokens por segundo, com uma tarefa durando em média 7,1 minutos.

Fazendo uma conta simples, considerando só a saída, uma tarefa custa cerca de 0,23 dólar no 4.6 e cerca de 0,49 dólar no 4.7. O preço de tabela ficou igual, mas o gasto real por tarefa mais que dobrou — boa parte do ganho de pontuação vem de o modelo "pensar por mais tempo".

Colocando na tabela de preços desta semana, a conta fica ainda mais evidente. Um dia depois do lançamento do Grok 4.7, o Claude Opus 5.5 da Anthropic e o GPT-6 Sol da OpenAI entraram no ar: o Opus 5.5 cobra 4 dólares por milhão de tokens de entrada e 20 dólares na saída, enquanto o GPT-6 Sol caiu para 2 e 10 dólares. Pelo preço de tabela por milhão de tokens, o preço de saída do Grok 4.7 ainda é o mais baixo; quanto essa diferença vai encolher ao considerar o gasto real por tarefa depende do consumo de tokens dos outros dois modelos, e esses dados de terceiros ainda não estão completos.

Menos de dois dias depois de o Grok 4.7 atingir 46 pontos, o Opus 5.5 e o GPT-6, duas novas gerações de modelos, já entraram na fila de avaliação da Artificial Analysis — a metade superior do ranking deve mudar de novo.

Fontes: página oficial de lançamento da SpaceXAI, CocoLoop, relatório de avaliação da Artificial Analysis; o preço da API e os resultados oficiais foram verificados na página de lançamento da SpaceXAI, o índice de inteligência, o índice de agente de codificação e o consumo de tokens foram verificados conforme os dados da Artificial Analysis, e o custo de saída por tarefa é uma estimativa aproximada com base no preço de tabela.