Anthropic admite três erros que prejudicaram o desempenho do Claude

Ontem (23 de abril), a Anthropic fez algo raro: admitiu publicamente seus erros.

Não com frases vagas de relações públicas, mas listando três decisões técnicas específicas — quando foram alteradas, o que foi alterado, por que, quais as consequências e quando foram corrigidas.

Do início de março a meados de abril, essas três alterações se sobrepuseram, fazendo o Claude Code parecer cada vez mais burro aos olhos dos usuários. Muitos pensaram ser uma degradação do modelo, mas na verdade foram três decisões que podem ser atribuídas a momentos específicos.

Primeiro erro: Colocar o Claude silenciosamente em modo econômico

Data: 4 de março

A profundidade de raciocínio padrão do Claude Code foi alterada de high (alta) para medium (média). A justificativa foi reduzir a latência para respostas mais rápidas.

O resultado foi que os usuários sentiram claramente que o Claude Code ficou mais burro. Com as mesmas perguntas, a qualidade da saída caiu.

Conclusão da Anthropic: "Esta foi uma troca errada. Revertemos essa alteração em 7 de abril, porque os usuários nos disseram que preferem alta inteligência por padrão e escolher baixa latência ativamente quando necessário."

Muitos usuários já relatavam isso em meados de março, mas na época a Anthropic não explicou publicamente o motivo. Agora foi oficialmente admitido: não foi um bug, mas uma decisão errada tomada ativamente.

Do problema à correção: mais de um mês.

Segundo erro: Otimização de cache introduziu bug de esquecimento

Data: 26 de março

A equipe de engenharia, ao otimizar o cache, introduziu um bug:

Lógica normal — o cache da sessão de raciocínio é limpo somente quando o usuário fica um período sem interagir. Após o bug, passou a ser limpo toda vez que o usuário enviava uma mensagem.

O resultado foi que Claude se tornou esquecido e repetitivo nas conversas. Algo dito há pouco era esquecido na mensagem seguinte. Usuários pensavam ser degradação da inteligência, mas na verdade era um vazamento de memória.

Anthropic disse: "Esta não é a experiência que os usuários deveriam ter ao usar o Claude Code."

Data da correção: 10 de abril.

Do problema à correção: 15 dias.

Terceiro erro: Limite de palavras adicionado, desempenho caiu 3%

Data: 16 de abril

A Anthropic modificou os prompts do sistema, adicionando dois limites:

  • Entre chamadas de ferramentas: no máximo 25 palavras
  • Resposta final: no máximo 100 palavras

O objetivo era tornar Claude mais conciso. Testes internos revelaram uma queda de desempenho de 3%.

Em 20 de abril, essa alteração foi revertida.

Do problema à correção: 4 dias — muito mais rápido que o segundo bug, pois desta vez pelo menos havia dados de testes internos para embasar a decisão.

Três erros sobrepostos

Linha do tempo:

Data da alteraçãoConteúdo específicoData da correção
4 de marçoProfundidade de raciocínio high → medium7 de abril (>1 mês)
26 de marçoBug de cache, limpeza a cada mensagem10 de abril (15 dias)
16 de abrilLimite de palavras nos prompts do sistema20 de abril (4 dias)

A percepção dos usuários: Claude estava piorando constantemente, mas não estava claro onde estava o problema.

Porque os três problemas estavam atuando simultaneamente. Os sintomas relatados pelos usuários se misturavam, e a própria Anthropic precisou de tempo para identificar as causas.

Após a análise pública

O compromisso da Anthropic é com três coisas: melhorar os processos de teste, informar os usuários com antecedência sobre mudanças e redefinir os limites de uso das contas afetadas.

Admitir erros é algo raro na indústria de IA. Estar disposta a apresentar prazos e números concretos, sem rodeios, é melhor do que a maioria das empresas.

Mas há um detalhe digno de nota: o terceiro bug foi lançado após a Anthropic realizar testes internos — e ainda assim foi preciso detectar a queda de 3% no desempenho para reverter a mudança. O próprio processo de teste não conseguiu impedi-lo.

Este não é um problema exclusivo da Anthropic. Qual é o custo da iteração rápida? Cada lançamento é uma aposta na probabilidade de erros. A percepção dos usuários de que "a IA piorou" se acumula e é difícil de ser atribuída imediatamente.

Uma análise pública não pode resolver essa tensão, mas é pelo menos o começo de enfrentá-la.

A próxima questão é: o novo processo de teste prometido conseguirá realmente impedir uma alteração semelhante no futuro? A resposta só será conhecida quando o próximo problema surgir.

Fonte de referência: Anthropic admits it dumbed down Claude with upgrades (The Register, CocoLoop, 23 de abril de 2026); AI Dispatch: Daily Trends and Innovations – April 23, 2026 (Hipther, 23 de abril de 2026)