Ontem (23 de abril), a Anthropic fez algo raro: admitiu publicamente seus erros.
Não com frases vagas de relações públicas, mas listando três decisões técnicas específicas — quando foram alteradas, o que foi alterado, por que, quais as consequências e quando foram corrigidas.
Do início de março a meados de abril, essas três alterações se sobrepuseram, fazendo o Claude Code parecer cada vez mais burro aos olhos dos usuários. Muitos pensaram ser uma degradação do modelo, mas na verdade foram três decisões que podem ser atribuídas a momentos específicos.
Primeiro erro: Colocar o Claude silenciosamente em modo econômico
Data: 4 de março
A profundidade de raciocínio padrão do Claude Code foi alterada de high (alta) para medium (média). A justificativa foi reduzir a latência para respostas mais rápidas.
O resultado foi que os usuários sentiram claramente que o Claude Code ficou mais burro. Com as mesmas perguntas, a qualidade da saída caiu.
Conclusão da Anthropic: "Esta foi uma troca errada. Revertemos essa alteração em 7 de abril, porque os usuários nos disseram que preferem alta inteligência por padrão e escolher baixa latência ativamente quando necessário."
Muitos usuários já relatavam isso em meados de março, mas na época a Anthropic não explicou publicamente o motivo. Agora foi oficialmente admitido: não foi um bug, mas uma decisão errada tomada ativamente.
Do problema à correção: mais de um mês.
Segundo erro: Otimização de cache introduziu bug de esquecimento
Data: 26 de março
A equipe de engenharia, ao otimizar o cache, introduziu um bug:
Lógica normal — o cache da sessão de raciocínio é limpo somente quando o usuário fica um período sem interagir. Após o bug, passou a ser limpo toda vez que o usuário enviava uma mensagem.
O resultado foi que Claude se tornou esquecido e repetitivo nas conversas. Algo dito há pouco era esquecido na mensagem seguinte. Usuários pensavam ser degradação da inteligência, mas na verdade era um vazamento de memória.
Anthropic disse: "Esta não é a experiência que os usuários deveriam ter ao usar o Claude Code."
Data da correção: 10 de abril.
Do problema à correção: 15 dias.
Terceiro erro: Limite de palavras adicionado, desempenho caiu 3%
Data: 16 de abril
A Anthropic modificou os prompts do sistema, adicionando dois limites:
- Entre chamadas de ferramentas: no máximo 25 palavras
- Resposta final: no máximo 100 palavras
O objetivo era tornar Claude mais conciso. Testes internos revelaram uma queda de desempenho de 3%.
Em 20 de abril, essa alteração foi revertida.
Do problema à correção: 4 dias — muito mais rápido que o segundo bug, pois desta vez pelo menos havia dados de testes internos para embasar a decisão.
Três erros sobrepostos
Linha do tempo:
| Data da alteração | Conteúdo específico | Data da correção |
|---|---|---|
| 4 de março | Profundidade de raciocínio high → medium | 7 de abril (>1 mês) |
| 26 de março | Bug de cache, limpeza a cada mensagem | 10 de abril (15 dias) |
| 16 de abril | Limite de palavras nos prompts do sistema | 20 de abril (4 dias) |
A percepção dos usuários: Claude estava piorando constantemente, mas não estava claro onde estava o problema.
Porque os três problemas estavam atuando simultaneamente. Os sintomas relatados pelos usuários se misturavam, e a própria Anthropic precisou de tempo para identificar as causas.
Após a análise pública
O compromisso da Anthropic é com três coisas: melhorar os processos de teste, informar os usuários com antecedência sobre mudanças e redefinir os limites de uso das contas afetadas.
Admitir erros é algo raro na indústria de IA. Estar disposta a apresentar prazos e números concretos, sem rodeios, é melhor do que a maioria das empresas.
Mas há um detalhe digno de nota: o terceiro bug foi lançado após a Anthropic realizar testes internos — e ainda assim foi preciso detectar a queda de 3% no desempenho para reverter a mudança. O próprio processo de teste não conseguiu impedi-lo.
Este não é um problema exclusivo da Anthropic. Qual é o custo da iteração rápida? Cada lançamento é uma aposta na probabilidade de erros. A percepção dos usuários de que "a IA piorou" se acumula e é difícil de ser atribuída imediatamente.
Uma análise pública não pode resolver essa tensão, mas é pelo menos o começo de enfrentá-la.
A próxima questão é: o novo processo de teste prometido conseguirá realmente impedir uma alteração semelhante no futuro? A resposta só será conhecida quando o próximo problema surgir.
Fonte de referência: Anthropic admits it dumbed down Claude with upgrades (The Register, CocoLoop, 23 de abril de 2026); AI Dispatch: Daily Trends and Innovations – April 23, 2026 (Hipther, 23 de abril de 2026)