Codex passa a trocar de janela de contexto em vez de resumir
Três PRs mesclados mostram que o Codex vai abrir uma nova janela em vez de gerar um resumo quando o contexto enche, com novas ferramentas de histórico e notas.
119 artigos verificados sobre Programação com IA, produtos e movimentos do setor. Página 1 de 2
Três PRs mesclados mostram que o Codex vai abrir uma nova janela em vez de gerar um resumo quando o contexto enche, com novas ferramentas de histórico e notas.
A ByteDance adia o lançamento do modelo Doubao 2.2 para reforçar antes as capacidades de programação, chamada de ferramentas e agentes de IA.
A OpenAI encerra o contrato de fornecimento de modelos ao Cursor após a SpaceX adquirir a empresa por 60 bilhões de dólares, com data de corte prevista para 12 de novembro de 2026.
No primeiro dia em que o GLM-5.3-Flash passou a ser pago, o DeepSeek retomou o primeiro lugar no uso diário do OpenCode, revelando a sensibilidade dos desenvolvedores ao preço.
A OpenAI está testando um Persistent mode para a versão de linha de comando do Codex, em que o agente trabalha continuamente até o usuário decidir pausá-lo, mas sem previsão de lançamento no curto prazo.
Warp explica como um agente revisor ajusta continuamente as skills de seus agentes de IA a partir do feedback humano, sem tocar nos pesos do modelo.
O CEO da Shopify, Tobi Lütke, ameaça proibir o Claude Code internamente se a Anthropic não passar a ler o AGENTS.md — depois de um ano de silêncio, a empresa finalmente explicou o motivo da recusa.
Quase todo o pessoal da OpenAI usa o Codex internamente, mas entre assinantes individuais pagantes o uso de agentes fica abaixo de 1% — a TechCrunch mostra onde trava a adoção.
A OpenAI reinstala o limite de cinco horas do Plus no ChatGPT Work e no Codex, e admite que 3% das respostas Pro e Thinking foram parar no GPT-5.5-mini.
Em um vídeo, o GPT-5.6 Sol projeta o processador RV32IM Codex-R32 dentro da sandbox do jogo Turing Complete e roda o DOOM via PureDOOM, mostrando coerência de design entre múltiplas camadas de abstração.
ByteDance funde TRAE e Coze ao ecossistema Doubao, concentrando programação com IA e criação de agentes em um novo produto de escritório chamado Doubao Work.
Um modelo anônimo no OpenRouter oferece 1 milhão de tokens de contexto de graça, pistas técnicas apontam para a Zhipu, enquanto lançamentos anônimos viram estratégia comum.
Nvidia paga US$ 6 bilhões para licenciar o sistema de treinamento da Poolside, investe mais US$ 1 bilhão e contrata 109 funcionários, mas a empresa segue independente.
Anthropic torna público o ciclo de vida de desenvolvimento de software AI-native usado internamente em torno do Claude, com seis fases, uma cadeia de arquivos markdown e quatro peças de governança.
A OpenAI diz que a recente redução de cota do Codex mirou quem transforma a assinatura em tráfego de API e a compartilha via sub2api, sinalizado pelo sistema antifraude.
OpenAI abre o código do "harness" do Codex em três níveis de integração; Cisco, GitHub, JetBrains e uma empresa de serviços fiscais já usam a tecnologia, um piloto processou 7 mil declarações.
A Anthropic colocou o Claude na linha de frente do plantão: mediana de 14 minutos até a primeira análise com evidências, 4 minutos no melhor caso, num cenário de entrega de código 8 vezes maior por trimestre.
GLM-5.3 marca 60 pontos no Intelligence Index da Artificial Analysis, 8º entre 182 modelos, com API a US$ 1,4/4,4 — mas o alto consumo de tokens por tarefa reduz a vantagem de preço.
A Cursor lançou o Origin, um serviço próprio de hospedagem de código para assinantes pagantes, poucas horas antes de uma queda global do GitHub que durou quase sete horas, reacendendo o debate sobre o futuro da hospedagem de código na era dos agentes de IA.
A Modular publicou no GitHub o compilador e a toolchain do Mojo sob licença Apache 2.0 com exceção da LLVM, um mês depois de a Qualcomm concluir a aquisição da empresa.
A OpenCode elevou a cota mensal do Flash no plano Go de 15 para 30 dólares e passou a testar tarifas de horário de pico no plano Pro.
A OpenAI afirma que quase todos os alertas de segurança iniciais já são triados primeiro pela IA, deixando às pessoas apenas as decisões de alto impacto.
A API DeepSeek V4 Pro agora aponta para a versão 0813, com contexto de 1M tokens, saída máxima de 384K e aviso de reajuste de preços.
O Qwen3.8-2.4T-A95B apareceu no ModelScope como repositório open-weight, transformando a promessa de abertura em um artefato verificável.
A InclusionAI abriu o Ling-3.0-tiny, um modelo MoE de 7,9B parâmetros que ativa 1,3B por token para cargas de agentes locais.
A Thinking Machines lançou o Inkling-Small com pesos abertos, 276B parâmetros totais, 12B ativos, entrada multimodal e resultados próximos ao Inkling de 975B.
A DeepSeek abriu o beta público da API V4-Flash 0731, adicionou Responses API para Codex e divulgou fortes ganhos em testes de agentes.
A Unity China lançou o Tuanjie Engine 2.0 com Codely e colocou agentes de jogos dentro de um fluxo de engenharia auditável.
O Laguna S 2.1 mira empresas que querem hospedar agentes de programação internamente, mantendo dados sob controle mesmo com distância dos modelos fechados líderes.
O Qwen3.8-Max-Preview chega com 2,4T parâmetros, acesso via Qoder e grandes descontos de Credits antes de um model card completo e benchmarks independentes.
O Gemini 3.5 Pro do Google teria ficado meses atrasado enquanto a empresa tenta melhorar sua capacidade de programação.
A Moonshot AI lançou o Kimi K3 com 2,8 trilhões de parâmetros, contexto de 1 milhão de tokens e preços de API; a prova open-weight ainda depende de pesos e model card.
Agnes-2.5-Flash usa modelo de código gratuito para pressionar ferramentas agentic de desenvolvedor. O texto resume os fatos verificados e o sinal que vai além de um anúncio isolado.
Grok Build é acusado de enviar bundles de repositório além dos arquivos abertos. O texto resume os fatos verificados e o sinal que vai além de um anúncio isolado.
Reescrita do Bun com Claude provoca reação do Zig. Uma leitura local dos fatos verificados e do sinal setorial por trás da notícia.
Grok 4.5 mira vagas de coding com preço baixo. Uma leitura local dos fatos verificados e do sinal setorial por trás da notícia.
GhostApproval expõe risco de symlink em ferramentas de coding com IA. Uma leitura local dos fatos verificados e do sinal setorial por trás da notícia.
Meta precifica Muse Spark 1.1 para agentes e reescrito para leitores de tecnologia em portugues, preservando numeros, promessas de produto e pontos de verificacao.
MoonBit aposta em linguagem de programacao nativa para IA e reescrito para leitores de tecnologia em portugues, preservando numeros, promessas de produto e pontos de verificacao.
Claude Code recebe alerta de risco do NVDB chines e reescrito para leitores de tecnologia em portugues, preservando numeros, promessas de produto e pontos de verificacao.
Software factories, enterprise agents and investor-operators.
Model choice, Azure hosting and coding-model price pressure.
AI coding agents, ACP protocol support and editor strategy.
Meta restringe Claude Code e Codex para equipes de IA. O texto resume os pontos centrais, os números-chave, a posição das empresas e o efeito para mercado ou regulação.
Claude Sonnet 5 mira agentes mais baratos。
Cursor leva agentes de código ao celular。
Chamath volta como CEO após 8090 Labs captar US$135 mi
Google acelera coding com IA após taxa ficar perto da metade
Base44 da Wix lança modelo próprio com ARR de US$150 mi
A Tenet Security descreve Agentjacking, em que invasores inserem relatórios falsos que agentes de código tratam como instruções confiáveis.
O GLM-5.2 open-weight da Z.ai fez 74,4 no FrontierSWE, perto do Claude Opus e acima do GPT-5.5 em alguns benchmarks, com tokens mais baratos.
Sinais não confirmados da OpenAI sugerem foco em contexto longo, raciocínio mais forte e programação agentic.
A pesquisa Agentjacking da Tenet mostra como telemetria confiável pode virar instrução executável para assistentes de programação.
A carga de agentes de programação sempre ativos testa a infraestrutura antiga do GitHub e a migração para Azure.
Dias apos o IPO, a SpaceX exerceu uma opcao em acoes para adquirir a Anysphere, dona do Cursor.
A Moonshot AI lançou o Kimi K2.7-Code com modo HighSpeed. O modelo aparece bem em testes próprios, mas o preço de saída muito menor é o ponto mais forte.
A xAI adicionou um Agent Dashboard ao Grok Build e reduziu o acesso do plano Heavy de US$ 300 para opções mais baratas.
Um benchmark liderado pela Shanghai Jiao Tong University mostra que agentes acham o arquivo certo, mas acertam só 14% a 19% das linhas do bug.
O GLM-5.2 da Zhipu combina MoE de 744B parâmetros, janela de 1 milhão de tokens e promessa de pesos abertos em estilo MIT para agentes de programação.
O MoE aberto da Moonshot cobra muito menos por tokens e melhora benchmarks de coding com agentes em relação ao K2.6.
O classificador do Cursor libera ações de baixo risco e pausa etapas sensíveis, reduzindo a fadiga de aprovações.
O novo comando da Anthropic copia uma sessão ativa para testar caminhos arriscados sem perder o contexto original.
Moonshot abre Kimi K2.7-Code para programação com IA.
O movimento mostra que a disputa de IA não depende só de modelos ou ferramentas, mas de capital, adoção por clientes e preparo regulatório.
O movimento mostra que a disputa de IA não depende só de modelos ou ferramentas, mas de capital, adoção por clientes e preparo regulatório.
O MoE de 30B parâmetros da Cohere ativa cerca de 3B, suporta contexto de 256K e sai sob Apache 2.0.
A Cursor planeja uma sede europeia em Londres e quer levar a equipe regional a cerca de 200 pessoas até o fim do ano.
A plataforma backend baseada em Postgres diz que usuários mais que dobraram e agentes já implantam a maioria dos bancos.
Copilot’s AI Credits make agentic sessions and frontier models usage-based, exposing developers to bills far above the old flat subscription.
Plugins por função, Sites e annotations transformam o Codex em ferramenta de workflow para trabalhadores do conhecimento.
Um piloto do Google Play teria oferecido dinheiro por código-fonte de desenvolvedores, incluindo projetos arquivados, sem citar IA no email.
No Build 2026, a Microsoft apresentou sete modelos treinados internamente, e o MAI-Code-1-Flash superou Claude Haiku 4.5 nos benchmarks citados.
O GitHub substitui os premium requests do Copilot por AI Credits, aproximando sessões longas de agent coding do custo real em tokens.
No Build 2026, a Microsoft colocou o Windows como plataforma de agentes e indicou o Project Polaris como motor padrão de raciocínio do GitHub Copilot.
A Sekai captou uma Series A de US$ 20 milhões após usuários criarem 15 milhões de mini apps e passarem mais de uma hora por dia na plataforma.
O Copilot troca premium requests por AI Credits e expõe o custo real de tokens na programação com agentes.
A startup de codificação de IA Cognition levanta mais de US$ 1 bilhão com valuation de US$ 26 bilhões, alegando que 90% de seu código interno é gerado por seu agente de IA Devin.
No primeiro evento europeu de desenvolvedores da Anthropic, uma votação de mãos mostrou que quase metade dos participantes mesclou pull requests escritos inteiramente pelo Claude sem ler o código.
A atualização 3.5 do Cursor move o recurso Automations de uma página web independente para a janela Agents do IDE, permitindo suporte a múltiplos repositórios e fluxos de trabalho além da codificação.
O Google lançou o Antigravity 2.0 no I/O 2026, uma plataforma de agente independente que pode orquestrar 93 subagentes para construir um sistema operacional em 12 horas.
Cursor lançou seu terceiro modelo de programação próprio, Composer 2.5, que iguala Opus 4.7 e GPT-5.5 em benchmarks públicos com custo por tarefa de apenas um décimo.
O Gemini 3.5 Flash do Google supera o GPT-5.5 em benchmarks de agentes com preço muito baixo e se torna o modelo padrão no aplicativo Gemini e na Pesquisa.
OpenAI added Codex controls to ChatGPT on iPhone, iPad and Android, letting users monitor and approve coding tasks away from the desktop.
Cursor’s cloud agents now support multi-repository environments, faster builds and enterprise controls for teams with microservice codebases.
O Coder Agents leva agentes de programação com IA para a infraestrutura da própria empresa, com escolha flexível de modelo e sem enviar código ou prompts para fora da rede.
A Cognition AI, empresa criadora do Devin – descrito como "o primeiro engenheiro de software de IA totalmente autônomo do mundo" – está negociando uma nova rodada de financiamento com uma avaliação-alvo de US$ 25 bilhões, um aumento de seis vezes em apenas 13 meses.
Sundar Pichai revelou em teleconferência de resultados que 75% do novo código do Google é agora escrito por IA, ante 25% há 18 meses, e que a migração de código está seis vezes mais rápida. Alguns funcionários da DeepMind usam o Claude Code da Anthropic em vez do Gemini.
DeepSeek lança V4-Pro e V4-Flash com arquitetura MoE, preço de saída de US$ 3,48/milhão de tokens, significativamente mais barato que GPT-5.5 e Claude Opus 4.7, e pontuação 3206 no Codeforces superando GPT-5.4.
Pesquisa da JetBrains de janeiro de 2026 com mais de 10 mil desenvolvedores profissionais mostra que 90% já usam ferramentas de IA. Claude Code saltou de 3% para 18% em seis meses, enquanto GitHub Copilot não apresentou crescimento significativo, mantendo-se em 29%.
A Anthropic redesenhou completamente o aplicativo desktop do Claude Code e lançou o recurso Routines, permitindo que desenvolvedores gerenciem várias sessões simultâneas e automatizem fluxos de trabalho por meio de eventos do GitHub.
Dois anos após a popularização das ferramentas de programação com IA, algumas equipes viram o volume de commits de código dobrar, mas a entrega de produtos não acelerou e os bugs aumentaram. O fenômeno "Tokenmaxxing" – tratar o orçamento de tokens de IA como símbolo de status – é contestado pelos dados.
Qwen3.6-35B-A3B, um modelo MoE de 35B parâmetros que ativa apenas 3B, alcança 73,4% no SWE-bench Verified, superando o Gemma 4-31B do Google. O modelo pode ser executado em uma RTX 4090 e em um MacBook Pro M4/M5.
A ferramenta de programação com IA Cursor está negociando uma rodada de financiamento de US$ 2 bilhões com valuation pré-money de mais de US$ 50 bilhões, liderada por a16z e Thrive Capital, com participação da Nvidia.
A equipe de engenharia da Agoda descobriu que, embora a produtividade individual tenha aumentado com a IA, a velocidade geral de entrega do projeto não mudou, transferindo o gargalo da escrita de código para a revisão e especificação.
Todos pensavam que as ferramentas de programação com IA acabariam se unificando em uma só – o resultado foi o oposto.
A Apple está enviando dezenas de engenheiros da equipe Siri para um bootcamp de programação com IA, focado no uso do Claude Code, enquanto se prepara para a WWDC e tenta corrigir atrasos no desenvolvimento do assistente.
Factory anuncia rodada Série B de US$ 150 milhões, avaliada em US$ 1,5 bilhão, liderada pela Khosla Ventures. A startup desenvolve agentes de IA para programação em nível empresarial, voltados para grandes equipes de engenharia com requisitos complexos de conformidade e segurança.
A Z.ai (antiga Zhipu AI) lançou o GLM-5.1, com 754B parâmetros, arquitetura MoE e código aberto sob licença MIT. O modelo alcançou 58,4% no SWE-Bench Pro, superando GPT-5.4 e Claude Opus 4.6, e foi treinado exclusivamente em chips Huawei Ascend 910B e framework MindSpore, sem GPUs NVIDIA.
A OpenAI implantou o modelo GPT-5.3-Codex-Spark nos chips Cerebras WSE-3 em vez de GPUs Nvidia, atingindo mais de 1000 tokens por segundo – cerca de 15 vezes mais rápido que a versão padrão, marcando a primeira implantação de produção da empresa em hardware que não é da Nvidia.
OpenAI lançou uma grande atualização para o Codex, transformando-o de uma ferramenta de chat para escrever código em um agente que pode operar silenciosamente em segundo plano no desktop. A atualização introduz o "background computer use", permitindo que o Codex controle outros aplicativos no macOS sem assumir a tela inteira, além de navegador integrado, geração de imagens, mais de 90 novos plugins e autoagendamento.