Codex change de fenêtre de contexte au lieu de résumer
Trois PR fusionnées montrent que Codex ouvrira une nouvelle fenêtre plutôt qu'un résumé quand le contexte est plein, avec des outils d'historique et de notes pour tout retrouver.
119 articles vérifiés sur Codage IA, les produits et le secteur. Page 1 sur 2
Trois PR fusionnées montrent que Codex ouvrira une nouvelle fenêtre plutôt qu'un résumé quand le contexte est plein, avec des outils d'historique et de notes pour tout retrouver.
ByteDance repousse la sortie du modèle Doubao 2.2 pour d'abord renforcer ses capacités de codage, d'appel d'outils et d'agents IA.
OpenAI met fin au contrat de fourniture de modèles à Cursor après le rachat de l'entreprise par SpaceX pour 60 milliards de dollars, avec une date d'arrêt prévue au 12 novembre 2026.
Dès le premier jour de facturation de GLM-5.3-Flash, DeepSeek a repris la première place de l'usage quotidien sur OpenCode, révélant la sensibilité au prix des développeurs.
OpenAI teste un Persistent mode pour la version en ligne de commande de Codex, où l'agent continue de travailler jusqu'à ce que l'utilisateur le mette en pause, sans date de lancement prévue pour l'instant.
Warp explique comment un agent réviseur ajuste en continu les compétences de ses agents IA à partir des retours humains, sans jamais toucher aux poids du modèle.
Le PDG de Shopify, Tobi Lütke, menace d'interdire Claude Code en interne si Anthropic ne lit pas AGENTS.md ; après un an de silence, l'entreprise a enfin expliqué les raisons de son refus.
En interne, la quasi-totalité du personnel d'OpenAI utilise Codex, mais moins de 1 % des abonnés individuels payants utilisent des agents — TechCrunch situe le point de blocage.
OpenAI réinstaure la limite de cinq heures pour Plus sur ChatGPT Work et Codex, et reconnaît 3 % d'erreurs de routage vers GPT-5.5-mini côté Pro et Thinking.
GPT-5.6 Sol a conçu le processeur RV32IM Codex-R32 dans le bac à sable du jeu Turing Complete, faisant tourner DOOM via le portage PureDOOM et démontrant une cohérence de conception à travers plusieurs couches d'abstraction.
ByteDance fusionne TRAE et Coze dans l'écosystème Doubao, regroupant codage IA et création d'agents dans un nouveau produit bureautique baptisé Doubao Work.
Un modèle anonyme sur OpenRouter propose 1 million de tokens de contexte gratuits, des indices techniques pointent vers Zhipu, alors que les lancements anonymes deviennent une stratégie courante.
Nvidia paie 6 milliards de dollars pour la licence du système d'entraînement de Poolside, investit 1 milliard de plus et embauche 109 salariés, mais l'entreprise reste indépendante.
Anthropic rend public son cycle de vie de développement logiciel AI-native utilisé en interne autour de Claude, en six phases, une chaîne de fichiers markdown et quatre dispositifs de gouvernance.
OpenAI affirme que la récente limitation de Codex vise ceux qui transforment leur abonnement en trafic API pour le partager via sub2api, signalé par son antifraude.
OpenAI ouvre le code du "harness" de Codex en trois niveaux d'intégration ; Cisco, GitHub, JetBrains et un prestataire de déclarations fiscales l'utilisent déjà, un pilote a traité 7 000 dossiers.
Anthropic confie l'astreinte de première ligne à Claude : 14 minutes en médiane pour la première analyse étayée, 4 minutes dans le meilleur des cas, alors que le volume de code livré par trimestre a été multiplié par 8.
GLM-5.3 obtient 60 points à l'Intelligence Index d'Artificial Analysis, 8e sur 182 modèles, avec une API à 1,4/4,4 dollars, mais sa forte consommation de tokens par tâche rogne l'avantage tarifaire.
Cursor a lancé Origin, un service d'hébergement de code maison pour ses utilisateurs payants, quelques heures avant une panne mondiale de GitHub ayant duré près de sept heures, relançant le débat sur l'avenir de l'hébergement de code à l'ère des agents IA.
Modular a publié sur GitHub le compilateur et la chaîne d'outils de Mojo sous licence Apache 2.0 avec exception LLVM, un mois seulement après le rachat de l'entreprise par Qualcomm.
OpenCode Go fait passer le quota mensuel Flash du forfait Go de 15 à 30 dollars et instaure une tarification aux heures de pointe pour le forfait Pro.
OpenAI affirme que presque toutes les alertes de sécurité initiales sont désormais triées d'abord par l'IA, les humains ne tranchant que les décisions à fort impact.
L'API DeepSeek V4 Pro pointe désormais vers la version 0813, avec 1M de contexte, 384K en sortie et un avertissement de hausse des prix.
Qwen3.8-2.4T-A95B est désormais publié sur ModelScope comme dépôt open-weight, transformant une promesse en modèle vérifiable.
InclusionAI a ouvert Ling-3.0-tiny, un modèle MoE de 7,9B paramètres qui active 1,3B paramètres par token pour les agents locaux.
Thinking Machines a publié Inkling-Small en open weights, avec 276B paramètres au total, 12B actifs, des entrées multimodales et des scores proches du modèle Inkling 975B.
DeepSeek ouvre la bêta publique de l’API V4-Flash 0731, ajoute le format Responses pour Codex et annonce de forts gains sur les tests d’agents.
Unity China lance Tuanjie Engine 2.0 avec Codely et place les agents de jeu dans un workflow d'ingénierie vérifiable.
Laguna S 2.1 vise les entreprises qui veulent héberger un agent de programmation en interne, avec un contrôle des données plus important que la course au sommet fermé.
Qwen3.8-Max-Preview arrive avec 2,4T paramètres, l'accès Qoder et de fortes remises Credits avant une model card complète et des benchmarks indépendants.
Google aurait pris plusieurs mois de retard sur Gemini 3.5 Pro, le temps d'améliorer surtout ses capacités de codage.
Moonshot AI lance Kimi K3 avec 2,8 billions de paramètres, un contexte de 1 million de tokens et des prix API publics; la preuve open-weight dépend encore des poids et de la model card.
Agnes-2.5-Flash utilise un modèle de code gratuit pour bousculer les outils développeur agentiques. L’article résume les faits vérifiés et le signal au-delà d’une annonce isolée.
Grok Build est accusé d’envoyer des bundles de dépôt au-delà des fichiers ouverts. L’article résume les faits vérifiés et le signal au-delà d’une annonce isolée.
La réécriture de Bun avec Claude déclenche la riposte de Zig. Une version localisée des faits vérifiés et du signal industriel sous-jacent.
Grok 4.5 attaque le coding par les prix bas. Une version localisée des faits vérifiés et du signal industriel sous-jacent.
GhostApproval révèle les risques de symlink dans les outils de coding IA. Une version localisée des faits vérifiés et du signal industriel sous-jacent.
Meta tarifie Muse Spark 1.1 pour les agents est repris pour des lecteurs tech francophones, avec les chiffres, les limites produit et les points de verification essentiels.
MoonBit mise sur un langage de programmation natif pour l IA est repris pour des lecteurs tech francophones, avec les chiffres, les limites produit et les points de verification essentiels.
Claude Code vise par une alerte de risque du NVDB chinois est repris pour des lecteurs tech francophones, avec les chiffres, les limites produit et les points de verification essentiels.
Software factories, enterprise agents and investor-operators.
Model choice, Azure hosting and coding-model price pressure.
AI coding agents, ACP protocol support and editor strategy.
Meta limite Claude Code et Codex pour ses équipes IA. L’article résume les points clés, les chiffres importants, la position des entreprises et l’effet pour le marché ou la régulation.
Claude Sonnet 5 vise des agents moins coûteux。
Cursor porte les agents de code sur mobile。
Chamath redevient CEO après les 135 M$ levés par 8090 Labs
Google remet la pression alors que le code écrit par IA plafonne
Base44 de Wix lance son modèle avec 150 M$ d’ARR
Tenet Security décrit Agentjacking: des attaquants injectent de faux rapports d’erreur que les agents de code traitent comme consignes fiables.
Le GLM-5.2 open-weight de Z.ai atteint 74,4 sur FrontierSWE, proche de Claude Opus et devant GPT-5.5 dans certains tests, avec des tokens bien moins chers.
Des signaux non confirmés d'OpenAI suggèrent un accent sur le long contexte, le raisonnement et le codage agentique.
L'étude Agentjacking de Tenet montre comment une télémétrie fiable peut devenir une instruction exécutable pour les assistants de code.
La charge des agents de code toujours actifs teste l'infrastructure historique de GitHub et la migration vers Azure.
Quelques jours apres son IPO, SpaceX exerce une option en actions pour racheter Anysphere, la societe derriere Cursor.
Moonshot AI a publié Kimi K2.7-Code avec un mode HighSpeed. Certains scores internes sont flatteurs, mais l'argument le plus solide reste un prix de sortie nettement inférieur.
xAI ajoute un Agent Dashboard à Grok Build et ouvre l'accès au-delà du forfait Heavy à 300 dollars.
Un benchmark mené par Shanghai Jiao Tong University montre que les agents trouvent souvent le bon fichier, mais seulement 14 à 19% des lignes pertinentes.
GLM-5.2 de Zhipu associe un MoE de 744 Md de paramètres, une fenêtre d'un million de tokens et des poids ouverts de type MIT pour les agents de code.
Le MoE ouvert de Moonshot réduit fortement les coûts d'entrée et sortie tout en progressant sur les benchmarks de code agentique.
Le classificateur de Cursor laisse passer les actions à faible risque et bloque seulement les étapes sensibles, réduisant la fatigue d'approbation.
La nouvelle commande d'Anthropic copie une session active afin d'essayer des approches risquées sans perdre le contexte original.
Moonshot ouvre Kimi K2.7-Code pour le codage IA.
Le mouvement montre que la compétition IA ne se joue plus seulement sur les modèles ou les outils, mais aussi sur le capital, l’adoption client et la réponse réglementaire.
Le mouvement montre que la compétition IA ne se joue plus seulement sur les modèles ou les outils, mais aussi sur le capital, l’adoption client et la réponse réglementaire.
Le modèle MoE 30B de Cohere active environ 3B paramètres, prend en charge 256K de contexte et sort sous Apache 2.0.
Cursor prévoit un siège européen à Londres et veut porter son équipe régionale à environ 200 personnes d’ici fin d’année.
La plateforme backend basée sur Postgres dit que ses utilisateurs ont plus que doublé et que les agents déploient la majorité des bases.
Copilot’s AI Credits make agentic sessions and frontier models usage-based, exposing developers to bills far above the old flat subscription.
Plugins par métier, Sites et annotations transforment Codex en outil de workflow pour les travailleurs du savoir.
Un pilote Google Play proposerait de payer des développeurs pour leur code source, y compris d’anciens projets, sans mentionner l’IA dans l’e-mail.
Lors de Build 2026, Microsoft a présenté sept modèles entraînés en interne, dont MAI-Code-1-Flash devant Claude Haiku 4.5 dans les benchmarks cités.
GitHub remplace les premium requests de Copilot par des AI Credits afin de rapprocher les longues sessions agentiques du coût réel en tokens.
Lors de Build 2026, Microsoft a présenté Windows comme une plate-forme dagents et Project Polaris comme futur moteur par défaut de GitHub Copilot.
Sekai a levé 20 millions de dollars en Series A après la création de 15 millions de mini-apps et plus dune heure dutilisation quotidienne.
Copilot passe des premium requests aux AI Credits et rend visible le coût en tokens du codage agentique.
La startup de codage IA Cognition lève plus d'un milliard de dollars pour une valorisation de 26 milliards, affirmant que 90 % de son code interne est généré par son agent IA Devin.
Lors du premier événement européen pour développeurs d'Anthropic, un vote à main levée a révélé que près de la moitié des participants avaient fusionné des pull requests entièrement écrites par Claude sans lire le code.
La mise à jour 3.5 de Cursor déplace la fonctionnalité Automations d'une page web indépendante vers la fenêtre Agents de l'IDE, avec prise en charge multi-dépôts et workflows au-delà du codage.
Google a lancé Antigravity 2.0 lors de l'I/O 2026, une plateforme d'agent autonome capable d'orchestrer 93 sous-agents pour construire un système d'exploitation en 12 heures.
Cursor a publié son troisième modèle de programmation maison, Composer 2.5, qui rivalise avec Opus 4.7 et GPT-5.5 sur les benchmarks publics pour un coût par tâche dix fois inférieur.
Le Gemini 3.5 Flash de Google surpasse GPT-5.5 dans les benchmarks d'agents à un prix défiant toute concurrence et devient le modèle par défaut dans l'application Gemini et la Recherche.
OpenAI added Codex controls to ChatGPT on iPhone, iPad and Android, letting users monitor and approve coding tasks away from the desktop.
Cursor’s cloud agents now support multi-repository environments, faster builds and enterprise controls for teams with microservice codebases.
Coder Agents permet aux entreprises d'exécuter des agents de codage IA dans leur propre infrastructure, avec un choix libre du modèle et sans envoyer code ni prompts hors du réseau.
Cognition AI, la société à l'origine de Devin – décrit comme "le premier ingénieur logiciel IA entièrement autonome au monde" – négocie un nouveau tour de financement avec une valorisation cible de 25 milliards de dollars, soit une multiplication par six en seulement 13 mois.
Sundar Pichai a révélé lors d'une conférence téléphonique trimestrielle que 75 % des nouveaux codes de Google sont désormais écrits par l'IA, contre 25 % il y a 18 mois, et que la migration de code est six fois plus rapide. Certains employés de DeepMind utilisent Claude Code d'Anthropic plutôt que Gemini.
DeepSeek lance V4-Pro et V4-Flash avec architecture MoE, prix de sortie à 3,48 $/million de tokens, nettement inférieur à GPT-5.5 et Claude Opus 4.7, et score Codeforces de 3206 dépassant GPT-5.4.
Une enquête JetBrains de janvier 2026 auprès de plus de 10 000 développeurs professionnels montre que 90 % utilisent déjà des outils d'IA. Claude Code est passé de 3 % à 18 % en six mois, tandis que GitHub Copilot n'a pas connu de croissance significative, stagnant à 29 %.
Anthropic a entièrement repensé l'application de bureau Claude Code et lancé la fonctionnalité Routines, permettant aux développeurs de gérer plusieurs sessions simultanées et d'automatiser des flux de travail via des événements GitHub.
Deux ans après la démocratisation des outils de codage IA, certaines équipes ont vu le nombre de commits doubler, mais la livraison des produits n'a pas accéléré et les bogues ont augmenté. Le phénomène « Tokenmaxxing » – considérer le budget de tokens IA comme un symbole de statut – est contredit par les données.
Qwen3.6-35B-A3B, un modèle MoE de 35B paramètres n'en activant que 3B, obtient 73,4 % au SWE-bench Verified, surpassant largement le Gemma 4-31B de Google. Le modèle peut fonctionner sur une RTX 4090 et un MacBook Pro M4/M5.
L'outil de codage IA Cursor négocie un tour de financement de 2 milliards de dollars avec une valorisation pré-investissement de plus de 50 milliards, mené par a16z et Thrive Capital, avec la participation de Nvidia.
L'équipe d'ingénierie d'Agoda a constaté que, bien que la productivité individuelle ait augmenté grâce à l'IA, la vitesse globale de livraison du projet n'a pas changé, le goulot d'étranglement passant de l'écriture du code à la revue et à la spécification.
Tout le monde pensait que les outils de codage IA finiraient par fusionner en un seul – c'est l'inverse qui s'est produit.
Apple envoie massivement les ingénieurs de l'équipe Siri dans un bootcamp de codage IA, axé sur l'utilisation de Claude Code, à deux mois de la WWDC et après l'échec de la livraison de plusieurs fonctionnalités Apple Intelligence.
Factory annonce un tour de table Série B de 150 millions de dollars, valorisé à 1,5 milliard de dollars, mené par Khosla Ventures. La startup développe des agents IA de codage destinés aux grandes équipes d'ingénierie avec des exigences complexes de conformité et de sécurité.
Z.ai (anciennement Zhipu AI) a publié GLM-5.1, avec 754B paramètres, architecture MoE et open source sous licence MIT. Le modèle a atteint 58,4 % sur SWE-Bench Pro, surpassant GPT-5.4 et Claude Opus 4.6, et a été entièrement entraîné sur des puces Huawei Ascend 910B et le framework MindSpore, sans aucun GPU NVIDIA.
OpenAI a déployé le modèle GPT-5.3-Codex-Spark sur les puces Cerebras WSE-3 plutôt que sur des GPU Nvidia, atteignant plus de 1000 tokens par seconde, soit environ 15 fois plus rapide que la version standard, marquant le premier déploiement en production de l'entreprise sur du matériel autre que Nvidia.
OpenAI a publié une mise à jour majeure de Codex, le transformant d'un outil de chat pour écrire du code en un agent capable d'opérer silencieusement en arrière-plan sur le bureau. La mise à jour introduit le « background computer use », permettant à Codex de contrôler d'autres applications sur macOS sans prendre tout l'écran, ainsi qu'un navigateur intégré, la génération d'images, plus de 90 nouveaux plugins et l'auto-planification.