Codexの文脈管理、要約から新ウィンドウ方式へ
Codexがコンテキスト管理を刷新。要約生成をやめ、新しいウィンドウと履歴・ノートツールで必要な情報を検索する方式に切り替える。マージ済み3件のPRから判明した。
AIコーディングに関する製品動向と業界分析を全119件掲載しています。 1 / 2ページ
Codexがコンテキスト管理を刷新。要約生成をやめ、新しいウィンドウと履歴・ノートツールで必要な情報を検索する方式に切り替える。マージ済み3件のPRから判明した。
字節跳動が豆包2.2の8月投入を延期。コーディングやツール呼び出し、エージェント能力の底上げが狙いで、Seed部門の大規模再編とほぼ同時期の決定となった。
OpenAIがSpaceXに通知、Cursorへのモデル提供を2026年11月12日で打ち切る方針。600億ドル買収後の対応だが、影響は利用の5%にとどまる。
GLMが有料化した初日、DeepSeekがOpenCodeの日次利用トップを奪還した。41兆トークンを集めた無料キャンペーンの反動が表れた形だ。
OpenAIはコマンドライン版Codexに、ユーザーが止めるまで働き続ける「常駐モード」を試験導入中で、提供時期は未定だ。
Anthropicが公開したWarpの事例は、人間のフィードバックをもとにエージェントが自分のスキルファイルを書き換え、モデルの重みには一切手を加えない仕組みを解説する。
Shopify CEOがClaude CodeのAGENTS.md非対応に抗議し排除を示唆。Anthropicは即日、設定の柔軟化を約束する異例の速さで反応した。
OpenAI社内は98%がCodexを使う一方、個人課金ユーザーの利用は1%未満。エージェントが直面する壁を数字で読み解く。
OpenAIがChatGPT WorkとCodexでPlusアカウントの5時間利用制限を復活させる。同時期、ルーティングの不具合でProとThinkingの応答の3%がGPT-5.5-miniにこっそり降格していたことも発覚した。
GPT-5.6 SolがNANDゲートの段階から設計したRV32IM CPU「Codex-R32」上で1993年の『DOOM』が起動。複数の抽象レイヤーをまたぐ一貫性を示した挑戦的なデモだ。
バイトダンスがTRAEとCozeを豆包に統合、オフィスをAIの単一入口にする狙いと代償を解説する。
OpenRouterに正体不明の「Ox Alpha」が登場。104万トークンのコンテキストを無料で提供し、指紋調査は智譜(Zhipu)のGLM系列を示唆している。
NVIDIAがPoolsideの訓練システムを60億ドルでライセンス、109人採用へ。買収ではなく独立運営を維持。
Anthropicが社内の開発プロセスをClaude中心の六段階に再構築し、intent.md・spec.md・plan.mdの連鎖とSkills・Hooks・CLAUDE.md・evalsで統制する手引きを公開した。
OpenAIがCodexの利用制限強化の原因をサブスク転売サービスsub2apiの利用に求め、今後も検知対象になると警告した。
OpenAIがCodexの実行層を3段階の統合方式でオープンソース化。Ciscoや税務申告企業がすでにエージェントを製品に組み込んでいる。
AnthropicがCI/CDのオンコール対応をClaudeに任せた。障害発生から証拠付き分析まで中央値14分、背景にはコード生産量8倍増という圧力があった。
智譜がGLM-5.3のAPIを公開。入力1.4ドル・出力4.4ドル/百万tokenで、Artificial Analysisのスコアは60点、182モデル中8位だが出力トークン数は多め。
Cursorが全有料ユーザーにコードホスティング機能Originを公開した直後、GitHubで6時間42分に及ぶ世界的な障害が発生した経緯と背景を解説する。
クアルコムがModular買収から1カ月でMojoコンパイラをApache 2.0とLLVM例外でオープンソース化。ただし外部からのコード貢献はまだ受け付けていない。
OpenCode Goの月額10ドルプランで、DeepSeek Flashの月間利用枠が15ドル相当から30ドル相当に引き上げられた。Proは15ドル据え置きでピーク料金制を導入する。
OpenAIは最初のセキュリティアラートの「ほぼすべて」をAIが選別し、影響の大きい判断のみ人間が担う体制を公表。8月17日の記事でブロックマン氏が明らかにした。
DeepSeek V4 Pro APIが0813版に切り替わり、1Mコンテキスト、384K出力、料金引き上げ予告が同じ価格表に並んだ。
Qwen3.8-2.4T-A95BがModelScopeで公開され、AlibabaのMax級モデルがAPIだけでなく検証可能な重みとして扱える段階に入った。
InclusionAIがLing-3.0-tinyを公開した。総7.9Bパラメータ、tokenごとに1.3Bを活性化するMoEモデルで、ローカルエージェント用途を狙う。
Thinking Machines が Inkling-Small のオープンウェイトを公開。276B総パラメータ、12B有効パラメータで、推論・コーディングの一部指標は旗艦Inklingに迫った。
DeepSeekはV4-Flash 0731のAPIベータを開始し、Codex向けResponses API対応とエージェント評価の大幅向上を発表した。
Unity中国は団結エンジン2.0とCodelyを発表し、ゲームAgentを一文生成ではなく監査可能な制作ワークフローに置いた。
Laguna S 2.1は、企業がコードとログを自社環境に置いたまま使えるセルフホスト型コードエージェント基盤として位置づけられている。
Qwen3.8-Max-Previewは2.4兆パラメータ、Qoder連携、大幅なCredit割引を掲げ、詳細なモデルカードより先に実運用へ出た。
GoogleのGemini 3.5 Proは、コーディング性能の改善を理由に公開が遅れていると報じられた。
Moonshot AIのKimi K3は2.8兆パラメータ、100万トークンのコンテキスト、公開API価格を掲げたが、オープンモデルとしての評価は重みとモデルカードの公開にかかっている。
Agnes-2.5-Flashは無料のコーディングモデルでAgent型開発ツール市場に圧力をかける。この記事は確認済みの事実と、単発の発表を超えた意味を整理する。
Grok Buildは開いたファイルを超えてリポジトリバンドルを送信した疑いが出た。この記事は確認済みの事実と、単発の発表を超えた意味を整理する。
ClaudeによるBunのRust移行にZig側が反発。確認済みの事実と、その背後にある産業上の意味を簡潔に整理する。
Grok 4.5、低価格でコーディング席を狙う。確認済みの事実と、その背後にある産業上の意味を簡潔に整理する。
GhostApproval、AIコーディングツールのシンボリックリンクリスクを露呈。確認済みの事実と、その背後にある産業上の意味を簡潔に整理する。
Meta、Muse Spark 1.1をAgent向けAPIに投入を、日本のテクノロジー読者向けに要点、数字、検証すべき論点を保った形で整理した記事です。
MoonBit、AI時代のプログラミング言語に賭けるを、日本のテクノロジー読者向けに要点、数字、検証すべき論点を保った形で整理した記事です。
Claude Code、中国NVDBのリスク警告を受けるを、日本のテクノロジー読者向けに要点、数字、検証すべき論点を保った形で整理した記事です。
Software factories, enterprise agents and investor-operators.
Model choice, Azure hosting and coding-model price pressure.
AI coding agents, ACP protocol support and editor strategy.
Meta、AI部門でClaude CodeとCodex利用を制限。発表や報道の要点、主要な数字、企業側の説明、市場への意味を自然なニュース文体で整理した。
Claude Sonnet 5、低コストAgentを狙う。
Cursor、スマホでコーディングAgentを操作。
Chamath、8090 Labsの1.35億ドル調達でCEOに復帰
Google、AI生成コード比率の伸び悩みで開発攻勢
Wix傘下Base44、ARR1.5億ドルで自社モデルBase 1投入
Tenet Securityは、攻撃者が偽のエラーレポートを注入し、コーディングエージェントが信頼済み修復指示として扱うAgentjackingを説明した。
Z.aiのオープンウェイトGLM-5.2はFrontierSWEで74.4を記録し、一部のコーディング評価でClaude Opusに近くGPT-5.5を上回り、価格は低い。
OpenAIの未確認情報は、GPT-5.6が長文脈、より強い推論、エージェント型コーディングに寄る可能性を示す。
TenetのAgentjacking研究は、信頼されたログがコーディング支援AIへの実行命令に変わる危険を示した。
常時稼働するコーディングAgentの負荷が、GitHubの人間時代の設計とAzure移行計画を試している。
上場直後のSpaceXが、Cursorを運営するAnysphereを全株式取引で買収するオプションを行使した。
Moonshot AI は Kimi K2.7-Code と HighSpeed 版を公開した。自社ベンチでは一部で Claude Opus 4.8 を上回るが、より大きな売りは低い出力単価だ。
xAI は Grok Build に Agent Dashboard を追加し、300ドルの Heavy 専用から安いプランにも開放した。複数エージェント管理競争への参入だ。
上海交通大学などの基準は、エージェントが正しいファイルを見つけても、バグに関係する行の命中率は14〜19%にとどまると示した。
ZhipuのGLM-5.2は744BパラメータのMoE設計、100万トークン文脈、MIT系ライセンスでの重み公開予定を組み合わせ、コーディングエージェントを狙う。
MoonshotのオープンMoEモデルは入出力tokenを大幅に安くし、K2.6よりエージェント型コーディング指標を伸ばした。
Cursorの分類器は低リスク操作を通し、重要な操作だけ止めることで、開発者の承認疲れを減らす。
Anthropicの新コマンドは進行中のコーディングセッションを複製し、元の文脈を失わずにリスクのある案を試せるようにする。
Moonshot、AIコーディング向けKimi K2.7-Codeを公開.
この動きは、モデルやツール単体ではなく、資金、顧客導入、規制対応が競争力を左右する段階に入ったことを示す。
この動きは、モデルやツール単体ではなく、資金、顧客導入、規制対応が競争力を左右する段階に入ったことを示す。
Cohereの30B MoEモデルは約3Bパラメータを有効化し、256Kコンテキストに対応、Apache 2.0で公開された。
Cursorは欧州本部をロンドンに置き、年末までに地域チームを約200人へ拡大する計画だ。
Postgres ベースのバックエンド基盤は、前回ラウンド以降ユーザーが倍増し、現在はエージェントが大半のデータベースを作成しているという。
Copilot’s AI Credits make agentic sessions and frontier models usage-based, exposing developers to bills far above the old flat subscription.
職種別プラグイン、Sites、Annotationsにより、Codexはプログラマー専用から非開発者向けワークフロー基盤へ広がる。
Google Play 開発者向けの試験施策が、公開されていないソースコードや休眠プロジェクトの提供に報酬を出す内容だと報じられた。
Build 2026 で Microsoft は自社訓練の 7 モデルを披露し、MAI-Code-1-Flash が比較ベンチで Claude Haiku 4.5 を上回ったとした。
GitHubはCopilotのpremium requestをAI Creditsに置き換え、長時間のエージェント利用を実際の推論コストに近づける。
Build 2026でMicrosoftはWindowsをagent基盤として打ち出し、Project PolarisをGitHub Copilotの標準推論エンジンにすると示した。
Sekaiはユーザーが1500万個のミニアプリを作った実績を示し、2000万ドルのSeries Aを調達した。
Copilotはpremium requestからAI Creditsへ移り、agent型コーディングのtokenコストを表に出した。
AIコーディングスタートアップCognitionが10億ドル超を調達し、評価額260億ドルに。自社コードの90%をAIエージェントDevinが生成していると主張。
Anthropicがロンドンで開催した初の欧州開発者イベントで、参加者の半数近くがClaudeが書いたプルリクエストをコードを読まずにマージしたことが明らかになった。
Cursorの3.5アップデートにより、Automations機能が独立したWebページからIDE内のAgents Windowに統合され、マルチリポジトリ対応やコード以外のワークフローも可能に。
GoogleはI/O 2026で、93のサブエージェントを統括して12時間でオペレーティングシステムを構築できるスタンドアロンのエージェントプラットフォーム「Antigravity 2.0」を発表した。
Cursorが第3世代の自社プログラミングモデルComposer 2.5をリリース。Opus 4.7やGPT-5.5と同等のベンチマーク性能を、タスクあたり10分の1のコストで実現。
GoogleのGemini 3.5 Flashがエージェント系ベンチマークでGPT-5.5を上回り、圧倒的な低価格でGeminiアプリとSearchのデフォルトモデルに。
OpenAIはiPhone、iPad、AndroidのChatGPTからCodex作業を監視・承認できるようにした。
Cursor’s cloud agents now support multi-repository environments, faster builds and enterprise controls for teams with microservice codebases.
Coder Agentsは、コードやプロンプトを社外に出さずにAIコーディングAgentを動かしたい企業向けの、自社ホスト型でモデル非依存の選択肢だ。
AIソフトウェアエンジニア「Devin」を開発するCognition AIが、250億ドルの評価額で資金調達を協議中と報じられた。13ヶ月で評価額は6倍に急成長している。
Sundar Pichai氏は四半期決算電話会議で、Googleの新規コードの75%がAIによって生成され、人間がレビューしていると明らかにした。18カ月前は25%だった。この変化は開発者の役割を再定義し、DeepMind内での競合ツールClaude Codeの使用も浮き彫りにしている。
DeepSeekがV4-ProとV4-FlashをMITライセンスで公開。競技プログラミングで最高スコアを達成し、出力価格は$3.48/MとGPT-5.5やClaude Opus 4.7の数分の一。
JetBrainsが1万人以上のプロ開発者を対象に実施した調査で、AIツールを利用する開発者が90%に達し、Claude Codeが6ヶ月で3%から18%に急成長する一方、GitHub Copilotの成長は停滞していることが明らかになった。
Anthropic が Claude Code デスクトップアプリを刷新。マルチセッション管理、内蔵開発ツール、イベント駆動型の自動コーディング機能 Routines を発表。
AIコーディングツールが普及して2年、「Tokenmaxxing」と呼ばれる現象が浮上している。開発者がAIトークン予算をステータスシンボルとして扱い、コードのチャーンは最大9.4倍に増加。数週間後にはAI生成コードの10~30%しか残らないというデータもある。
AlibabaのQwenチームは、Apache 2.0ライセンスでQwen3.6-35B-A3Bを公開。総パラメータ35B、推論時は3Bのみ活性化するMoEモデルで、SWE-bench Verifiedで73.4%を記録し、GoogleのGemma 4-31Bを21ポイント上回った。
AIコーディングツールCursorが、20億ドルの資金調達ラウンドを協議中。評価額は500億ドル超で、半年でほぼ倍増となる。
Agodaのエンジニアチームは、AIコーディングツールが個人の生産性を大幅に向上させた一方で、プロジェクト全体のデリバリー速度は変わらず、コードレビューが新たなボトルネックになっていることを発見した。
2026年4月第1週、Cursor v3、OpenAIのCodexプラグイン、そして3つのツールを連鎖させる初期ユーザーの出現により、AIコーディングツールは統合ではなく専門化の道を歩み始めている。
AppleはSiriチームのエンジニアを、Claude CodeなどのAIツールを使ったコーディングを学ぶブートキャンプに送り込んでいる。6月のWWDCに向けてSiriの大幅な改良を急いでいる。
FactoryはKhosla Ventures主導のシリーズBで1.5億ドルを調達し、評価額は15億ドルに。モルガン・スタンレー、EY、Palo Alto Networksが既に顧客として利用するエンタープライズ向けAIコーディングエージェントプラットフォーム。
Z.ai(旧智譜AI)が754BパラメータのオープンソースMoEモデルGLM-5.1をリリース。SWE-Bench Proで58.4%を記録し、GPT-5.4とClaude Opus 4.6を上回った。学習は華為昇騰910BチップとMindSporeフレームワークのみを使用し、NVIDIA GPUは一切使われていない。
OpenAIはGPT-5.3-Codex-SparkモデルをNvidia GPUではなくCerebras WSE-3チップ上にデプロイし、毎秒1,000トークン以上を達成。標準版の約15倍の速度で、OpenAI初のNvidia以外のハードウェアでの本番稼働となる。
OpenAIはCodexに大規模アップデートを実施し、バックグラウンドでmacOS上の他のアプリケーションを自律操作できる「background computer use」機能を追加。内蔵ブラウザ、画像生成、90以上の新プラグイン、SSHアクセス、自己スケジューリング機能も搭載した。