Codex改用換視窗,不再產生摘要
openai/codex三個已合併的PR顯示,上下文視窗滿了不再產生摘要,改開全新視窗,並用歷史與筆記工具讓模型自行查回所需內容。
收錄 AI 編程 相關產品動態與產業觀察,共 119 篇文章。 第 1 / 2 頁
openai/codex三個已合併的PR顯示,上下文視窗滿了不再產生摘要,改開全新視窗,並用歷史與筆記工具讓模型自行查回所需內容。
字節跳動將豆包2.2延後推出,理由是程式撰寫、工具調用與Agent能力尚未達標,時間點恰好緊接在Seed部門大重組之後。
OpenAI 通知 SpaceX 將於 11 月 12 日終止供應 Cursor 模型,起因是 8 月 14 日的 600 億美元收購案,實際影響僅及 5% 流量。
GLM轉為付費的第一天,DeepSeek就在OpenCode每日使用量上奪回第一,41兆token的免費行銷效應迅速消退。
OpenAI正在替指令列版Codex測試「常駐模式」,讓代理人一直運作到使用者主動喊停為止,目前沒有正式上線時間表。
Anthropic公開Warp工程復盤,說明公司如何讓AI代理依據人類回饋改寫自己的技能檔案,且完全不觸碰模型權重。
Shopify執行長公開抱怨Claude Code不支援AGENTS.md揚言封殺,Anthropic在同一天回應將讓設定變得更有彈性。
OpenAI內部近全員使用Codex,付費個人用戶卻不到1%,數字背後是agent尚未跨過的門檻。
OpenAI 在 ChatGPT Work 與 Codex 上恢復 Plus 帳戶的五小時使用限制,同時一起路由問題也曝光:3% 的 Pro、Thinking 請求被悄悄降級成 GPT-5.5-mini。
使用者展示:GPT-5.6 Sol從邏輯閘設計出RV32IM處理器,成功跑起1993年《毀滅戰士》,展現AI跨層自洽設計能力。
字節跳動把TRAE與扣子併入豆包,賭辦公場景才是AI入口,代價是三個品牌收斂成一個。
OpenRouter新增匿名模型Ox Alpha,104萬token上下文與全部輸出免費開放,社群指紋比對指向智譜GLM-5.3變體,官方尚未認領。
輝達砸60億美元取得Poolside模型工廠授權,加碼10億美元投資並延攬109名員工,創辦團隊留任、公司維持獨立營運。
Anthropic公開以Claude為核心重排的六階段內部開發流程,用intent.md、spec.md、plan.md串接,並以Skills、Hooks、CLAUDE.md、evals四項治理產出物管控。
OpenAI將Codex限流原因指向訂閱轉API的共享轉售,警告此用法會持續被風控系統標記。
OpenAI以三種整合方式開源Codex執行層,Cisco與一家報稅服務商已將agent導入自家產品。
Anthropic讓Claude接手CI/CD值班,故障發生後中位數14分鐘就能生出有憑有據的分析,背後是工程師交付量暴增8倍的壓力。
智譜GLM-5.3 API上線,每百萬token輸入1.4美元、輸出4.4美元;Artificial Analysis智慧指數60分,182個模型中排第8,但輸出token數偏多。
Cursor週一上午對所有付費用戶推出程式碼代管服務Origin,三個半小時後GitHub便發生長達6小時42分鐘的全球性服務降級,兩起事件湊在一起格外引人聯想。
高通完成併購 Modular 滿一個月,就把 Mojo 編譯器以 Apache 2.0 加 LLVM 例外條款開源,但外部貢獻暫時還無法提交,要等到今年底才開放。
OpenCode Go 月費 10 美元方案中,DeepSeek Flash 月度額度由 15 美元回升至 30 美元;Pro 維持 15 美元,並開始導入尖離峰費率。
OpenAI表示如今「幾乎所有」最初的安全警報都先由AI分類,人力只處理影響重大的判斷,8月17日Greg Brockman在一篇文章中公開這套做法。
DeepSeek V4 Pro API 已指向 0813 版本,1M 上下文、384K 輸出與漲價預告同時落到價格表。
Qwen3.8-2.4T-A95B 已在 ModelScope 公開,阿里把此前的 Max 級開源承諾推進到可下載、可部署、可核驗的模型卡。
百靈開源 Ling-3.0-tiny,7.9B 總參數、每個 token 激活 1.3B 參數,瞄準本地智能體部署。
Thinking Machines 放出 Inkling-Small 全量權重,2760億總參數、120億啟用參數,在多項推理與編碼評測上貼近975B旗艦Inkling。
DeepSeek啟動V4-Flash 0731 API公開測試,加入Codex所需的Responses API,並公布Agent評測提升。
Unity 中國發布團結引擎2.0與 Codely,把遊戲 Agent 放進可審核的工程流程,而不是停在一句話生成遊戲。
Laguna S 2.1 將重點放在可自託管、可接入既有推理棧的企業級程式碼 agent,而不是直接宣稱超越閉源前沿模型。
Qwen3.8-Max-Preview 以 2.4 萬億參數、Qoder 接入和大幅 Credits 折扣先進入工作流,完整 model card 和獨立跑分仍待補齊。
Google旗艦模型Gemini 3.5 Pro據報因編碼能力調整延後,投資者已先用股價作出反應。
月之暗面發布 Kimi K3,給出 2.8 萬億參數、100 萬 token 上下文與 API 價格;開源含金量還要看權重、授權與模型卡是否補齊。
Agnes-2.5-Flash用免費編程模型切入Agent開發工具市場。本文整理已核驗事實,以及它為何不只是單一發布消息。
Grok Build被指上傳超出已開啟檔案範圍的程式庫包。本文整理已核驗事實,以及它為何不只是單一發布消息。
Claude改寫Bun引發Zig反擊。本文整理已核驗事實,以及這則消息背後的產業訊號。
Grok 4.5用低價搶編程席位。本文整理已核驗事實,以及這則消息背後的產業訊號。
六款AI編程助手栽在符號連結。本文整理已核驗事實,以及這則消息背後的產業訊號。
Meta 用 Muse Spark 1.1 打進付費 Agent API以繁體中文科技新聞語氣重寫,保留關鍵數字、產品邊界與後續觀察點。
MoonBit 押注 AI 原生程式語言以繁體中文科技新聞語氣重寫,保留關鍵數字、產品邊界與後續觀察點。
Claude Code 遭中國 NVDB 風險提示以繁體中文科技新聞語氣重寫,保留關鍵數字、產品邊界與後續觀察點。
Software factories, enterprise agents and investor-operators.
Model choice, Azure hosting and coding-model price pressure.
AI coding agents, ACP protocol support and editor strategy.
Meta 限制 AI 團隊使用 Claude Code 與 Codex。本文整理公告與報導重點、關鍵數字、企業說法,以及對市場或監管的含義。
Claude Sonnet 5 瞄準低成本 Agent。
Cursor 讓手機接管程式 Agent。
Chamath 押注 8090 Labs,1.35 億美元 A 輪後親任 CEO
Google AI 寫碼占比卡在一半,布林催動攻堅
Wix 旗下 Base44 年收 1.5 億美元,自造 Base 1 模型
Tenet Security 揭露 Agentjacking:攻擊者注入假報錯,讓編程 agent 把它當成可信修復指令,進而外洩密鑰與部署憑證。
Z.ai 開源權重 GLM-5.2 在 FrontierSWE 得 74.4 分,部分編程榜單接近 Claude Opus、壓過 GPT-5.5,同時 token 價格低很多。
未經證實的 OpenAI 線索顯示,GPT-5.6 可能主打更長上下文、更強推理與 Agent 編程。
Tenet 的 Agentjacking 研究顯示,受信任遙測資料可能變成編程助手會執行的指令。
不眠不休的編程 Agent 正考驗 GitHub 以人類使用曲線設計的基礎設施與 Azure 遷移計畫。
SpaceX 上市數日後行使期權,準備用全股票交易收購 Cursor 背後的 Anysphere。
月之暗面發布 Kimi K2.7-Code 與 HighSpeed 版,自家測試中有一項壓過 Claude Opus 4.8,但更關鍵的是輸出價格低得多。
xAI 為 Grok Build 加入 Agent Dashboard,並把入口從 300 美元 Heavy 檔下放到較便宜方案,加入多編程 agent 管理戰。
上海交通大學牽頭的新基準指出,agent 常能找到正確文件,但真正與 bug 相關的行命中率只有約 14% 到 19%。
智譜 GLM-5.2 以 744B MoE、100 萬 token 上下文與 MIT 式開源權重計畫,直接瞄準 AI 編程 agent。
Moonshot 的開源 MoE 模型用更低入輸出 token 價格,並在 agent 型編程基準上較 K2.6 明顯提升。
Cursor 的分類器讓低風險動作直接放行,只在高風險步驟暫停,降低開發者的審批疲勞。
Anthropic 的新命令會複製當前編程會話,讓開發者在不丟失原上下文的情況下測試高風險方案。
月之暗面開源 AI 編程模型 Kimi K2.7-Code.
這起事件說明,競爭已不只在模型或工具本身,而是落到資金、客戶落地與監管應對能力。
這起事件說明,競爭已不只在模型或工具本身,而是落到資金、客戶落地與監管應對能力。
Cohere 的 30B MoE 模型每次啟用約 3B 參數,支援 256K context,並以 Apache 2.0 開源。
Cursor 計畫在倫敦設立歐洲總部,年底前把區域團隊擴到約 200 人。
這家基於 Postgres 的後端平台稱,上一輪後用戶數已翻倍多,平台上多數資料庫如今由 agent 部署。
Copilot’s AI Credits make agentic sessions and frontier models usage-based, exposing developers to bills far above the old flat subscription.
職位插件、Sites 與批註功能讓 Codex 從編程助手,轉向非開發者也能用的企業工作流工具。
一項 Google Play 試點被曝向開發者收購 app 原始碼,連封存專案也在範圍內,但郵件本身避開 AI 字眼。
Build 2026 上,微軟展示 7 個從頭訓練的模型,MAI-Code-1-Flash 在其引用的程式基準上勝過 Claude Haiku 4.5。
GitHub 將 Copilot premium request 改為 AI Credits,讓長時間 agent 編程更接近實際 token 成本。
Build 2026 上,微軟把 Windows 定位成 agent 平台,並準備讓 Project Polaris 成為 GitHub Copilot 預設推理引擎。
Sekai 宣稱用戶已生成 1500 萬個迷你 App,並以此完成 2000 萬美元 A 輪融資。
Copilot 從 premium request 轉向 AI Credits,把 agent 式編程的 token 成本攤到檯面上。
AI程式設計新創Cognition完成逾10億美元融資,估值達260億美元,並宣稱內部90%程式碼已由自家AI代理Devin生成。
Anthropic在倫敦舉辦首場歐洲開發者大會,現場舉手調查顯示近半數與會者曾直接合併Claude寫的程式碼而未經審查。
Cursor 3.5 版本將 Automations 功能從獨立網頁移入 IDE 的 Agents Window,支援多倉儲協作與非程式碼工作流程。
Google 在 I/O 2026 推出 Antigravity 2.0,這款獨立代理平台可協調 93 個子代理在 12 小時內建構出作業系統。
Cursor 發布第三代自研程式設計模型 Composer 2.5,在公開基準測試中與 Opus 4.7 和 GPT-5.5 並駕齊驅,單次任務成本僅為對手的十分之一。
Google 的 Gemini 3.5 Flash 在代理型基準測試中擊敗 GPT-5.5,且價格極具競爭力,已成為 Gemini 應用程式與搜尋的預設模型。
OpenAI added Codex controls to ChatGPT on iPhone, iPad and Android, letting users monitor and approve coding tasks away from the desktop.
Cursor’s cloud agents now support multi-repository environments, faster builds and enterprise controls for teams with microservice codebases.
Coder Agents 主打自託管與模型無關,讓企業在不把程式碼和 prompt 送出內網的情況下部署 AI 編程 Agent。
打造「全球第一個全自動 AI 軟體工程師」Devin 的 Cognition AI,傳出正在以 250 億美元估值進行新一輪融資談判,13 個月內估值暴漲 6 倍。
Sundar Pichai 在季度電話會議上透露,Google 目前 75% 的新程式碼由 AI 生成、人工審閱,18 個月前這個比例為 25%。這項轉變正在重塑開發者角色,也凸顯 DeepMind 內部員工使用競爭對手工具 Claude Code 的事實。
DeepSeek 發佈 V4-Pro 與 V4-Flash,均以 MIT 協議開源。競技編程得分超越 GPT-5.4,輸出價格僅 $3.48/M,遠低於 GPT-5.5 與 Claude Opus 4.7。
JetBrains 針對全球超過一萬名專業開發者的調查顯示,90% 的開發者已使用 AI 工具,其中 Claude Code 在六個月內從 3% 躍升至 18%,而 GitHub Copilot 的增長則陷入停滯。
Anthropic 重新設計 Claude Code 桌面應用程式,加入多工作階段管理、內建開發工具,以及可透過 GitHub 事件觸發的自動化編碼功能 Routines。
AI 程式設計工具普及兩年,一種名為「Tokenmaxxing」的現象浮出水面:開發者將 AI 工具 token 預算視為身份象徵,但數據顯示程式碼變動率高達 9.4 倍,數週後僅 10-30% 的 AI 生成程式碼留存。
阿里 Qwen 團隊於 4 月 16 日開源 Qwen3.6-35B-A3B,採用 Apache 2.0 協議,無商用限制。這款總參數 35B、推理時僅激活 3B 的 MoE 模型,在 SWE-bench Verified 上取得 73.4%,領先 Google 開源的 Gemma 4-31B 達 21 個百分點。
AI 程式設計工具 Cursor 正在洽談一輪 20 億美元的融資,投前估值超過 500 億美元,半年內估值近乎翻倍。
Agoda 的工程團隊發現,AI 程式設計工具顯著提升了個人開發者效率,但專案整體交付速度並未改變,程式碼審查成為新的瓶頸。
2026 年 4 月第一週,Cursor v3、OpenAI 的 Codex 外掛,以及早期使用者開始把三個工具串起來用,顯示 AI 程式設計工具正走向專業分工而非整合為一。
蘋果正在將 Siri 團隊的工程師分批送入 AI 程式設計訓練營,專門學習如何使用 Claude Code 等 AI 工具編寫程式碼,為六月的 WWDC 做準備。
Factory剛宣佈完成1.5億美元B輪融資,估值達15億美元,由Khosla Ventures領投,摩根士丹利、安永、Palo Alto Networks已是付費客戶,打造企業級AI編程Agent平台。
Z.ai(原智譜 AI)發佈 GLM-5.1,754B 參數 MoE 開源模型,SWE-Bench Pro 得分 58.4%,超越 GPT-5.4 與 Claude Opus 4.6。該模型全程使用華為昇騰 910B 晶片與 MindSpore 框架訓練,未使用任何 NVIDIA GPU。
OpenAI 已將 GPT-5.3-Codex-Spark 模型部署在 Cerebras WSE-3 晶片上,而非 Nvidia GPU,實現每秒超過 1000 個 token 的處理速度,約為標準版本的 15 倍。這是 OpenAI 首次在 Nvidia 以外的硬體上部署正式產品級模型。
OpenAI 為 Codex 推出重大更新,加入背景電腦使用功能,讓它在 macOS 上自主操作其他應用程式,使用者可同時繼續工作。更新還包含內建瀏覽器、圖片生成、90 多個新外掛、SSH 存取及自我排程能力。