VS Code靠AI Agent把发版从月改为周
微软VS Code团队做了一件事:把坚持了十年的月度发版节奏改成了 每周发版 。 不是因为人变多了,是因为AI agent让整个团队的交付速度从根本上提高了。他们在3月份的博客里公开了具体数字——这大概是我见过最直接的AI编程效果证明之一。
关注 AI 编程工具、代码智能体、IDE、软件工程自动化和开发者工作流变化。 本页收录 116 篇已发布文章。 当前为第 2 页,每页最多 100 篇。
微软VS Code团队做了一件事:把坚持了十年的月度发版节奏改成了 每周发版 。 不是因为人变多了,是因为AI agent让整个团队的交付速度从根本上提高了。他们在3月份的博客里公开了具体数字——这大概是我见过最直接的AI编程效果证明之一。
四月初,Cursor悄悄推送了一个更新,但这次不是小版本迭代——Cursor 3.0把整个编辑器的底层逻辑改了一遍。 从产品层面看,这是Cursor有史以来变化最大的一次发布。从架构层面看,这次更新直接回答了一个问题:当AI已经能写代码,I
如果你现在还在为要不要买Claude Opus 4.6的API额度发愁,这篇文章可能会让你省一笔钱。 Anthropic在2月份发布了Claude Sonnet 4.6,价格和Sonnet 4.5完全一样——输入$3/百万tokens,输出
2月12日,Spotify联合CEO Gustav Söderström在财报电话会议上说了一句话: 我们最好的工程师,自从12月以来就没有写过一行代码了。 然后他补充:AI把公司的编码和部署速度大幅提升了,2025年全年公司发布了50多个
GitHub Copilot CLI 正式 GA(General Availability)了,面向所有付费 Copilot 用户开放。 如果你上次关注这个工具还是命令行里问问题的阶段,那现在进化得已经不太一样了。 现在的 CLI 是什么
3月30日,以色列代码验证初创公司Qodo完成了7000万美元B轮融资,总融资额达到1.2亿美元。 这笔钱是在一个很有意思的时间节点拿到的。 为什么验证成了问题 现在AI coding工具的核心问题已经不是能不能生成代码,而是生成的代码能不
3月22日,Cursor悄悄出了一个新模型 Composer 2,宣传语是frontier level coding intelligence(前沿级编程智能)。没过多久,一位叫 Fynn 的 X 用户把话说穿了:这东西基本上就是 Kimi
阿里云在4月初发了Qwen3.6 Plus,官方定位是"面向企业的Agentic AI"。放到一堆大模型发布公告里可能显得平平无奇,但仔细看技术细节和基准测试,还是有几个值得认真对待的地方。 1M上下文,专门为仓库级代码分析设计 Qwen3
"Vibe Coding"这个词在2025年底突然火了——简单说就是 用自然语言描述你想要什么,让AI来写代码 。 核心理念 不需要逐行写代码了。你描述需求,AI理解后生成代码。如果不对,用自然语言继续修正。整个过程更像是在"导演"代码而不
AI安全研究组织METR做了一个实验,结论让不少人大跌眼镜: 有经验的开发者使用AI编程工具后,完成任务的速度反而下降了19%。 实验设计 METR找了一批有经验的软件开发者,让他们在两种条件下完成相同的编程任务: 实验组 :可以自由使用A
Codex在OpenAI产品线里的定位一直在变。最早是代码补全工具,后来变成独立的编程模型(GPT 5.3 Codex),现在又并入了GPT 5.4的统一架构。 Codex CLI 值得一提的是OpenAI后来开源的 Codex CLI —
在AI编程工具普遍涨价的2026年,GitHub Copilot的 $10/月 定价显得格外亲民。但便宜归便宜,它到底能提供多少价值? 核心能力 Copilot目前提供三层能力: 第一层:代码补全 最基础也是最成熟的功能。在你写代码的过程中
OpenAI最近悄悄改了Codex的定价逻辑,幅度不大,但方向挺有意思。 以前在ChatGPT Business和Enterprise里用Codex,基本是按座位包月。现在多了一个选项: Codex专属席位按量计费 ,团队可以按实际用量付钱
2026年AI编程工具三足鼎立的格局基本定型了。三家走了完全不同的路线: 定位差异 | 工具 | 本质 | 强项 | | | | | | Claude Code | 终端agent | 复杂多文件改动、大仓库理解 | | Cursor |
Claude Code和市面上的AI编程工具走了一条完全不同的路—— 它就是个命令行程序,没有GUI,没有花哨的编辑器界面。 乍一看像是在开倒车,但用过的开发者基本都表示"回不去了"。 为什么终端反而更强? 终端意味着Claude Code
SWE bench已经成了AI编程能力的"高考分数线"——每个新模型发布必报的数字。但这个benchmark到底在考什么?刷到80%以上就意味着AI真的能当程序员了吗? 测试方式 SWE bench用的是 真实GitHub issue 。从