GLM收费首日DeepSeek夺回OpenCode榜首
编辑精选 41 万亿 token 堆在一个不收钱的模型上,收钱第一天就退潮。OpenCode 这张榜量的是开发者花掉的预算,免费闸门一关,几条曲线立刻各归各位。 GLM 5.3 Flash 结束免费供应、转入付费的第一天,DeepSeek
关注 AI 编程工具、代码智能体、IDE、软件工程自动化和开发者工作流变化。 本页收录 116 篇已发布文章。 第 1 / 2 页,每页最多 100 篇。
编辑精选 41 万亿 token 堆在一个不收钱的模型上,收钱第一天就退潮。OpenCode 这张榜量的是开发者花掉的预算,免费闸门一关,几条曲线立刻各归各位。 GLM 5.3 Flash 结束免费供应、转入付费的第一天,DeepSeek
编辑精选 这段代码是在 Codex 的开源命令行仓库里被翻出来的,OpenAI 承认在测,同时说没有上线时间表。一个会自己给自己派活、跨会话记着你的代理,权限边界该怎么划,比它能连续跑多久更难回答。 WIRED 记者 Maxwell Zef
编辑精选 这套做法的巧劲落在文件系统上:技能存成文件,改写代理提的每一次修改都走代码评审,团队能在 diff 里看见智能体给自己加了什么规则。自我改进第一次有了可回滚的形态。 Anthropic 8 月 26 日放出一篇 Warp 的工程复
编辑精选 一个挂了一年、攒到近五千个赞的 GitHub 请求没等来回应,一条 CEO 的公开抱怨半天内换来了官方表态。AI 编程工具的配置文件之争,表面是读哪个文件,底下是谁来定标准。 Shopify CEO Tobi Lütke 在 8
编辑精选 OpenAI 内部六月有 98% 的人用过 Codex,同期掏钱的个人订阅用户里碰过 agent 类工具的不到 1%。横在中间的东西相当具体:权限怎么授、入口藏在哪、token 账单谁来付。 TechCrunch 走访 OpenA
编辑精选 周额度还在,五小时窗口回来了。这是算力吃紧时最省事的一档旋钮——不改总量,只改用完的速度,代价由每月付 20 美元的那一层承担。 OpenAI 工程主管 Thibault Sottiaux 在 8 月 24 日晚(太平洋时间)宣布
编辑精选 模型从与非门这一级搭出一颗 RV32IM 处理器,还给自己起名 Codex R32,1993 年的《毁灭战士》在上面跑了起来。演示跑在一款解谜游戏的沙盒里,离流片很远,但门级设计能自洽到启动一个完整游戏,本身已是一道不低的门槛。
编辑精选 编程工具和智能体搭建平台各自撑不起一个独立入口,字节把两条产品线折进豆包,赌的是办公场景才是那个入口。代价是三个品牌收缩成一个。 字节跳动完成了一轮 AI 生产力产品的团队整合。TRAE 和扣子(Coze)整体并入豆包体系,其中
编辑精选 OpenRouter 上这个不署名的模型开放了 104 万 token 的上下文窗口,价格栏两个零,一次报错泄出的接口路径把嫌疑指向智谱。免费预览换回来的是编程 agent 跑出的完整长程轨迹,这类数据公开语料里几乎没有。 8 月
编辑精选 60 亿美元买走的是一套造模型的流水线,外加 109 个会开这条线的人,Poolside 三位创始人一个没走。英伟达用授权加投资替掉了收购动作,既避开审查口径,也给自家 Nemotron 补上了产能。 英伟达将向 AI 编程公司
编辑精选 六个阶段、一条 markdown 文件链、五层控制件,Anthropic 把自家开发流程的骨架摊在了公开文档里。看完最直观的感受是,这份手册的读者不是个人开发者,是要向审计交代的工程组织。 Anthropic 放出一份题为 AI
编辑精选 OpenAI 把这一轮限流的原因归到订阅转 API 的分发行为上,等于承认风控系统一直按流量形态识别账号;对国内规模不小的拼车生态来说,官方口径第一次从默许滑向明说不支持。 一批 Codex 用户最近发现自己的额度掉得异常快,Op
编辑精选 三档接入里 app server 最能说明 OpenAI 的算盘:把模型外面那层执行系统整个摊开做成通用接口,计费口子仍然留在模型侧。Cisco 和一家报税服务商已经照这个路子把 agent 塞进了自家产品。 8 月 19 日,O
编辑精选 Anthropic 让 Claude 顶一线值班,起因写得相当实在:工程师人均季度交付代码涨到 8 倍,半夜手工排查故障的老流程跟不上了。中位 14 分钟出一份带证据的分析,是这套压力下的产物。 Anthropic 把内部 CI/
编辑精选 GLM 5.3 在 Artificial Analysis 智能指数拿到 60 分、182 个模型里排第 8,API 定价 1.4/4.4 美元;分数已经贴近开放权重第一梯队,但每个任务吞掉 4.1 万输出 token,账单未必比
编辑精选 Origin 的定位写得很克制:GitHub 仍是唯一可信副本,推送照旧进 GitHub,Cursor 只做托管层和协作枢纽。但产品架子已经把仓库、PR、评审、合并、CI 全接了进来,剩下的只是哪天把同步开关关掉。 8 月 17
编辑精选 编译器和工具链的代码全部进了 modular/modular 主仓库,许可证是 Apache 2.0 叠加 LLVM 例外,连二进制分发的口子一起放开。做这个决定的是刚完成收购的高通,而三年前许下开源承诺的那家创业公司已经并入其中
编辑精选 订阅套餐的难处在于额度变化后,用户很难判断一段任务会在哪个费率区间被计入。 OpenCode Go 调整了模型额度:公开信息显示,月费 10 美元 的套餐中,DeepSeek Flash 的月度额度从此前的 15 美元 回升至 3
OpenAI 把一部分安全团队的“第一眼”交给了模型:新告警先由 AI 分诊,人再处理高影响决策。8 月 17 日,Greg Brockman 在一篇安全文章中把这套安排摆到台前,也给出了一个更具体的主张:安全团队不该只用 AI 多找漏洞,
编辑精选 DeepSeek V4 Pro 这次没有开发布会,信号藏在 API 文档里:版本号转到 0813,输出上限抬到 384K,价格页同时挂出涨价预告。对重度开发者来说,这比一张跑分海报更需要立刻算账。 DeepSeek V4 Pro
编辑精选 Qwen3.8 的新变化不在参数更大,而在阿里第一次把 Max 级模型权重放到开发者面前。此前写在预告里的“开源承诺”,现在变成了可下载、可部署、可核验的模型卡。 Qwen3.8 Max 终于从“下周开放”的承诺,走到了模型仓库页
编辑精选 Ling 3.0 tiny 的看点不只是 7.9B 总参数。每个 token 只激活 1.3B 参数、同时给出 BF16/FP8/INT4 权重和 SGLang/vLLM 部署路径,说明国产开源模型正在把智能体能力往本地设备压。
编辑精选 Thinking Machines 把 Inkling Small 全量权重放出后,最醒目的信号落在成本曲线上:12B 激活参数已经能贴近 41B 激活旗舰的多个能力项。 Mira Murati 的 Thinking Machin
编辑精选 DeepSeek 用同一套 284B/13B 模型结构,把 Terminal Bench 2.1 自报成绩从 61.8 拉到 82.7;涨幅来自后训练与尚未公开的极简 harness,复现仍要等工具放出。 DeepSeek 7 月
编辑精选 Unity 中国把团结引擎 2.0 做成游戏 Agent 底座,考验点从代码生成转向可审核、可追踪的生产流程。 “一句话生成游戏”的想象,在游戏引擎公司这里被按了一次暂停键。 7 月 28 日,Unity 中国在上海发布团结引擎
Poolside 这次没有端出一个万亿参数的庞然大物。它把 Laguna S 2.1 做成 118B 总参数、8B 激活参数 的 MoE 代码模型,权重直接放上 Hugging Face,还说能在单台 NVIDIA DGX Spark 上跑
阿里把 Qwen3.8 Max Preview 推上 Qoder 和 Token Plan 时,最抢眼的数字并非跑分榜名次。它先把两个数字摆到开发者面前: 2.4 万亿参数 ,以及低至 0.01 倍 Credits 消耗 。 这组搭配很有意
Google I/O 舞台上,Sundar Pichai 给开发者留了一个很短的等待期:Gemini 3.5 Pro 下个月见。两个月过去,最强 Pro 版还没放出来,Bloomberg 的新说法把原因指向编码能力。 这条新闻的张力不在“又
Kimi 这次把牌摊得很大:2.8 万亿参数、100 万 token 上下文、原生视觉理解,还把价格直接挂在开放平台首页。7 月 16 日发布的 Kimi K3,先把月之暗面重新推回国产开源模型的中央位置。 这条新闻的张力不在“又发了一个大
AI 编程工具的门槛刚被抬高,另一个玩家立刻把价格牌翻到零。 7 月 14 日晚,Agnes AI 发布 Agnes 2.5 Flash,并同步推出 Agnes Code 桌面端。它给出的承诺很直接:Flash 面向日常编码和 agent
一个终端里的 AI 编程工具,风险通常藏在它能读多少文件。Grok Build 这次被盯上的点更直接:研究者在网络流量里复原出完整 Git bundle,里面包含工具被明确要求不要打开的文件和提交历史。 这场争议没有落在“模型会不会拿代码训
Bun 用 Claude 把一套大型 JavaScript 运行时从 Zig 迁到 Rust,刚被包装成 AI 编程的标杆案例,Zig 创始人 Andrew Kelley 就把桌子掀了。 这场争议有个很具体的画面:一边是 11 天、6778
Grok 4.5没有把发布会开成一场“全能模型”表演。SpaceXAI给它选的入口很窄:写代码、跑智能体任务、处理知识工作。放在GPT 5.6、Claude Fable 5和Opus 4.8同一周的竞争里,这个选择反而让它更容易被企业团队算
开发者点下“同意修改”时,屏幕上看到的是一个项目配置文件。实际被改掉的,可能是自己电脑上的 SSH 登录文件。 Wiz 7 月 8 日公开的 GhostApproval,把 AI 编程工具的一个尴尬边界摊开了:这不是模型胡说,也不是提示词注
扎克伯格隔了三年重新在 X 上发帖,没有晒社交产品,先给 Meta 的新模型打广告。 这件事放在以前有点反常。Meta 在大模型圈最响的标签一直是 Llama 和开源权重,开发者拿模型回去自己跑、自己改,Meta 靠生态声量和产品流量回血。
AI 写代码已经不稀奇了,真正卡人的问题变成: 模型写出来的代码,能不能被机器快速检查、修正、分发到真实环境里 。这也是 MoonBit 最近被重新放到聚光灯下的原因。 这门来自中国团队的新语言,过去常被当作“又一个小众编程语言”看待。但
Claude Code 这次被点名,不是因为它“会写代码”,而是因为它离企业代码库太近。 7 月 8 日,工业和信息化部网络安全威胁和漏洞信息共享平台(NVDB)发布风险提示,称 Anthropic 旗下 AI 编程工具 Claude Co
Chamath Palihapitiya 是硅谷有名的投资人,早年在 Facebook,后来自己开了 Social Capital,这些年更多以「下注的人」身份出现。这回他换了个位置:亲自出任 AI 创业公司 8090 Labs 的 CEO
7 月 1 日起,GitHub Copilot 的模型列表里多了个新名字:Kimi K2.7 Code。这是月之暗面(Moonshot AI)的开源模型,也是 Copilot 上线以来接进来的头一个开源权重模型。在这之前,能在这个框里选的,
7 月 1 日这天,Cognition 把 Windsurf 里那个用了两年多的 AI 助手 Cascade 正式关了。没有过渡期,也不给你留旧版,官方文档写得很硬:不能选择退出,也没有延长支持窗口。 这事得从一个月前说起。6 月 2 日,
Meta 给应用 AI 部门的一批工程师立了新规矩:想用 Anthropic 的 Claude Code 或者 OpenAI 的 Codex 写代码,得先报批;有几个组收到的备忘录更直接,让他们停掉所有用到这两个外部工具的任务。The In
先说结论:天天让 AI 替你跑 Agent 的那批人,可以把顶配 Opus 从默认档位上撤下来了。 6 月 30 日,Anthropic 放出了中杯新模型 Claude Sonnet 5。官方给它的定位很直白——会自己定计划、会调浏览器和终
"我现在大部分代码,是在手机上写的。" 说这话的是 Anthropic 的 Boris Cherny。他自己都补了一句:半年前你要跟我说这话,我会觉得你疯了——可现在,就是这样。 这句话听着像段子,但它正好踩在 6 月 29 日的一条新闻上
Chamath Palihapitiya 上一次有正经全职工作,还是在 Facebook。 那是 2011 年的事了。之后这十几年,他干的是投资人、SPAC 操盘手、播客主持,外加硅谷头号嘴炮。手里过的钱不少,亲自带队做一家公司这种活,他一
一边是 Anthropic 自曝八成以上代码出自 Claude 之手,一边是 Google 自家这个数才到一半。 这个差距,把谢尔盖·布林急出了一封全员信。 布林亲自下场催 布林这两年已经不是甩手掌柜,重新回 Google 一线动手了。这次
vibe coding——用大白话指挥 AI 把网站、App 直接写出来——这一年火得没边。但这门生意一直有个软肋:平台底下跑的,全是别人家的模型。Claude、GPT 给你撑着,你赚的是中间那道差价。 现在有人不想再当二传手了。 6 月
黑客现在懒得攻你的服务器了。 他只要往你公司的报错系统里塞一条假的 bug 报告,你的 AI 编程助手——Claude Code、Cursor、Codex 随便哪个——就会自己照着上面的“修复建议”跑代码。然后 AWS 密钥、GitHub
先扔个数字。 跑长周期编程任务的 FrontierSWE 榜单上,智谱(现在改叫 Z.ai)的开源模型 GLM 5.2 拿了 74.4 分 。同台的 GPT 5.5 是 73 分上下,Claude Opus 4.8 是 75 分多一点。 换
ChatGPT Pro 的用户这几天有点上头。 有人发现,自己问 ChatGPT 同一个问题,回答的口吻和质量跟平时的 GPT 5.5 不太一样——更慢,但明显更「懂」。社交媒体上开始冒出一批前后对比图:同一个 3D 渲染需求、同一段 SV
先说结论:你那个天天帮你修 bug 的 AI 编程助手,现在可能正帮黑客在你电脑上跑代码。 而且整条链路,没有一个环节是「非法」的。 一条假报错,就能让 Claude Code 听黑客的话 干这件事的是一家叫 Tenet 的安全公司,旗下研
6 月 16 日,微软承认了一件挺没面子的事:GitHub 快扛不住了,得把一部分流量甩给亚马逊的 AWS。 是的,就是那个跟自家 Azure 抢了十几年生意的对头。 把全世界程序员的代码都托管在自家平台上的微软,现在得花钱去租对手的机房,
敲钟才四天,马斯克就掏出了 600 亿美元。 上周五(6 月 12 日)SpaceX 在纳斯达克上市,开盘 161 美元、比 135 的发行价跳了 19%。这周二,公司一纸监管文件递上去:用全股票方式,把 AI 编程工具 Cursor 背后
一个开源模型,在某个跑分上把 Claude Opus 4.8 摁了下去。 这事本身不算稀奇。稀奇的是——卷子是它自己出的,分也是它自己打的。 发生了什么 6 月 12 日,月之暗面(Moonshot AI)放出了 Kimi K2.7 Cod
同时开五个 AI 编程 agent 干活,听起来很爽。 真用过的人都知道,爽不过十分钟。一个在改后端,一个在跑测试,一个卡住了等你拍板——你得在五个终端窗口之间来回切,切着切着就忘了哪个干到哪儿了。多开几个 agent 省下的时间,全砸在切
你让 Claude Code 去修个 bug,它八成能找对是哪个文件出的毛病。可真正要动的那几行,它经常看漏。 这不是拍脑袋。6 月 14 日,上海交通大学牵头的一个国际团队甩出一个新基准,专门测 AI 编程 agent 的"找代码"这一步
6 月 12 号晚上,白宫一纸命令,Anthropic 把最强的 Claude Fable 5 和 Mythos 5 对所有外国人关停。隔了不到 24 小时,智谱 Z.ai 那边上线了 GLM 5.2——而且把话挑明了:下周连权重一起开源,
先看一组价格。 同样跑一百万个输出 token,GPT 5.5 收你 30 美元,Claude Opus 4.8 收 25 美元,Anthropic 那个更强的 Fable 5 直接 50 美元。月之暗面这周扔出来的 Kimi K2.7 C
AI 编程 agent 用久了,都撞过同一个烦人的地方:你让它干活,它干两下就停下来问"这个能不能执行?"——一天下来光点"同意"就点麻了。 Cursor 想治这个病。6 月 11 日它上线了一个叫 Auto review 的东西,专管 a
用 AI 写代码最怕什么? 不是它写得慢。是你让它干一件大活,它埋头改了半天,把原来好好的东西也一并改坏了——回头想退,退不回去。 Claude Code 这周加的 /fork ,就是冲着这个来的。 一行命令,把 AI 的"记忆"分叉一份
又一个 1 万亿参数的开源模型,六月十二号悄悄挂上了 Hugging Face。 这次是月之暗面,模型叫 Kimi K2.7 Code。一句话概括:专门干编程的开源大模型,免费下载,Modified MIT 协议——商用基本没门槛。 但比"
500 万人,每周打开 Codex 写代码。 这个数字年初还只有 100 万出头。半年时间涨了 4 倍——OpenAI 自己说的,原话是 "up 400 percent since the beginning of the year"。 涨
6 月 8 号 OpenAI 刚把上市申请递进 SEC,三天后它出手的第一件大事不是发新模型——是买了一家做云端开发环境的公司。 对象叫 Ona,前身就是程序员圈子里用了多年的 Gitpod。交易金额没公开,还得过监管这一关。 听上去是笔不
Cohere 这两年一直在企业和"主权 AI"那条线上闷头跑:模型卖给政府和大客户,部署在人家自己机房,数据不出门。前阵子它把 218B 的旗舰 Command A+ 用 Apache 2.0 开源,押的也是这套叙事。 6 月 9 日,它把
"在美国遥控欧洲生意,根本行不通。" Cursor 管欧洲市场的高级副总裁 Ismail Elmas 把话撂得很直。6 月 9 号,这家被 SpaceX 用 600 亿美元期权盯着的 AI 编程公司宣布,欧洲总部落在伦敦。 从七八十人,干到
AI 写代码这波热闹里,最闷声发财的可能不是那些写代码的工具,而是它们背后默默存数据的地方。 Supabase 这周把这事摆到了台面上:周四宣布拿下 5 亿美金 F 轮,估值一把推到 105 亿美金 。领投的是新加坡主权基金 GIC,跟投名
6 月 1 日,GitHub 把 Copilot 的计费表打开了。第二天,开发者社区炸成一片。 变化的核心是:Copilot 从"一口价订阅"改成了 按 token 计费 ,名字叫 AI Credits,1 个 credit 等于 1 美分
Codex 现在每周有 500 万人用。但增长最快的那一拨,根本不写代码。 OpenAI 6 月 3 日给 Codex 来了一次大更新,方向很明确:把这个原本服务程序员的编程工具,改造成全公司都能用的"干活工具"。 三样新东西 6 个按岗位
谷歌最近在给一批 Google Play 的开发者发邮件,内容很直接:把你 App 背后的代码卖给我,给钱。 这事是 404 Media 6 月 2 日捅出来的。爆料的开发者要求匿名,怕谷歌因为他泄露了这个"机密"项目找他麻烦。 邮件里到底
50 亿参数的小模型,把 Anthropic 的 Claude Haiku 在编程基准上甩开了 16 分。 6 月 2 日 Build 2026 大会上,微软真正的硬货不是又一个 agent 平台,是苏莱曼那支"超级智能团队"一口气端出来的
以前你花 10 美元包月买 Copilot,问一句话和让它跑一整夜写代码,花的是同一笔钱。从 6 月 1 日起,这种好事没了。 昨天,GitHub 把 Copilot 的所有套餐切到了"按用量付费"——以后用多少,按你烧掉的 token 实
今天上午,旧金山 Fort Mason,微软 Build 2026 开场。 Nadella 第一句话就把基调定了:Windows 不再只是给人用的系统了。他的原话是—— "Agents are now first class citizen
过去一年,"vibe coding"——用一句话让 AI 帮你写软件——基本都在程序员圈里打转。Cursor、Claude Code、Replit,工具再火,门槛也还是冲着会写代码的人。 Sekai 想干的事是:把这套东西直接塞进你妈的手机
6 月 1 日,有程序员在 Reddit 上晒了张账单:上个月 50 美元,这个月 3000 美元。同一个 GitHub Copilot,同样的活,价钱翻了 60 倍。 另一个人更干脆,月费从 29 刀跳到 750 刀,撂下一句 "What
Cognition 这轮融资最抓人的不是 260 亿美元估值,而是它拿自己的代码库做了一个样板:公司称,内部 90% 的代码已经由 Devin 生成。 5 月 27 日,Cognition 宣布完成超过 10 亿美元融资,投后估值达到 26
5 月 20 日,伦敦泰晤士河岸边一个会场,Anthropic 在欧洲办了第一场开发者大会 Code with Claude London。 主持人在台上问了一个问题: 「这周谁提交过完全由 Claude 写的 pull request?」
做"后台跑活的 Agent"这事,Cursor 之前是搁在 cursor.com/automations 一个独立网页上办的。5 月 20 日的 3.5 版本,把这页直接缝进了 IDE 里的 Agents Window——日常写代码的窗口和
I/O 2026 的开场 demo 里,Google 干了件挺逗的事。 他们让 Antigravity 2.0 写了一个操作系统。 12 小时、93 个 AI 子 agent、几十亿 token、不到 1000 美金的算力 ——OS 内核跑
5 月 18 日,Cursor 把 Composer 2.5 扔了出来。这是它的第三代自家编程模型,也是第一次在公开 benchmark 上跟 Opus 4.7、GPT 5.5 站到同一档位——而单次任务的成本,只到对手的十分之一。 数字摆
Google I/O 2026第一天扔出来的炸弹,不是Gemini 3.5 Pro,是Flash。 按惯例,Flash向来是Pro系列下面那个"够便宜、够快、跑得动就行"的备胎档。这次直接把分数甩上了Pro的头顶——Terminal Ben
AI 编程工具卷了一年,绑死的还是一件事——你得坐在桌前。 OpenAI 这次把这道绳子剪了。 5 月 14 日下午,ChatGPT 手机 App 多了个 Codex 入口。iPhone、iPad、Android 三个端都能用,Window
写过微服务的都知道这种痛:一个 bug 报上来,问题不在你看的那个 repo,而是横跨三四个仓库。本地 clone、切分支、改完测、各自提 PR——一上午就过去了。 5 月 13 日,Cursor 把这事砍掉了。Cloud agents 现
Coder这家公司,做的是企业自托管的开发环境基础设施——就是那种"开发者打开浏览器进网页就能写代码、所有计算和代码都在公司内网"的方案。 5月6日,他们扔出了 Coder Agents 的beta版。一句话总结:把AI编程的agent整套
250亿美元。13个月前,这家公司只值40亿。 Bloomberg周四放出消息,做出"全球第一个全自动AI软件工程师"Devin的Cognition AI正在谈下一轮融资,目标估值 250亿美元 ,规模"几亿美元起"。具体投资人没披露,条款
Sundar Pichai在季度电话会上扔出了一个数字。 75%。 这是Google目前新代码里,AI写的比例。人工审阅,AI生成。 18个月前,这个数字是25%。 18个月,25%到75% 路径很清楚: 2024年10月: 25% 202
今天(4月24日),DeepSeek发布了V4。 Bloomberg的标题是「一年后再次颠覆硅谷」。有没有这么夸张暂且不说,但这次确实是两件事一起发: V4 Pro :1.6万亿总参数,激活49B,支持100万token上下文 V4 Fla
JetBrains的研究团队每隔几个月就会做一次开发者调查,这次的数据有点意思。 他们在2026年1月对全球超过一万名职业开发者做了调查,主题是:你在工作中到底用了哪些AI工具? 先说结论:90%的开发者已经在用AI工具了,但哪家在增长、哪
4月15日,Anthropic对Claude Code桌面应用做了一次比较彻底的重设计,同时发布了一个新功能叫Routines。 这次改动的核心信号是:Claude Code不再是你发指令、它执行的单线程工具了,开始向多任务异步工作的方向演
AI编程工具普及了两年,有一种现象开始浮出水面:有些团队的代码提交量翻倍了,产品交付没有变快,bug却变多了。 TechCrunch最近报道了一个词: Tokenmaxxing 。意思是,开发者开始把AI工具的token预算当成一种身份标志
4月16日,阿里Qwen团队把Qwen3.6 35B A3B开源了,Apache 2.0协议,没有任何商用限制。 这个模型有点意思:总参数35B,但推理时只激活3B。用了混合专家(MoE)架构,12:1的计算稀疏比——在效果上接近35B大模
根据 TechCrunch 和 CNBC 的报道,AI编程工具 Cursor 正在洽谈一轮 20亿美元 的融资,投前估值超过 500亿美元 。 这个数字需要一点背景才能感受到它的分量:就在六个月前,Cursor 的估值还是 293亿美元。半
Agoda的工程团队花了不少时间推广AI编程工具,然后做了复盘。结论让人有点坐不住: 个人开发者效率提升了,但项目整体交付速度没怎么动。 这不是Agoda一家的问题。Faros AI整理了跨公司的数据,给出了一组扎心的数字: 高AI采用率的
所有人都以为AI编程工具最后会并成一个。结果——反过来了。 2026年4月第一周发生了什么 三件事,一周之内: Cursor v3(代号Glass) 发布Agents Window,可以跨本地机器、Git worktrees和云沙箱同时管理
4月15日,The Information爆出一个有点好笑的消息:Apple正在把Siri团队的工程师批量送进AI编程培训营(bootcamp),专门学怎么用AI工具写代码。 时间点是WWDC前两个月。Apple原本要在六月的开发者大会上发
Factory刚宣布完成1.5亿美元B轮,估值15亿美元。Khosla Ventures领投,Sequoia、Insight Partners、黑石跟投。 创始人Matan Grinberg,UC Berkeley物理博士在读。2023年发
4月7日,Z.ai(原智谱AI)发布了GLM 5.1,754B参数,MoE架构,MIT协议开源。 跑分结果:SWE Bench Pro 58.4%,全球第一。GPT 5.4是57.7%,Claude Opus 4.6是57.3%。 光这个数
如果你最近在用 ChatGPT Pro 里的 Codex,可能会注意到有个新选项叫 Codex Spark,响应速度快得有点不像话。 这不是参数调优的结果,是底层硬件换了。 跑在什么芯片上 GPT 5.3 Codex Spark 运行在 C
4月16日,OpenAI 给 Codex 推了一次大更新。不是小修小补——是把 Codex 从「聊天写代码」改造成了一个可以在桌面后台默默操作一切的 agent。同一天,Anthropic 发布了 Opus 4.7。两家在4月16号同时发力
GitHub Octoverse 2025数据出了,有个变化值得单独说:TypeScript在2025年8月成了GitHub贡献者最多的编程语言,月活贡献者 263.6万人 ,把一度统治的JavaScript甩在身后。 这是近十年最大的编程
Anthropic 在4月16日发布了 Claude Opus 4.7,这个版本在编程能力上的提升幅度出乎不少人的预料——生产代码修复任务直接做到了上代的3倍,SWE bench Pro 从53.4%跳到64.3%。 三个最值得看的跑分 先
4月13日,月之暗面(Moonshot AI)向所有Kimi Code订阅用户全量推送了K2.6代码预览版。这个版本在闭测了大约一周之后正式铺开,时间点卡在GPT 5.4 Cyber和Anthropic Mythos刚发布后不到两周。 Mo