四家一周发新模型,企业犯起模型疲劳
一周里 Anthropic、Meta、谷歌、OpenAI、英伟达先后放出新模型,采购方要重新比一遍能力、价格、速度和可靠性。选型这件事本身正在变成一项持续开销,不再是一次性动作。
收录 AI成本 相关 AI 新闻、产品动态和产业观察。 本页收录 9 篇已发布文章。
一周里 Anthropic、Meta、谷歌、OpenAI、英伟达先后放出新模型,采购方要重新比一遍能力、价格、速度和可靠性。选型这件事本身正在变成一项持续开销,不再是一次性动作。
四项改动分别省下 5.5%、3.1%、2.9%、2.3%,没有一项来自换更便宜的模型。按量计费铺开之后,上下文里每一段冗余日志都会写进账单,清掉它比调参数见效更快。
单价往下走、用量往上冲,这套组合过去两年一直被解读成健康信号。当降价的节奏开始由开源模型定,账面上先受伤的是那些把算力合同签到几年后的公司。
过去按每秒一帧硬啃整段素材,现在模型自己决定看哪一段、看多快、走画面还是走音轨。谷歌给出的数字是 token 最多省 88%、成本最多降 66%,准确率反倒还能涨 7 个点。省钱和变准同时发生的场景并不常见。
OpenAI 这次把 10 亿活跃用户、200 万企业客户和 GPT 5.6 降价放在同一篇账本里,重点已经从“谁的模型更强”转向“谁能把强模型卖得起、跑得动”。
这条消息得放到一个背景里看才有分量:OpenAI 一年在算力上烧掉几十亿美元,其中最疼的不是训模型,是天天跑模型。 6 月 30 日,The Information 捅出一条:OpenAI 的工程师找到一个办法,把跑模型的推理成本砍掉了一半
"我也是个 token 上瘾的人,这玩意儿会上瘾。" 说这话的是微软 CEO 纳德拉。6 月 13 日他上了《Hard Fork》播客,难得没讲什么宏大叙事,反倒劝起大家省着点用 AI。
数十亿美元。这是 Meta 今年光是 员工自己内部用 AI 这一项,预计要烧掉的钱。 不是建机房、不是买卡,就是公司里的人敲键盘调模型——这一块账单,单拎出来就是数十亿。 扎克伯格坐不住了。
先说个拧巴的画面:美国企业的 IT 负责人,一边在合规群里转发「别用中国模型」的警告,一边把公司信用卡绑到了 DeepSeek 的 API 上。 这不是段子。6 月 7 日 The Decoder 援引 Ramp 的数据,把这事摆到了台面上