三家模型商 90 分钟内接连报错,谷歌正常
三家的状态页都停在同一句话上:已定位原因,正在修复。原因是什么,没有一家说。互不相干的三个供应商在 90 分钟里先后报错,是巧合还是共用了某段上游,目前没有任何官方口径能回答。
跟踪大模型、AI 编程、算力和具身智能的关键变化。每篇文章基于公开来源核验,保留事实出处,并补充面向中文读者的产业判断。
三家的状态页都停在同一句话上:已定位原因,正在修复。原因是什么,没有一家说。互不相干的三个供应商在 90 分钟里先后报错,是巧合还是共用了某段上游,目前没有任何官方口径能回答。
把校验步骤写成图里的一个路由节点,测试没过就自动回喂给模型,最多五轮然后掐断。这套写法把散在提示词里的约束搬进了确定性代码,模型换代之后不用重调。
四项改动分别省下 5.5%、3.1%、2.9%、2.3%,没有一项来自换更便宜的模型。按量计费铺开之后,上下文里每一段冗余日志都会写进账单,清掉它比调参数见效更快。
奖励函数里没有单元测试,只有一池 178 张手工评分的参考图。这条路子把强化学习从数学题、代码题挪到了说不清对错的地方,也顺带把训练一个有审美的模型的账单压到几百美元量级。
协助教唆这一项大概率过不了初审动议,但原告要的东西已经拿到手了——它把 Lehane 和 Altman 推上证人席,也把枪手的完整聊天记录变成一项必须回应的披露请求。
纽约市公立学校新学年起禁止八年级及以下学生在课堂使用生成式 AI,覆盖约 60 万人,占全市公立校学生的三分之二。美国最大学区第一次对 AI 进课堂按下了暂停键。
递表和新一轮融资同时推进,说明月之暗面把一级市场的钱和二级市场的窗口按同一个时间表在排。港股这一年给 MiniMax 和智谱的溢价摆在那里,后面排队的公司只会更急。
月之暗面正与微软、亚马逊、谷歌谈 Kimi K3 的收入分成,初期开价最高 30%,而此前业内默认的上限是 20%。开放权重模型不收授权费,云上托管的调用收入就成了唯一能摆上桌的那笔钱。
一篇工程文档比发布会更能看出方向:多智能体编排被明确排在了单体加技能之后,理由是交接过程会丢状态。这是从线上跑出来的结论。
Muse Spark 1.3 在 DeepSWE v1.1 拿到 75.4 分,压过 GPT 5.6 Sol 与 Claude Opus 5,但三项智能体测试全线落在后面。Meta 把资源押在了编码这条最容易被开发者立刻感知的赛道上。