智谱开源 GLM-5.3-Flash,激活参数砍到 180 亿
编辑精选 把激活参数从 320 亿压到 180 亿、层数减半,AA 指数还顶到 57 分,智谱这一版给国产开源模型划了条新的成本线:前沿档位的能力,开始按 Flash 档位的价格卖。 8 月 26 日,智谱把在 OpenCode、OpenR
关注中国大模型公司、开源模型、产品迭代、价格战和产业落地。 本页收录 14 篇已发布文章。
编辑精选 把激活参数从 320 亿压到 180 亿、层数减半,AA 指数还顶到 57 分,智谱这一版给国产开源模型划了条新的成本线:前沿档位的能力,开始按 Flash 档位的价格卖。 8 月 26 日,智谱把在 OpenCode、OpenR
编辑精选 六天匿名跑到 OpenRouter 用量榜首,才由智谱出面认领。免费预览把调用量做到 DeepSeek 的两倍,权重紧随其后,国产模型争夺开发者的顺序,正从先办发布会改成先让人用上。 智谱在 8 月 26 日确认,此前在 Open
编辑精选 OpenRouter 上这个不署名的模型开放了 104 万 token 的上下文窗口,价格栏两个零,一次报错泄出的接口路径把嫌疑指向智谱。免费预览换回来的是编程 agent 跑出的完整长程轨迹,这类数据公开语料里几乎没有。 8 月
编辑精选 MathForm 8B 在最难的 FATE X 上拿到 37% 一致性通过率,压过多款 32B 专用形式化模型。把数学题翻成 Lean 4 这件事上,检索 Mathlib 加编译器反馈迭代,比继续堆参数划算。 OpenBMB 把
编辑精选 MiMo 在开发者侧的调用量已经跑到榜首,小米却仍旧把 AI 划在"暂不变现"的账目里。桌面端应用是这套打法里第一个直接面向个人用户的入口。 小米公布二季度财报的同一场电话会上,CFO 林世伟披露了一条产品消息:MiMo 近期将推
编辑精选 GLM 5.3 在 Artificial Analysis 智能指数拿到 60 分、182 个模型里排第 8,API 定价 1.4/4.4 美元;分数已经贴近开放权重第一梯队,但每个任务吞掉 4.1 万输出 token,账单未必比
编辑精选 Ling 3.0 tiny 的看点不只是 7.9B 总参数。每个 token 只激活 1.3B 参数、同时给出 BF16/FP8/INT4 权重和 SGLang/vLLM 部署路径,说明国产开源模型正在把智能体能力往本地设备压。
编辑精选 腾讯把混元大模型接进语音识别,公开 WER、方言覆盖和 API 限制,竞争轴已经从“听清字”转向“听懂场景”。 语音识别很久以来都像一台打字机:字听得越来越准,句子背后的业务场景却常常顾不上。腾讯混元这次发布 Hy ASR 3.0
编辑精选 发改委把 10 万卡超集群、2.8 倍智能算力和人工智能法放进同一场发布会,信号很清楚:AI 产业继续冲,规则底座也要同步补。 中国 AI 产业的最新官方口径,少见地把两件事摆在同一张桌上:一边是全国产 10 万卡人工智能超集群、
智谱刚从资本市场拿到一轮高光,创始人唐杰却在内部信里把话题拉回了模型能力上限。 这封题为《巨浪已来》的内部信在 7 月 11 日发出。它没有把重点放在股价、融资或销售捷报上,反倒把公司未来两年的重心压到三个难题上:长程任务、自治智能体、自我
OpenSquilla 0.5.0 Preview 的核心,不是再押一个更大的模型,而是把四个国产模型组织成一支小队。 这次更新把 DeepSeek v4、GLM 5.2、Kimi K2.7、Qwen3.7 放进同一个 Agentic Ro
一个开源项目最近抛出个有点反直觉的结论:与其用一个最强的模型,不如把四个国产模型凑到一块投票。 这个项目叫OpenSquilla,7月6日放出0.5.0预览版,背后是家刚成立不久、估值1亿美元的公司基元律动。它的核心改动,是在Agent的调
平时这些 AI 拼了命宣传的卖点是"拍张照,难题秒解"。 可一到高考,这个卖点恰恰是第一个被摁掉的功能。 6 月 7 号, 1330 万 考生进考场。赶在这之前,豆包、腾讯元宝、百度文心、阿里通义千问、Kimi、DeepSeek——六家主流
腾讯AI实验室成立于2016年,研究了十年,论文发了一堆,结果2026年3月就这样宣布解散了。员工被批量划入混元大模型团队,配合一位28岁的年轻首席AI科学家,为四月底前要上线的混元3.0做最后冲刺。 这件事本身就很能说明问题:学术导向的A