Qwen3.8-Flash-Next今晚开源,架构提前跳到Qwen4
编辑精选 模型挂在 3.8 的代号下,用的却是下一代 Qwen4 架构。阿里把架构选型提前半步交给社区去试,等 Qwen4 正式发布时,推理框架和量化工具链已经跑过一轮了——开源节奏本身也是产品设计的一部分。 魔搭社区挂出了 Qwen3.8
收录 阿里 相关 AI 新闻、产品动态和产业观察。 本页收录 19 篇已发布文章。
编辑精选 模型挂在 3.8 的代号下,用的却是下一代 Qwen4 架构。阿里把架构选型提前半步交给社区去试,等 Qwen4 正式发布时,推理框架和量化工具链已经跑过一轮了——开源节奏本身也是产品设计的一部分。 魔搭社区挂出了 Qwen3.8
编辑精选 一小时内超额认购,股价当天跌 9%,收盘价还跌破了配售价——机构抢的是 AI 基建的长期票,二级市场付的是即时稀释的账。两种定价同时成立。 阿里巴巴 8 月 23 日订立配售协议,按每股 112.70 港元配售 7.1 亿股新股,
编辑精选 归母净利只剩 105.37 亿元,同比砍掉四分之三;同一份报表里,AI 云与算力服务收入做到 484.37 亿元。利润和增长在这个季度指向了相反的方向,钱花在哪儿写得清清楚楚。 阿里巴巴公布 2027 财年第一财季业绩:总营收 2
编辑精选 真机集群是这次发布里最贵的一块:100 多台手机、150 多个应用撑起评测基准,把 GUI 智能体从模拟器里拽了出来。跑分之外,谁能把这套环境长期养住,才是后面拉开距离的地方。 8 月 20 日,阿里千问团队推出 Qwen UI
编辑精选 Qwen3.8 的新变化不在参数更大,而在阿里第一次把 Max 级模型权重放到开发者面前。此前写在预告里的“开源承诺”,现在变成了可下载、可部署、可核验的模型卡。 Qwen3.8 Max 终于从“下周开放”的承诺,走到了模型仓库页
阿里把 Qwen3.8 Max Preview 推上 Qoder 和 Token Plan 时,最抢眼的数字并非跑分榜名次。它先把两个数字摆到开发者面前: 2.4 万亿参数 ,以及低至 0.01 倍 Credits 消耗 。 这组搭配很有意
AI Agent 又多了一道更接近真实工作的考题:不是让模型在网页里找答案,也不是让它把一段代码补完,而是给它一件商品,让它按海关规则判出 10 位 HS 编码。 阿里国际数字商业团队的 HSCodeComp 研究,7 月进入 ACL 20
训 AI Agent 最头疼的一件事,是它得在真环境里练。 你想让一个 agent 学会用终端、点网页、调工具,就得让它真去点、真去调。点错了?轻则白跑一轮,重则把测试环境搞崩。一次强化学习训练动辄上百万次交互,这账谁算谁肉疼——又慢、又贵
20 亿美元。这是林俊旸离开阿里三个月后,新公司谈下来的估值。 据 The Information,他这家 AI lab 的首轮融资已经关账,投后估值约 20 亿美元(约 135 亿元),高榕创投和红杉中国领投,两家各掏 1 亿美元。 如果
一台机械臂练了几千小时学会拧螺丝,换一台构型不一样的机械臂,这套本事基本归零,得从头再教一遍。 这是机器人这行最烧钱的一道坎。6 月 16 日,阿里 Qwen 团队一次发了三个具身智能大模型,冲的就是这道坎——他们把"一台机器学会、换台机器
Qwen3.7 Plus 最值得说的一点,不是它会看图——是它答完一句不会停。 6 月 2 日,阿里 Qwen 团队上线了这款新模型。它是 Qwen3.7 Max 的多模态版:Max 只懂文字,Plus 能看懂图片和视频。但真正的卖点,在它
梁文锋今年二月没去巴黎。 那场 AI 峰会给 DeepSeek 创始人发了请柬,他婉拒了。当时外界以为是行程问题。现在 Bloomberg 把这条线串起来了:中国正在收紧顶尖 AI 人才的出境,阿里、DeepSeek 这些民营公司里被认定"
5 月 20 日,杭州云栖大会,阿里端了三盘菜上来——一颗芯片、一个模型、一台机柜。 但真正让人记住这场发布会的,是一段 35 小时的演示。 这场演示干了一件反直觉的事 阿里把刚发布的 Qwen3.7 Max 模型,放到刚发布的 Zhenw
4月20日,Alibaba发布了Qwen系列有史以来性能最强的模型——Qwen3.6 Max Preview。 说悄悄,是因为这次没有大张旗鼓的开源庆典,没有Apache协议公告,也没有欢迎下载、商业免费的旗帜。Qwen3.6 Max只在Q
4月16日,阿里Qwen团队把Qwen3.6 35B A3B开源了,Apache 2.0协议,没有任何商用限制。 这个模型有点意思:总参数35B,但推理时只激活3B。用了混合专家(MoE)架构,12:1的计算稀疏比——在效果上接近35B大模
4月2号,阿里发布了Qwen3.6 Plus。 这次不是"更大的模型"那种常规发布,而是专门针对企业级AI Agent场景的一次定向升级。从产品定位看,阿里这次想明白了一件事:通用能力军备竞赛跑不赢,那就去做"真正能进生产环境干活"的执行层
今年2月17号,阿里在农历新年前夕放出了Qwen3.5—— 397B参数的开放权重模型 ,语言支持从82种直接拉到了 201种 。 主要升级 原生多模态 :文本、图片、视频在同一个模型里处理,不是外挂的adapter方案。这和Llama 4
Qwen3系列里最有技术含量的设计之一是 混合推理模式 ——同一个模型内置了thinking和non thinking两种工作状态。 怎么工作的 Thinking mode :模型会先生成一段内部推理过程(类似Chain of Though
阿里今年把Qwen3全系列模型用 Apache 2.0协议 开源了,从0.6B到235B一共8个尺寸,全线开放。 为什么Apache协议很重要? Apache 2.0基本上是最宽松的开源协议之一,意味着企业可以 免费商用 ,不用额外谈授权。