DeepSeek V3.2改稀疏注意力,推理成本砍半
去年九月底,DeepSeek悄悄放出了V3.2,没有大张旗鼓,但这个版本搞了一个挺有意思的架构变动。 V3.2的核心改动不是参数规模,而是注意力机制。他们做了一个叫 DeepSeek Sparse Attention(DSA) 的东西,把传
去年九月底,DeepSeek悄悄放出了V3.2,没有大张旗鼓,但这个版本搞了一个挺有意思的架构变动。 V3.2的核心改动不是参数规模,而是注意力机制。他们做了一个叫 DeepSeek Sparse Attention(DSA) 的东西,把传
Yann LeCun 从 Meta 离开之后,干了一件让所有人都在等待的事。 他创办了 AMI Labs,完成了 10.3 亿美元种子轮融资,估值 35 亿美元,欧洲有史以来最大的种子轮。然后他说:我要造一个不靠预测下一个词来工作的 AI。
Agentforce的ARR刚过了8亿美元。169%的年增速。这不是PPT里的数字,是Salesforce Q4财报里的真实数据。 29000个企业客户签了Agentforce合同,Q4单季合同数量环比增长50%,平台上跑了24亿个agen
4月初的AI圈最炸裂的新闻,不是某家又发了新模型,而是OpenAI、Anthropic和Google这三家平时抢生意的死对头,突然宣布要一起对付中国AI公司。 具体来说,三家公司通过Frontier Model Forum(2023年由这几
搞过 AI agent 开发的人,基本都被微软的框架选择困扰过:Semantic Kernel 和 AutoGen 各有一套 API,文档风格不同,社区方向也不重叠。你想做一个能上生产的 agent 应用,要么拼框架,要么等微软统一思路。
一个会自己找漏洞的AI 先说数字。Anthropic测试Mythos Preview时发现:它能在83.1%的情况下一次成功复现并利用漏洞。作为对比,同家公司的Claude Opus 4.6这个指标接近0%。 不是进步一点,是从0到83%。
日本正在做一件其他国家还在PPT里讲的事: 大规模部署物理AI 。 不是因为他们比别人更热爱技术,而是因为没有别的选择了。 劳动力危机逼出来的硬需求 日本人口已经连续14年下降。目前劳动年龄人口占总人口的59.6%,预计未来20年还会减少约
4月8日,DeepSeek悄悄在聊天产品里上线了两个新模式:快速模式(Instant Mode)和专家模式(Expert Mode)。从名字看,专家模式更厉害;但用起来你会发现,「专家」在某些地方反而有限制。 两个模式,一个让你等 快速模式
现在AI工程圈里最容易搞混的概念是MCP和A2A。很多人以为是竞争关系,其实是两层协议,解决的根本不是同一个问题。 先把问题说清楚 MCP(Model Context Protocol) :AI模型跟外部工具之间怎么通信。你让Claude去
4月初,一个叫Zero Shot的新风险基金浮出水面。创始人不是普通的VC,是一群从OpenAI出来的人。 光说是「OpenAI出来的」可能显得平平无奇——毕竟这两年OpenAI离职员工创业、加入基金的新闻多得数不清。但Zero Shot有