苹果M6用上2纳米,M5 Ultra给桌面塞512GB内存
编辑精选 M5 Ultra 把统一内存拉到 512GB、带宽拉到 1.2TB/s,四芯片封装是 M 系列头一回。这个容量恰好卡在四位量化后的开源千亿模型能不能整个装进单机的那条线上,苹果这次的发力点很明确。 苹果发布了 M6 和 M5 Ul
收录 端侧AI 相关 AI 新闻、产品动态和产业观察。 本页收录 10 篇已发布文章。
编辑精选 M5 Ultra 把统一内存拉到 512GB、带宽拉到 1.2TB/s,四芯片封装是 M 系列头一回。这个容量恰好卡在四位量化后的开源千亿模型能不能整个装进单机的那条线上,苹果这次的发力点很明确。 苹果发布了 M6 和 M5 Ul
编辑精选 一套六月底才在国内开源的投机解码方法,两个月后被一家美国端侧模型公司做成了默认加速件,连推理框架里的算法开关都直接沿用了它的名字。开源代码的扩散速度,比论文引用数诚实得多。 8 月 20 日,Liquid AI 在 Hugging
编辑精选 Q4 0 是 llama.cpp 里最老的四比特格式,精度差到社区基本弃用,Liquid AI 却用蒸馏把分数拉回 BF16 的九成七。拿训练侧的一次性成本,换 Arm 手机上那几毫秒。 Liquid AI 在 Hugging F
编辑精选 面壁智能把端侧大模型带进上市辅导,资本市场要看的已经不止开源下载量。手机、汽车和机器人里的本地模型,开始接受收入、客户和合规流程的检验。 面壁智能走到 IPO 辅导这一步,给端侧大模型赛道补上了一个可验证节点。 8 月 11 日,
机器人这轮模型竞赛,面壁智能没有把参数表拉到最大,先把模型压到了能贴近机器本体的位置。 7月19日,OpenBMB在GitHub公开MiniCPM Robot系列。两套首发模型分工很清楚: 1.5B的MiniCPM RobotManip管机
把一个 270 亿参数模型放进 iPhone,本来听起来像给芯片发布会准备的概念片。 PrismML 现在把这个说法推到台前:这家从加州理工走出来的初创公司称,已经把阿里通义千问 Qwen 3.6 的 270 亿参数稠密模型压缩到 iPho
一家靠云端大模型起家的 AI 公司,突然说想把一半的活推回到你电脑上跑——这事听着反常,但 Perplexity 的算盘其实很实在:云太贵了。 6 月 2 日的台北 Computex,Perplexity CEO Aravind Srini
打开你的Windows 11,去这个目录看一眼: %LOCALAPPDATA%\Google\Chrome\User Data\OptGuideOnDeviceModel 如果你装了Chrome 147,里面大概率躺着一个4GB的文件,叫w
4月2日,Google DeepMind发布了Gemma 4。 这不是第一个Gemma,但有两点跟之前不一样:一是切到了 Apache 2.0协议 ,二是31B这个版本在Arena AI开源榜上排到了 第三名 。 四个模型,怎么选? | 型
苹果的AI策略和其他家很不一样——不卷最强通用模型, 主打端侧部署和隐私保护 。 端侧模型:3B参数 2025年WWDC上苹果公布了Apple Foundation Models(AFM),端侧版本大约 30亿参数 ,专门为Apple Si