H Company开源Holo4,270亿参数操作电脑

法国 AI 公司 H Company 9 月 28 日在 Hugging Face 发布了 Holo4 系列模型,专门用来做”电脑操作智能体”:看屏幕截图、点鼠标、敲键盘,也能调用代码、MCP 和 API 完成任务。这一代有两个主力版本,270 亿参数的稠密模型 Holo4-27B,以及总参数 350 亿、每次激活约 30 亿的混合专家模型 Holo4-35B-A3B,权重都以 Apache 2.0 协议开放。

另外还有一个 Holotron4 Nano,基于英伟达的 Nemotron 3 Nano Omni 训练,规格是 30B-A3B。

H Company 总部在巴黎,2024 年成立,创始团队里有多位前 DeepMind 研究员,成立当年就拿到了一轮约 2.2 亿美元的种子融资。Holo 系列是它的主线产品,官方博客说 Holo4 是在上一代模型的基础上继续训练出来的。

跑分和定位

H Company 主要拿 OSWorld 2.0 说话,这是一个让模型在真实桌面系统里完成多步操作的基准。官方博客给出的对比:

  • Holo4-27B:61.7%
  • Claude Opus 5.5:81.8%
  • Claude Opus 5:70.2%
  • GPT-5.6 Sol:66.2%

从这组数看,Holo4-27B 和上一代闭源旗舰已经很接近,跟当前最强的 Opus 5.5 还有明显距离。H Company 的说法是,Holo4 在长流程任务上”只落后于最强的几款闭源模型”,参数量却小几个数量级,单任务成本低得多。

成本数字在模型卡里:Holo4-35B-A3B 跑 AutomationBench 拿到 34.5%,每个任务约 0.02 美元。博客里其他模型的单任务成本只画在图上,没有给出具体数值。

演示场景包括 3D 建模、游戏设计和企业业务流程自动化。这些分数都是在 H Company 自己的测试框架里跑出来的,官方也注明模型需要搭配自家的 hai-agents 运行框架使用,第三方复现结果目前还没有出现。

对国内开发者有什么用

先说底子。Holo4-35B-A3B 的模型卡写明基座是阿里的 Qwen3.6-35B-A3B,最长上下文 262144 个 token。国内团队对这套架构的部署、量化和推理优化都很熟,换上 Holo4 的权重,工具链基本不用改。

再说能不能本地跑。Holo4-27B 提供了 BF16、FP8、NVFP4 和 Q4 GGUF 几种格式,量化到 4 位后,一张 24GB 显存的消费级显卡有机会装下,这是粗略估算,实际还要看截图分辨率和上下文长度。35B-A3B 每次只激活约 30 亿参数,推理速度上更占便宜。

电脑操作智能体有个绕不开的问题:它要持续截取屏幕发给模型。用 Opus、GPT 这类闭源模型,截图要上传到海外云端,很多金融、政务和制造业的内网环境根本不允许。Apache 2.0 协议允许商用和修改,一个能在本地机房跑、分数又过了 60% 的开源模型,给了这些场景一个现实可用的选项。

H Company 同时通过自家的 H Models API 提供托管服务,价格还没有公布。

参考来源:H Company 官方博客、Hugging Face 模型卡、CocoLoop;OSWorld 2.0 分数以 H Company 博客为准,AutomationBench 成绩与单任务成本以模型卡口径为准,均为厂商自测。