H Company Open-Source Holo4, Model 27 Miliar Parameter untuk PC

Perusahaan AI asal Prancis, H Company, merilis rangkaian model Holo4 di Hugging Face pada 28 September, dirancang khusus sebagai "agen operasi komputer": membaca screenshot layar, mengklik mouse, mengetik di keyboard, serta bisa memanggil kode, MCP, dan API untuk menyelesaikan tugas. Generasi ini punya dua versi andalan, yaitu model dense Holo4-27B dengan 27 miliar parameter, dan model mixture-of-experts Holo4-35B-A3B dengan total 35 miliar parameter yang mengaktifkan sekitar 3 miliar parameter per proses. Bobot kedua model dirilis dengan lisensi Apache 2.0.

Selain itu ada juga Holotron4 Nano, yang dilatih berbasis Nemotron 3 Nano Omni milik Nvidia, dengan spesifikasi 30B-A3B.

H Company berbasis di Paris dan didirikan pada 2024, dengan tim pendiri yang mencakup beberapa mantan peneliti DeepMind. Perusahaan ini mendapat pendanaan seed sekitar 220 juta dolar AS pada tahun yang sama saat didirikan. Seri Holo adalah lini produk utamanya, dan menurut blog resminya, Holo4 dilatih lanjutan dari model generasi sebelumnya.

Benchmark dan Posisi

H Company terutama mengandalkan OSWorld 2.0, benchmark yang meminta model menyelesaikan tugas multi-langkah di lingkungan desktop nyata. Perbandingan yang diberikan blog resminya adalah:

  • Holo4-27B: 61,7%
  • Claude Opus 5.5: 81,8%
  • Claude Opus 5: 70,2%
  • GPT-5.6 Sol: 66,2%

Melihat angka-angka ini, Holo4-27B sudah cukup mendekati model flagship closed-source generasi sebelumnya, tapi masih tertinggal cukup jauh dari Opus 5.5 yang saat ini paling kuat. Menurut H Company, Holo4 pada tugas jangka panjang "hanya kalah dari beberapa model closed-source terkuat", padahal jumlah parameternya jauh lebih kecil dan biaya per tugasnya juga jauh lebih rendah.

Angka biaya tercantum di model card: Holo4-35B-A3B mencatat skor 34,5% di AutomationBench dengan biaya sekitar 0,02 dolar AS per tugas. Biaya model lain yang ditampilkan di blog hanya berupa grafik, tanpa angka pasti.

Skenario demo yang ditampilkan meliputi pemodelan 3D, desain game, dan otomasi proses bisnis perusahaan. Semua skor ini dihasilkan dari framework pengujian milik H Company sendiri, dan perusahaan juga mencatat bahwa model ini perlu dijalankan bersama framework hai-agents miliknya; hasil replikasi dari pihak ketiga belum ada sampai sekarang.

Apa Artinya bagi Developer di China

Mulai dari fondasinya. Model card Holo4-35B-A3B menyebutkan model dasarnya adalah Qwen3.6-35B-A3B milik Alibaba, dengan konteks maksimum 262.144 token. Tim-tim di China sudah cukup akrab dengan deployment, kuantisasi, dan optimasi inferensi untuk arsitektur ini, sehingga mengganti ke bobot Holo4 hampir tidak memerlukan perubahan pada tooling yang sudah ada.

Soal bisa dijalankan secara lokal atau tidak: Holo4-27B tersedia dalam format BF16, FP8, NVFP4, dan Q4 GGUF. Setelah dikuantisasi ke 4-bit, model ini berpotensi masuk ke satu GPU konsumer dengan VRAM 24GB — ini perkiraan kasar, dan hasil sebenarnya masih bergantung pada resolusi screenshot serta panjang konteks. Varian 35B-A3B hanya mengaktifkan sekitar 3 miliar parameter per proses, sehingga lebih unggul dalam kecepatan inferensi.

Agen operasi komputer punya masalah yang tak terhindarkan: ia harus terus mengirim screenshot layar ke model. Dengan model closed-source seperti Opus atau GPT, screenshot itu harus diunggah ke cloud luar negeri, yang di banyak jaringan internal sektor keuangan, pemerintahan, dan manufaktur sama sekali tidak diizinkan. Lisensi Apache 2.0 mengizinkan penggunaan komersial dan modifikasi, sehingga model open-source yang bisa berjalan di data center lokal dan tetap mencetak skor di atas 60% memberi opsi yang realistis untuk lingkungan seperti itu.

H Company juga menyediakan layanan hosting lewat H Models API miliknya sendiri, meski harganya belum diumumkan.

Sumber: blog resmi H Company, model card Hugging Face, CocoLoop; skor OSWorld 2.0 mengacu pada blog H Company, sedangkan hasil AutomationBench dan biaya per tugas mengacu pada model card — semuanya merupakan data pengujian sendiri dari vendor.