GPT-6.1 Sol Rilis, Harga API Seperlima dari Astra

OpenAI memperkenalkan GPT-6.1 Sol dalam DevDay pada 29 September, diposisikan untuk agen coding, pengoperasian komputer, dan tugas kantor profesional. Harga standar API-nya 2 dolar AS per juta token input, 0,10 dolar AS untuk input yang di-cache, dan 10 dolar AS per juta token output — sama dengan GPT-6 Sol. Dibandingkan model andalan GPT-6 Astra yang dipatok 10 dolar AS, 0,20 dolar AS, dan 50 dolar AS, harga input maupun output GPT-6.1 Sol hanya seperlimanya.

Ritme perilisannya cukup cepat. GPT-6 Astra diluncurkan 26 hari sebelumnya, sementara GPT-6 Sol baru berumur 7 hari saat digantikan oleh versi 6.1. Menurut OpenAI, model baru ini "mendekati Astra" dalam kemampuan coding dan pengoperasian komputer.

Skor mendekati model andalan, sebagian masih tertinggal

Dalam hasil yang dipublikasikan OpenAI, GPT-6.1 Sol meraih 75,2% pada DeepSWE v1.1 di level penalaran tinggi, menyamai Astra dengan biaya sekitar seperlimanya. Pada OSWorld 2.0 di level penalaran tertinggi, skornya 71,4%, tertinggal 2,1 poin persentase dari Astra, dengan biaya per tugas sekitar sepertujuhnya. Pada Terminal-Bench Science 0.1 yang menguji alur kerja riset berbasis command line, biaya rata-ratanya 5,47 dolar AS per tugas, dibandingkan Claude Opus 5.5 sebesar 23,21 dolar AS dan Astra 23,80 dolar AS.

Pengujian independen dari Artificial Analysis menghasilkan kesimpulan serupa: indeks kecerdasannya 4 poin lebih tinggi dari GPT-6 Sol dan 1 poin lebih rendah dari GPT-6 Astra; pada uji akurasi pengetahuan, tingkat halusinasi turun dari 60% menjadi 54%. Konsekuensinya, jawabannya jadi lebih panjang — menyelesaikan tugas yang sama membutuhkan token output 10% hingga 30% lebih banyak. Kenaikan diskon cached read dari 90% menjadi 95% sedikit mengimbangi biaya tambahan ini.

Tidak semua kategori sedekat itu. Menurut data yang dirilis OpenAI sendiri, pada ExploitBench internal Sol mencatat 21,5% berbanding 31,5% milik Astra; pada TroubleshootingBench yang menguji penanganan gangguan, skornya 47,96% berbanding 63,46%. Untuk skenario yang membutuhkan rantai debugging panjang, model andalan masih unggul jelas.

Akses dan beberapa batasan

GPT-6.1 Sol kini tersedia di ChatGPT Work dan Codex untuk pengguna Plus, Pro, Business, Enterprise, dan Edu; pengguna gratis dan Go belum bisa mengaksesnya, dan model ini juga belum masuk ke antarmuka chat biasa. Pengembang dapat memanggilnya sebagai gpt-6.1-sol, dengan jendela konteks sekitar 1,05 juta token dan output maksimum 128 ribu token per panggilan.

Ada beberapa detail yang perlu diperhatikan:

  • Untuk prompt yang melebihi 272 ribu token, kelebihannya dikenakan biaya 2x untuk input dan 1,5x untuk output;
  • Level penalaran none dan minimal tidak didukung;
  • Pemanggilan tools tidak tersedia lewat endpoint Chat Completions; tim harus beralih ke Responses API.

Poin kedua paling berdampak bagi tim yang membangun interaksi real-time. Trik lama mematikan penalaran untuk memangkas latensi tidak lagi berfungsi di 6.1 Sol.

Dari mana pengembang di China bisa mengaksesnya

API resmi OpenAI sudah tidak tersedia untuk China daratan sejak Juli 2024, dan itu tidak berubah. Jalur pihak ketiga dalam daftar peluncuran kali ini justru lebih relevan bagi pengembang di sana: OpenRouter dan Vercel AI Gateway menghadirkannya bersamaan, dan model ini juga tersedia lewat paket Pro+, Max, Business, dan Enterprise GitHub Copilot.

Bagi tim di China, perbandingan yang lebih langsung adalah harga model buatan lokal. Harga API GLM-5.3 yang dipublikasikan sebelumnya adalah 4,4 dolar AS per juta token output — kurang dari separuh harga GPT-6.1 Sol. Dengan menekan kemampuan coding setara model andalan ke kisaran 10 dolar AS, Sol mempersempit selisih harga yang selama ini dipegang model-model lokal di ranah coding; apakah mereka akan ikut menurunkan harga masih harus dilihat.

Variabel lain ada pada OpenAI sendiri. Sehari sebelumnya, perusahaan ini baru saja menarik rencana peluncuran GPT-6.1 Astra yang semula dijadwalkan Oktober, dengan alasan standar keamanannya belum terpenuhi, dan belum ada jadwal pasti untuk pembaruan berikutnya di lini andalan. Sampai saat itu tiba, 6.1 Sol kemungkinan besar akan menjadi model yang paling didorong OpenAI ke pengembang.

Sumber: halaman rilis resmi OpenAI dan rangkuman DevDay, uji independen Artificial Analysis, CocoLoop, rangkuman pengujian dari DataCamp dan Vellum; harga per tingkat API, panjang konteks, dan pengali biaya untuk prompt panjang mengikuti angka yang dipublikasikan OpenAI.