OpenAI menaikkan kecepatan output default untuk GPT-6 Astra dan GPT-6.1 Sol di produk berbayarnya. Kepala Codex, Thibault Sottiaux, mengumumkan lewat media sosial pada 5 Oktober bahwa kecepatan default kedua model ini naik sekitar 50% secara keseluruhan, dengan laju output meningkat dari sekitar 30 token per detik menjadi sekitar 50. Perubahan ini mencakup seluruh produk OpenAI sendiri, juga semua aplikasi mitra yang terhubung lewat "Sign in with ChatGPT".
Pengguna tidak perlu mengubah pengaturan apa pun. Sottiaux mengatakan update ini akan digulirkan ke semua orang dalam waktu dua jam.
"Peningkatan" yang disetor sehari setelahnya
Waktu peluncuran peningkatan kecepatan ini bukan kebetulan. Pada 4 Oktober, Sottiaux memberi tenggat publik 28 hari untuk tim Codex: setiap hari harus merilis sesuatu yang benar-benar terasa lebih baik bagi mayoritas pengguna Codex dan ChatGPT Work, atau kalau tidak, semua kuota pengguna akan di-reset total.
Peningkatan kecepatan pas sekali dengan standar "terasa oleh mayoritas pengguna" itu. Manfaatnya tidak terbatas pada satu skenario saja — menulis kode, mencari informasi, maupun menjalankan tugas agen semuanya kebagian untung — dan pengguna juga tidak perlu belajar fitur baru. Dalam komitmen yang mengharuskan ada sesuatu baru setiap hari, perubahan seperti ini paling mudah diakui sebagai pencapaian.
Cakupannya juga lebih luas daripada sekadar ChatGPT. Mitra yang disebut Sottiaux antara lain alat coding open source OpenCode, lalu Pi, Amp, dan Devin dari Cognition. Produk-produk ini memungkinkan pengguna login langsung dengan akun berbayar ChatGPT mereka, sehingga yang terpakai adalah kuota subscription, bukan tagihan API — jadi peningkatan kecepatan di sisi subscription otomatis ikut terbawa ke sana.
Dari 30 ke 50, hitungannya lebih dari separuh
Judul resminya menyebut "sekitar 50%", tapi berdasarkan dua angka yang diberikan — 30 token per detik naik jadi 50 — kenaikannya sebenarnya sekitar 67%. Sottiaux tidak menjelaskan selisih antara dua angka ini. Salah satu kemungkinan, 50% itu mengacu pada pengalaman end-to-end secara keseluruhan, termasuk waktu tunggu token pertama, sementara kalau hanya dilihat dari fase generasi saja, kenaikannya memang dua pertiga.
Kalau diubah jadi waktu yang benar-benar terasa oleh pengguna, perkiraan kasarnya seperti ini:
| Panjang output | 30 token/detik | 50 token/detik |
|---|---|---|
| Satu blok kode 2.000 token | Sekitar 67 detik | Sekitar 40 detik |
| Output tugas agen 20.000 token | Sekitar 11 menit | Sekitar 6,7 menit |
Ini hanya menghitung waktu model menghasilkan teks. Dalam tugas agen masih ada waktu untuk memanggil tool, menjalankan test, dan menunggu jaringan, yang semuanya tidak ikut lebih cepat. Jadi persentase waktu yang benar-benar dihemat saat menyelesaikan satu tugas akan lebih kecil daripada yang tertera di tabel ini.
Tokenizer dan pemakaian token
Sottiaux juga menyebut bahwa kedua model sudah memakai tokenizer yang dioptimalkan, sehingga jumlah token yang dibutuhkan untuk menyelesaikan tugas yang sama juga berkurang. OpenAI tidak memberikan angka pasti soal seberapa besar pengurangannya.
Poin ini kemungkinan berdampak lebih langsung bagi pengguna berbayar dibanding soal kecepatan. Kuota Codex dan ChatGPT Work dihitung berdasarkan konsumsi token, jadi kalau satu tugas memakai token lebih sedikit, kuota yang sama bisa dipakai untuk lebih banyak pekerjaan. Sebaliknya, peningkatan kecepatan saja tidak mengubah kuota — output yang lebih cepat hanya membuat pengguna lebih cepat mencapai batas jendela lima jam. Beberapa media secara khusus menyoroti hal ini dalam pemberitaan mereka.
Saat GPT-6.1 Sol diluncurkan di DevDay pada 29 September, pengujian pihak ketiga menemukan model ini memakai 10% hingga 30% lebih banyak token output dibanding generasi sebelumnya untuk menyelesaikan tugas yang sama. Seberapa besar tokenizer baru ini bisa menutup selisih tersebut baru akan jelas setelah ada pengujian independen ulang.
Belum ada perubahan di sisi API
Pembagian tugas kedua model ini cukup jelas. GPT-6 Astra adalah model andalan, dengan harga API standar 10 dolar AS per sejuta token input dan 50 dolar AS per sejuta token output. GPT-6.1 Sol ditujukan untuk agen coding dan operasi komputer, dengan harga 2 dolar AS untuk input dan 10 dolar AS untuk output — keduanya seperlima dari harga Astra. Peningkatan kecepatan di sisi subscription ini berlaku untuk kedua model secara bersamaan.
Penyesuaian kali ini hanya menyangkut kecepatan default di produk berbayar. Pengguna API membayar per token, dan pernyataan Sottiaux tidak menyebutkan apakah kecepatan di sisi API juga berubah secara bersamaan; dokumentasi API OpenAI pun belum diperbarui terkait hal ini.
Sumber: pernyataan publik Thibault Sottiaux di media sosial, CocoLoop, RuntimeWire, Crypto Briefing. Laju output mengacu pada angka token per detik yang diberikan secara resmi; kenaikan dan estimasi waktu dihitung berdasarkan angka tersebut.