Insinyur Anthropic: Claude Belajar Menulis untuk AI, Bukan Manusia

Jackson Kernion, insinyur Anthropic yang menangani fine-tuning Claude, belakangan ini membuat serangkaian utas di X untuk menjelaskan mengapa banyak pengguna merasa Claude makin pintar tapi tulisannya makin sulit dibaca. Penjelasannya cukup blak-blakan: model-model belakangan menaruh bobot pelatihan lebih besar pada matematika dan kode, ditambah pelatihan besar-besaran untuk “menulis penjelasan teknis buat model AI lain,” sehingga model itu perlahan beradaptasi dengan “psikologi LLM” — ia belajar menulis untuk AI, bukan untuk manusia.

Diskusi ini bermula dari keluhan pengguna soal kualitas tulisan Claude; sebagian menganggap Opus 4.6 adalah “model penulisan” terakhir dari Anthropic yang benar-benar enak dipakai. Kernion tidak membantah kesan itu.

Dari Mana Asal “Gaya Claude”

Penjelasan Kernion berpusat pada desain reward dalam reinforcement learning. Sebagian reward pelatihan menyasar “apakah model lain bisa memahaminya,” sebagian lagi menyasar “apakah manusia bisa memahaminya.” Makin besar volume pelatihan untuk matematika dan kode, makin kuat sinyal jenis pertama, dan model pun makin condong menulis paragraf yang sangat padat dan bertumpuk istilah teknis. Untuk menggambarkan rasanya bagi pembaca manusia, ia memakai istilah: overly-dense info dumps, informasi yang ditumpahkan terlalu padat.

Ia juga memberi perumpamaan: sekelompok orang yang hanya bicara dengan sesamanya lama-lama akan membentuk cara bicara yang lancar di dalam kelompok tapi sulit dipahami dari luar. Hal serupa terjadi antar-model AI.

Untuk memperbaikinya, perlu ada penambahan reward secara sengaja dalam pelatihan, untuk penjelasan sederhana yang bisa diikuti pembaca manusia. Kernion mengatakan ini pekerjaan yang sulit, dan timnya akan terus memperbaikinya.

Apa yang Berubah di Opus 5.5

Ia menulis dalam salah satu unggahannya:

"Opus 5.5 is our first model release with targeted improvements on sentence clarity and overly-dense info dumps."

Opus 5.5 adalah rilis model pertama kami dengan perbaikan khusus pada kejelasan kalimat dan masalah informasi yang terlalu padat.

Ia lalu menambahkan bahwa sejak Opus 4.6, ia belum pernah sepuas ini dengan tulisan model mana pun. Pernyataan ini masih menyisakan ruang — ia tidak mengatakan Opus 5.5 sudah melampaui 4.6.

Liputan soal peluncuran Opus 5.5 juga menyebut janji Anthropic untuk mengurangi gaya tulisan “Claudish.” Pengguna berbahasa Inggris pernah membeberkan gejala khasnya: frasa baku yang berulang, subjudul berlapis-lapis, dan satu poin yang dipecah jadi terlalu banyak butir. Semua ini rangkuman dari sisi pengguna — Anthropic sendiri belum pernah merilis daftar resmi “gaya Claude,” maupun skor evaluasi keterbacaan tulisan.

Dampaknya bagi Pengguna Berbahasa Mandarin

Semua yang dibahas Kernion adalah konteks berbahasa Inggris. Apakah keluaran berbahasa Mandarin punya kecenderungan yang sama, dan apakah perbaikan khusus kali ini mencakup bahasa Mandarin, tidak ia singgung, dan Anthropic pun tidak menjelaskannya secara terpisah.

Satu hal bisa disimpulkan dari penjelasannya: kecenderungan ini terkait dengan jenis tugas. Makin teknis suatu tugas, makin mudah model beralih ke mode “menulis untuk model lain.” Para pengembang di Tiongkok yang memakai Claude untuk menulis dokumentasi API, proposal teknis, atau komentar kode, persis berada di area ini.

Sebelum Anthropic merilis data khusus untuk sisi bahasa Mandarin, saran dari tim redaksi ada dua, dan keduanya sekadar praktik berdasarkan pengalaman: pertama, jelaskan di prompt siapa pembacanya, misalnya “untuk manajer produk yang baru masuk kerja” — ini lebih efektif daripada sekadar meminta “tulis yang sederhana.” Kedua, minta model menulis kesimpulan lebih dulu baru menjabarkannya, sambil membatasi jumlah poin informasi per paragraf. Tim yang sudah beralih ke Opus 5.5 bisa menjalankan ulang kumpulan prompt lama yang sama, lalu membandingkan hasilnya dengan keluaran era 4.6 dan era 5.x untuk menilai sendiri seberapa besar perbaikannya.

Sumber: unggahan X Jackson Kernion, The Decoder, CocoLoop, Ifeng Technology; jabatan dan kutipan Kernion diverifikasi berdasarkan unggahannya sendiri dan pemberitaan media.