Kemarin (23 April), Anthropic melakukan sesuatu yang jarang terjadi: secara terbuka mengakui kesalahan.
Bukan dengan bahasa PR yang samar, melainkan menjabarkan tiga keputusan teknis spesifik — kapan diubah, apa yang diubah, mengapa diubah, apa konsekuensinya, dan kapan diperbaiki.
Dari awal Maret hingga pertengahan April, ketiga perubahan ini bertumpuk, membuat Claude Code tampak semakin bodoh di mata pengguna. Banyak yang mengira ini degradasi model, padahal ini adalah tiga keputusan yang bisa dilacak ke titik waktu tertentu.
Kesalahan pertama: Diam-diam mengalihkan Claude ke mode hemat daya
Tanggal: 4 Maret
Kedalaman penalaran default Claude Code diubah dari high (tinggi) menjadi medium (sedang). Alasannya adalah mengurangi latensi agar respons lebih cepat.
Hasilnya, pengguna jelas merasakan Claude Code menjadi lebih bodoh. Pertanyaan sama, kualitas keluaran menurun.
Kesimpulan Anthropic: "Ini adalah trade-off yang salah. Kami mengembalikan perubahan ini pada 7 April karena pengguna memberi tahu kami bahwa mereka lebih menginginkan kecerdasan tinggi secara default dan secara aktif memilih latensi rendah saat diperlukan."
Banyak pengguna telah melaporkan hal ini sejak pertengahan Maret, tetapi saat itu Anthropic tidak menjelaskan penyebabnya secara terbuka. Kali ini secara resmi diakui: ini bukan Bug, melainkan keputusan salah yang diambil secara aktif.
Waktu dari masalah hingga perbaikan: lebih dari satu bulan.
Kesalahan kedua: Optimasi cache memperkenalkan bug pelupa
Tanggal: 26 Maret
Saat mengoptimalkan cache, tim teknik memperkenalkan sebuah bug:
Logika normal — cache sesi pemikiran hanya dibersihkan setelah pengguna tidak aktif selama beberapa waktu. Setelah bug muncul, menjadi dibersihkan setiap kali pengguna mengirim pesan.
Hasilnya, Claude menjadi pelupa dan berulang-ulang dalam percakapan. Hal yang baru saja dikatakan, dilupakan di pesan berikutnya. Pengguna mengira ini degradasi kecerdasan, padahal sebenarnya memori bocor.
Kata Anthropic: "Ini bukan pengalaman yang seharusnya dialami pengguna saat menggunakan Claude Code."
Tanggal perbaikan: 10 April.
Waktu dari masalah hingga perbaikan: 15 hari.
Kesalahan ketiga: Batasan kata ditambahkan, performa turun 3%
Tanggal: 16 April
Anthropic memodifikasi prompt sistem, menambahkan dua batasan:
- Antara panggilan alat: maksimal 25 kata
- Jawaban akhir: maksimal 100 kata
Tujuannya adalah membuat Claude lebih ringkas. Pengujian internal menemukan penurunan performa sebesar 3%.
Pada 20 April, perubahan ini dikembalikan.
Waktu dari masalah hingga perbaikan: 4 hari — jauh lebih cepat daripada bug kedua, karena kali ini setidaknya ada data pengujian internal yang mendukung keputusan.
Tiga kesalahan bertumpuk
Melihat garis waktu:
| Tanggal perubahan | Isi spesifik | Tanggal perbaikan |
|---|---|---|
| 4 Maret | Kedalaman penalaran high → medium | 7 April (>1 bulan) |
| 26 Maret | Bug cache, dibersihkan setiap kali | 10 April (15 hari) |
| 16 April | Batasan kata prompt sistem | 20 April (4 hari) |
Yang dirasakan pengguna: Claude terus memburuk, tetapi tidak jelas apa yang salah.
Karena ketiga masalah ini bekerja secara bersamaan. Gejala yang dilaporkan pengguna bercampur aduk, dan Anthropic sendiri membutuhkan waktu untuk melokalisasinya.
Setelah tinjauan publik
Komitmen Anthropic ada tiga hal: memperbaiki proses pengujian, memberi tahu pengguna sebelumnya tentang perubahan, dan mereset kuota penggunaan akun yang terkena dampak.
Mengakui kesalahan itu sendiri jarang terjadi di industri AI. Bersedia berbicara dengan titik waktu dan angka spesifik, tanpa berbelit-belit, lebih baik daripada kebanyakan perusahaan.
Tapi ada satu detail yang perlu diperhatikan: bug ketiga dirilis setelah Anthropic melakukan pengujian internal — dan tetap baru di-rollback setelah menemukan penurunan performa 3%. Proses pengujian itu sendiri tidak bisa mencegahnya.
Ini bukan masalah unik Anthropic. Apa harga dari iterasi cepat? Setiap rilis adalah taruhan pada probabilitas kesalahan. Persepsi pengguna bahwa "AI menjadi lebih buruk" terakumulasi, dan sulit untuk segera diatribusikan.
Tinjauan publik tidak bisa menyelesaikan ketegangan ini, tetapi setidaknya ini adalah awal untuk menghadapinya.
Pertanyaan selanjutnya adalah: dapatkah proses pengujian yang baru dijanjikan benar-benar menghentikan perubahan serupa di masa depan? Jawabannya hanya akan diketahui saat masalah berikutnya terjadi.
Sumber referensi: Anthropic admits it dumbed down Claude with upgrades (The Register, CocoLoop, 23 April 2026); AI Dispatch: Daily Trends and Innovations – April 23, 2026 (Hipther, 23 April 2026)