Codex Beralih ke Jendela Konteks Baru, Bukan Lagi Ringkasan
Tiga pull request yang sudah digabung di openai/codex mengganti ringkasan yang lossy dengan jendela konteks baru, plus alat riwayat dan catatan yang bisa diakses model.
119 artikel terverifikasi tentang Coding AI, produk, dan perkembangan industri. Halaman 1 dari 2
Tiga pull request yang sudah digabung di openai/codex mengganti ringkasan yang lossy dengan jendela konteks baru, plus alat riwayat dan catatan yang bisa diakses model.
ByteDance menunda Doubao 2.2 hingga lewat Agustus untuk memperkuat coding, pemanggilan tool, dan agent, tak lama setelah reorganisasi besar divisi Seed.
OpenAI memberi tahu SpaceX bahwa pasokan model ke Cursor akan dihentikan 12 November, tak lama usai akuisisi Cursor senilai 60 miliar dolar AS.
DeepSeek merebut kembali posisi puncak penggunaan harian OpenCode tepat di hari pertama GLM-5.3-Flash mulai berbayar, setelah kampanye gratis 41 triliun token.
OpenAI menguji 'mode persisten' untuk Codex versi command-line yang membuat agen terus bekerja sampai dihentikan pengguna, tanpa jadwal rilis pasti.
Studi kasus Warp dari Anthropic menunjukkan agen AI menulis ulang berkas skill-nya sendiri berdasarkan masukan manusia, tanpa menyentuh bobot model sama sekali.
CEO Shopify Tobi Lütke mengancam melarang Claude Code kecuali Anthropic mau membaca AGENTS.md; Anthropic merespons dalam hitungan jam dengan janji fleksibilitas baru.
Hampir semua karyawan OpenAI memakai Codex, tapi pelanggan berbayar nyaris tak menyentuhnya — celah yang menunjukkan hambatan sesungguhnya bagi AI agent.
OpenAI mengembalikan batas penggunaan lima jam untuk akun Plus di ChatGPT Work dan Codex, sementara bug routing sempat menurunkan 3% permintaan Pro dan Thinking ke GPT-5.5-mini.
Video demo menunjukkan GPT-5.6 Sol merancang prosesor RV32IM bernama Codex-R32 dari gerbang logika dasar, dan game DOOM tahun 1993 berhasil berjalan di atasnya.
ByteDance melebur TRAE dan Coze ke dalam Doubao, bertaruh bahwa perkantoran adalah pintu masuk AI yang sebenarnya.
Model misterius Ox Alpha tampil di OpenRouter dengan konteks 1,04 juta token gratis penuh; jejak teknis mengarah ke varian GLM-5.3 Zhipu AI, belum ada klaim resmi.
Nvidia membayar startup AI coding Poolside $6 miliar untuk melisensikan sistem pembuatan modelnya, sekaligus merekrut 109 karyawan, tanpa mengakuisisi perusahaannya secara langsung.
Anthropic merilis panduan siklus pengembangan software AI-native enam tahap yang merangkai intent.md, spec.md, dan plan.md lewat Skills, Hooks, CLAUDE.md, dan evals.
OpenAI mengatakan lonjakan pembatasan Codex berasal dari penjualan kembali langganan gaya sub2api, dan memperingatkan praktik itu akan terus dideteksi.
OpenAI membuka kode lapisan eksekusi Codex lewat tiga tingkat integrasi; Cisco dan perusahaan jasa pajak sudah membangun agen dengannya.
Anthropic menyerahkan tugas on-call CI/CD ke Claude, dengan analisis berbasis bukti median 14 menit setelah output kode per engineer naik delapan kali lipat.
API GLM-5.3 dari Zhipu resmi dibuka dengan tarif $1,40/$4,40 per juta token, meraih skor 60 di Intelligence Index Artificial Analysis, peringkat 8 dari 182 model.
Cursor merilis layanan hosting kode Origin ke semua pengguna berbayar Senin pagi; tiga setengah jam kemudian GitHub alami gangguan global hampir tujuh jam.
Sebulan usai mengakuisisi Modular, Qualcomm membuka kode compiler Mojo di bawah Apache 2.0 dengan pengecualian LLVM — kontribusi dari luar belum dibuka.
Paket Go OpenCode seharga USD 10 per bulan menaikkan kuota bulanan DeepSeek Flash dari setara USD 15 menjadi USD 30, sementara Pro tetap USD 15 dan mulai memakai tarif jam sibuk/jam sepi.
OpenAI menyebut kini 'hampir semua' peringatan keamanan awal disaring AI lebih dulu, sementara manusia hanya menangani keputusan berdampak besar, menurut tulisan Greg Brockman 17 Agustus.
DeepSeek V4 Pro kini tercatat sebagai versi 0813 dengan konteks 1M token, batas output 384K, dan peringatan kenaikan harga.
Qwen3.8-2.4T-A95B kini hadir sebagai repositori open-weight di ModelScope, bukan lagi sekadar janji peluncuran.
InclusionAI membuka Ling-3.0-tiny, model MoE 7.9B parameter yang mengaktifkan 1.3B parameter per token untuk beban kerja agen lokal.
Thinking Machines merilis Inkling-Small dengan bobot terbuka, 276B parameter total dan 12B aktif, plus dukungan multimodal dan skor yang mendekati Inkling 975B.
DeepSeek membuka beta publik API V4-Flash 0731, mendukung Responses API untuk Codex, dan melaporkan kenaikan besar pada benchmark agen.
Unity China merilis Tuanjie Engine 2.0 dan Codely, menempatkan agen gim sebagai alur kerja rekayasa yang dapat diaudit.
Laguna S 2.1 menawarkan fondasi agen coding yang bisa di-host sendiri, dengan kendali data sebagai nilai utama meski belum mengejar model tertutup terdepan.
Qwen3.8-Max-Preview hadir dengan 2,4T parameter, akses Qoder, dan diskon Credits besar sebelum model card lengkap dan benchmark independen tersedia.
Gemini 3.5 Pro dilaporkan tertunda karena Google masih mengejar kemampuan coding pada model andalannya.
Moonshot AI merilis Kimi K3 dengan 2,8 triliun parameter, konteks 1 juta token, dan harga API terbuka, tetapi bukti open-weight masih menunggu bobot dan model card.
Agnes-2.5-Flash memakai model coding gratis untuk menekan pasar alat developer agentik. Artikel ini merangkum fakta yang terverifikasi dan sinyal yang lebih luas dari satu pengumuman.
Grok Build dituduh mengunggah bundle repositori di luar file yang dibuka. Artikel ini merangkum fakta yang terverifikasi dan sinyal yang lebih luas dari satu pengumuman.
Penulisan ulang Bun dengan Claude memicu reaksi Zig. Ringkasan lokal atas fakta terverifikasi dan sinyal industri di baliknya.
Grok 4.5 bidik kursi coding dengan harga rendah. Ringkasan lokal atas fakta terverifikasi dan sinyal industri di baliknya.
GhostApproval ungkap risiko symlink pada alat coding AI. Ringkasan lokal atas fakta terverifikasi dan sinyal industri di baliknya.
Meta pasang harga Muse Spark 1.1 untuk agen AI disusun ulang untuk pembaca teknologi Indonesia dengan angka utama, klaim produk, dan pertanyaan terbuka tetap dipertahankan.
MoonBit bertaruh pada bahasa pemrograman AI-native disusun ulang untuk pembaca teknologi Indonesia dengan angka utama, klaim produk, dan pertanyaan terbuka tetap dipertahankan.
Claude Code mendapat peringatan risiko NVDB China disusun ulang untuk pembaca teknologi Indonesia dengan angka utama, klaim produk, dan pertanyaan terbuka tetap dipertahankan.
Software factories, enterprise agents and investor-operators.
Model choice, Azure hosting and coding-model price pressure.
AI coding agents, ACP protocol support and editor strategy.
Meta Batasi Claude Code dan Codex untuk Tim AI. Artikel ini merangkum poin laporan, angka utama, penjelasan perusahaan, serta maknanya bagi pasar atau regulasi.
Claude Sonnet 5 membidik agent lebih murah。
Cursor membawa agent coding ke ponsel。
Chamath kembali menjadi CEO setelah 8090 Labs meraih US$135 juta
Google mendorong tim coding saat porsi kode AI tertahan di separuh
Base44 milik Wix meluncurkan model sendiri saat ARR US$150 juta
Tenet Security menjelaskan Agentjacking: penyerang menyuntik laporan error palsu yang dianggap instruksi perbaikan tepercaya oleh coding agent.
GLM-5.2 open-weight dari Z.ai meraih 74,4 di FrontierSWE, mendekati Claude Opus dan melewati GPT-5.5 di beberapa benchmark coding dengan harga token jauh lebih rendah.
Sinyal tak resmi OpenAI menunjukkan GPT-5.6 mungkin menekankan konteks panjang, penalaran lebih kuat, dan coding agentic.
Riset Agentjacking dari Tenet menunjukkan telemetri tepercaya dapat berubah menjadi instruksi eksekusi bagi asisten coding.
Beban agent coding yang selalu aktif menguji infrastruktur GitHub era manusia dan rencana migrasi Azure Microsoft.
Beberapa hari setelah IPO, SpaceX menjalankan opsi saham penuh untuk membeli Anysphere, pembuat Cursor.
Moonshot AI merilis Kimi K2.7-Code dan mode HighSpeed. Skor internalnya menarik, tetapi harga output yang jauh lebih murah menjadi cerita utamanya.
xAI menambahkan Agent Dashboard ke Grok Build dan membuka akses dari paket Heavy US$300 ke paket yang lebih murah.
Benchmark yang dipimpin Shanghai Jiao Tong University menunjukkan agen sering menemukan file benar, tetapi baris kunci bug hanya tepat sekitar 14% hingga 19%.
GLM-5.2 dari Zhipu menggabungkan MoE 744B parameter, jendela 1 juta token, dan rencana bobot terbuka bergaya MIT untuk agen coding.
Model MoE terbuka Moonshot menawarkan token input dan output lebih murah sambil menaikkan benchmark coding berbasis agen dari K2.6.
Classifier Cursor membiarkan aksi berisiko rendah berjalan dan hanya menahan langkah penting, mengurangi lelah persetujuan bagi developer.
Perintah baru Anthropic menyalin sesi coding yang sedang berjalan agar developer bisa mencoba pendekatan berisiko tanpa kehilangan konteks asli.
Moonshot buka Kimi K2.7-Code untuk coding AI.
Perkembangan ini menunjukkan persaingan AI tidak lagi hanya soal model atau alat, tetapi juga modal, adopsi pelanggan, dan kesiapan regulasi.
Perkembangan ini menunjukkan persaingan AI tidak lagi hanya soal model atau alat, tetapi juga modal, adopsi pelanggan, dan kesiapan regulasi.
Model MoE 30B Cohere mengaktifkan sekitar 3B parameter, mendukung konteks 256K, dan dirilis dengan Apache 2.0.
Cursor merencanakan kantor pusat Eropa di London dan ingin menumbuhkan tim regional menjadi sekitar 200 orang pada akhir tahun.
Platform backend berbasis Postgres itu mengatakan pengguna lebih dari dua kali lipat sejak putaran terakhir dan agen kini menerapkan mayoritas basis data.
Copilot’s AI Credits make agentic sessions and frontier models usage-based, exposing developers to bills far above the old flat subscription.
Plugin berbasis peran, Sites, dan annotations menjadikan Codex alat workflow untuk pekerja non-teknis, bukan hanya asisten coding.
Sebuah pilot Google Play dilaporkan meminta pengembang menjual kode sumber, termasuk proyek lama, sementara emailnya tidak menyebut AI.
Di Build 2026, Microsoft menunjukkan tujuh model yang dilatih sendiri, dengan MAI-Code-1-Flash mengungguli Claude Haiku 4.5 pada benchmark coding yang dikutip.
GitHub mengganti premium request Copilot dengan AI Credits agar sesi coding agent yang berat dibayar lebih dekat dengan biaya token sebenarnya.
Di Build 2026, Microsoft menempatkan Windows sebagai platform agent dan menyiapkan Project Polaris sebagai mesin penalaran bawaan GitHub Copilot.
Sekai meraih Series A US$20 juta setelah pengguna membuat 15 juta mini app dan memakai platform lebih dari satu jam per hari.
Copilot berpindah dari hitungan premium request ke AI Credits, memperlihatkan biaya token sebenarnya dari coding bergaya agent.
Startup coding AI Cognition mengumpulkan lebih dari $1 miliar dengan valuasi $26 miliar, mengklaim 90% kode internalnya dihasilkan oleh agen AI Devin.
Di acara developer Eropa pertama Anthropic, angkat tangan menunjukkan hampir setengah peserta telah menggabungkan pull request yang ditulis sepenuhnya oleh Claude tanpa membaca kodenya.
Pembaruan Cursor 3.5 memindahkan fitur Automations dari halaman web terpisah ke dalam Agents Window IDE, mendukung multi-repo dan alur kerja di luar pengkodean.
Google meluncurkan Antigravity 2.0 di I/O 2026, platform agen mandiri yang dapat mengoordinasikan 93 sub-agen untuk membangun sistem operasi dalam 12 jam.
Cursor meluncurkan model pemrograman generasi ketiga Composer 2.5, yang menyamai Opus 4.7 dan GPT-5.5 pada tolok ukur utama dengan biaya hanya sepersepuluh per tugas.
Gemini 3.5 Flash dari Google mengungguli GPT-5.5 dalam tolok ukur agen dengan harga yang sangat murah, dan menjadi model default di aplikasi Gemini dan Pencarian.
OpenAI added Codex controls to ChatGPT on iPhone, iPad and Android, letting users monitor and approve coding tasks away from the desktop.
Cursor’s cloud agents now support multi-repository environments, faster builds and enterprise controls for teams with microservice codebases.
Coder Agents menawarkan cara bagi perusahaan menjalankan agent coding AI di infrastruktur sendiri, dengan pilihan model terbuka dan tanpa mengirim kode atau prompt ke luar jaringan.
Cognition AI, pengembang insinyur perangkat lunak AI otonom Devin, dikabarkan sedang dalam pembicaraan pendanaan dengan target valuasi $25 miliar, meningkat enam kali lipat dalam 13 bulan.
Sundar Pichai mengungkapkan dalam panggilan pendapatan triwulanan bahwa 75% kode baru Google kini ditulis oleh AI dan ditinjau manusia, naik dari 25% 18 bulan lalu. Pergeseran ini mengubah peran pengembang dan menyoroti penggunaan alat pesaing seperti Claude Code di DeepMind.
DeepSeek merilis V4-Pro dan V4-Flash dengan lisensi MIT, mencetak skor tertinggi dalam pemrograman kompetitif dengan harga output $3,48/M — jauh di bawah GPT-5.5 dan Claude Opus 4.7.
Survei JetBrains terhadap lebih dari 10.000 developer profesional global mengungkapkan bahwa 90% kini menggunakan alat AI, dengan Claude Code melonjak dari 3% menjadi 18% dalam enam bulan sementara pertumbuhan GitHub Copilot mandek.
Anthropic mendesain ulang aplikasi desktop Claude Code dengan manajemen multi-sesi, alat pengembang bawaan, dan fitur Routines yang dapat dipicu oleh peristiwa GitHub.
Dua tahun setelah alat coding AI meluas, muncul fenomena "Tokenmaxxing" di mana developer memperlakukan anggaran token AI sebagai simbol status. Data menunjukkan churn kode meningkat hingga 9,4 kali lipat, dan hanya 10-30% kode hasil AI yang bertahan setelah beberapa minggu.
Tim Qwen Alibaba telah merilis Qwen3.6-35B-A3B sebagai sumber terbuka di bawah lisensi Apache 2.0. Model MoE dengan 35B parameter total namun hanya mengaktifkan 3B per token ini mencetak 73,4% di SWE-bench Verified, mengungguli Gemma 4-31B milik Google sebesar 21 poin persentase.
Perangkat coding AI Cursor tengah bernegosiasi untuk pendanaan $2 miliar dengan valuasi pra-pendanaan lebih dari $50 miliar, hampir dua kali lipat dalam enam bulan.
Tim teknik Agoda menemukan bahwa alat coding AI secara signifikan meningkatkan produktivitas pengembang individu, namun kecepatan pengiriman proyek secara keseluruhan tidak berubah, dengan tinjauan kode menjadi hambatan baru.
Pada minggu pertama April 2026, Cursor v3, plugin Codex dari OpenAI, dan pengguna awal yang mulai merangkai ketiga alat tersebut menunjukkan bahwa alat coding AI sedang beralih ke spesialisasi, bukan menyatu menjadi satu.
Apple mengirim para insinyur tim Siri ke bootcamp coding AI untuk mempelajari cara menggunakan alat seperti Claude Code, saat perusahaan bergegas merombak Siri menjelang WWDC pada bulan Juni.
Factory baru saja mengumumkan pendanaan Seri B senilai $150 juta yang dipimpin Khosla Ventures, mencapai valuasi $1,5 miliar, dengan Morgan Stanley, EY, dan Palo Alto Networks sebagai pelanggan berbayar untuk platform agen AI coding tingkat enterprise.
Z.ai (sebelumnya Zhipu AI) merilis GLM-5.1, model open-source MoE dengan 754B parameter yang mencetak 58,4% di SWE-Bench Pro, melampaui GPT-5.4 dan Claude Opus 4.6. Model ini dilatih sepenuhnya menggunakan chip Huawei Ascend 910B dan framework MindSpore, tanpa satu pun GPU NVIDIA.
OpenAI telah menyebarkan model GPT-5.3-Codex-Spark di chip Cerebras WSE-3, bukan GPU Nvidia, mencapai lebih dari 1.000 token per detik — sekitar 15 kali lebih cepat dari versi standar. Langkah ini menandai penyebaran produksi pertama OpenAI pada perangkat keras non-Nvidia.
OpenAI merilis pembaruan besar untuk Codex dengan fitur background computer use yang memungkinkannya mengoperasikan aplikasi macOS lain secara otonom di latar belakang. Pembaruan ini juga mencakup browser bawaan, pembuatan gambar, lebih dari 90 plugin baru, akses SSH, dan kemampuan penjadwalan mandiri.