Robot Tonton Satu Demo, Tingkat Keberhasilan Capai 59%
GEN-1.5 dari Generalist AI membuat robot mempelajari tugas baru dari satu video demo dalam konteksnya, tanpa fine-tuning, dengan keberhasilan 59%.
GEN-1.5 dari Generalist AI membuat robot mempelajari tugas baru dari satu video demo dalam konteksnya, tanpa fine-tuning, dengan keberhasilan 59%.
Pew Research menganalisis 49 snapshot Common Crawl dan 490.000 halaman berbahasa Inggris, menemukan jejak AI pada 35% halaman yang muncul setelah ChatGPT rilis.
SGLang dan tim Ling Infra Ant Group memangkas TPOT permintaan tunggal Ling-3.0-flash dari 3.33 ms menjadi 0.78 ms di 4 GPU Blackwell.
OpenAI memangkas harga API GPT-5.6 Sol lebih dari 20% selama tiga bulan, output turun sepertiga, sementara harga langganan tetap sama.
Ant Group dan tim SGLang membangun Weight Cache Daemon yang menyimpan bobot terkuantisasi tetap di memori GPU, memangkas waktu restart Ling-2.6-1T dari 8,8 menit menjadi sekitar 32 detik.
Anthropic memasukkan Mythos 5 ke produk keamanan mitra, mengucurkan kredit $35 juta untuk keamanan open source, dan memperluas Cyber Verification Program.
Anthropic merilis panduan siklus pengembangan software AI-native enam tahap yang merangkai intent.md, spec.md, dan plan.md lewat Skills, Hooks, CLAUDE.md, dan evals.
OpenBMB merilis open source pipeline MathForm untuk formalisasi matematika otomatis: model 8B, dataset Lean 4 terverifikasi sekitar 367 ribu contoh, dan kode evaluasi, mengungguli beberapa model formalisasi khusus 32B.
Eksperimen diagnostik Hume AI terhadap 11 model pengenalan suara terkemuka menemukan bahwa model dengan skor benchmark tertinggi justru paling sering mengulang teks referensi yang salah, bukan mendengar audio secara akurat.
Peneliti keamanan menemukan bucket S3 ClarityCheck tanpa proteksi berisi 9 juta foto wajah dan data pribadi yang bisa diunduh siapa saja.