ロボット、実演1回視聴で成功率59%に
Generalist AIのGEN-1.5は、ファインチューニングなしで実演動画1本から新タスクを学習し、成功率59%を達成する「物理プロンプティング」を発表した。
Generalist AIのGEN-1.5は、ファインチューニングなしで実演動画1本から新タスクを学習し、成功率59%を達成する「物理プロンプティング」を発表した。
ピュー研究所がCommon Crawlの49スナップショット・49万ページを分析、ChatGPT登場後に生まれたページの35%にAI関与の痕跡が見つかったと報告した。
SGLangとAnt Ling Infraが4基のBlackwellでLing-3.0-flashの生成速度を3.33msから0.78msに短縮した経緯をまとめた。
OpenAIがGPT-5.6 SolのAPI料金を3カ月間、20%超値下げ。出力トークンは3分の1減だがサブスク料金は据え置き。
Ant GroupとSGLangチームが量子化済みの重みをGPUメモリに常駐させる仕組みを開発、Ling-2.6-1Tの再起動時間を8.8分から約32秒に短縮した。
AnthropicがClaude Mythos 5をパートナーのセキュリティ製品に組み込み、オープンソースのセキュリティ支援に3500万ドル分のクレジットを拠出、Cyber Verification Programも拡大する。
Anthropicが社内の開発プロセスをClaude中心の六段階に再構築し、intent.md・spec.md・plan.mdの連鎖とSkills・Hooks・CLAUDE.md・evalsで統制する手引きを公開した。
OpenBMBが数学の自動形式化パイプラインMathFormを一括公開。8BモデルとLean 4検証済みデータ約36.7万件、評価コードを無償公開し、複数の32B専用モデルを上回る成績を記録した。
Hume AIの検証実験で、公開ベンチマークのスコア上位モデルほど、実際の音声ではなくデータセットの参照テキストの誤りをそのまま再現している傾向が判明した。
ClarityCheckのS3バケットが無防備で、顔写真900万枚と個人情報が誰でもダウンロードできる状態だった問題を追う。