Liquid AI草稿模型解碼提速3.18倍
Liquid AI釋出LFM2.5-DSpark草稿模型,為三款端側模型配上推測解碼,輸出結果不變,解碼速度最高提升3.18倍。
收錄 AI 推理 相關產品動態與產業觀察,共 11 篇文章。
Liquid AI釋出LFM2.5-DSpark草稿模型,為三款端側模型配上推測解碼,輸出結果不變,解碼速度最高提升3.18倍。
騰訊混元開源 AngelSpec,將推測解碼 drafter 的訓練、評測、權重與部署鏈路一次放出。
DeepSeek 與北京大學開源 DSpark 推理框架,生成速度提升 60% 到 85%,單卡吞吐最高可達 6.6 倍。
小米 MiMo 稱普通 GPU 上每秒超 1000 token. 本文整理事件重點、戰略背景,以及受影響用戶或企業需要注意的實務風險。
Tensormesh 獲得 AMD Ventures、NVentures、CoreWeave 等投資者 2000 萬美元,將其 KV 快取平台商業化,減少 GPU 重複計算浪費。
MiniMax 推出 M1 推理模型系列,瞄準 OpenAI 的 o 系列與 DeepSeek 的 R1,在數學推理、程式碼生成與邏輯分析上表現強勁,M2.5 在 SWE-bench Verified 上獲得 80.2% 的成績。
全面比較 OpenAI、DeepSeek、Google、Anthropic 等主要 AI 推理模型,分析各家路線、推理深度與回應速度的取捨,以及開源與閉源的最新格局。
OpenAI 的 GPT-5.2 在 ARC-AGI-1 獲得 72%,ARC-AGI-2 獲得 18%,凸顯當前大型語言模型與真正通用智慧之間的差距。
DeepSeek 於 2026 年 1 月直接開源了推理模型 R1,在數學、程式碼與邏輯推理基準測試上與 OpenAI 的 o1 打成平手,其蒸餾版 32B 參數模型更在多項測試中超越 o1-mini。
Google 發布 Gemini 2.5 Pro,官方稱其為「迄今最智慧的模型」,在數學、科學、程式碼與多模態基準測試中取得頂尖成績,但深度推理也導致回應速度較慢。
Anthropic 於 2 月 5 日發布 Opus 4.6,核心升級為自適應思考,可根據問題複雜度動態調整推理深度,並提供 100 萬 token 上下文視窗與理論上支援無限對話的 Compaction API。