MIT 用 121 個遊戲重看 AI 推理
MIT、劍橋、普林斯頓等團隊在 Nature 的研究顯示,人類面對新遊戲時更像是在做快速、淺層、帶目標感的心理模擬,而不是深度搜尋。
收錄 推理模型 相關產品動態與產業觀察,共 4 篇文章。
MIT、劍橋、普林斯頓等團隊在 Nature 的研究顯示,人類面對新遊戲時更像是在做快速、淺層、帶目標感的心理模擬,而不是深度搜尋。
An internal general reasoning model found an algebraic-number-theory construction that external mathematicians said is journal-worthy.
Arcee AI 這家僅 26 人的新創公司,投入約一半風險投資的 2000 萬美元,用 2048 張 Nvidia B300 GPU 跑了 33 天,訓練出 400 億參數的開源推理模型 Trinity-Large-Thinking,在 Agent 任務基準測試中拿下頂尖成績。
一篇發表於《自然·通訊》的論文指出,斯圖加特大學和ELLIS阿利坎特研究所的團隊讓推理大模型攻擊其他大模型,在25,200次測試中達到97.14%的總成功率,幾乎全部突破安全護欄。