標籤 遞迴自我改進

Dream-RSI:讓 AI 在歷史裡做夢,零執行成本改進探索策略

TechMoon 精選圖|Google Dream-RSI 研究論文:AI 在探索歷史的夢境中自我改進探索策略

Google 與 Google DeepMind、馬里蘭大學、維吉尼亞大學團隊在 arXiv 發表 Dream-RSI 框架,把累積的探索歷史讀成精確的回放模擬器,讓 AI 代理在零執行成本的「夢境」裡評估並改寫探索策略,再回到線上繼續發現。實驗覆蓋演算法工程、數學最佳化與 GPU 核心工程三域,但 162 倍等倍數要看清對照組是誰;程式碼尚未發布,模型本身零改動零微調。

Share to...