Google讓Agent學會「做夢」:複盤過去的試錯,下一輪自己少走彎路
Google研究團隊發布Dream-RSI,讓AI Agent做完任務後在腦中「複盤」過去的成功與失敗,推演出更好的策略再用到下一輪,不需重跑任務就能持續進步。實測中,Gemini 3.1 Pro在演算法任務上的調用次數從550次降到317次,結果反而更快。作者從實際帶領6個AI Agent團隊的經驗出發,說明為何真正的突破往往來自方法的複利,而非模型的升級。
Google研究團隊發布Dream-RSI,讓AI Agent做完任務後在腦中「複盤」過去的成功與失敗,推演出更好的策略再用到下一輪,不需重跑任務就能持續進步。實測中,Gemini 3.1 Pro在演算法任務上的調用次數從550次降到317次,結果反而更快。作者從實際帶領6個AI Agent團隊的經驗出發,說明為何真正的突破往往來自方法的複利,而非模型的升級。