🤖 Dream-RSI: агент ускоряет поиск решений на прошлых запусках
Google, Google DeepMind и университеты Мэриленда и Виргинии опубликовали препринт Dream-RSI (arXiv:2609.14858): накопленные деревья попыток работают как точный симулятор-реплей, где без единого нового вызова агента прогоняются тысячи альтернативных стратегий. Отдельный LLM-агент переписывает код стратегии, прежняя версия участвует в отборе — новая гарантированно не хуже.
🌍 Проверить новую стратегию самоулучшения обычно можно, лишь заново прогнав дорогой цикл открытий. Здесь уже оплаченные журналы запусков становятся бесплатным симулятором: один онлайн-запуск окупает тысячи офлайн-оценок политики.
👤 Исследователям агентного поиска метод снижает цену мета-обратной связи: на Gemini 3.1 Pro решатель Lasso ускорился с 3587 до 2931 мс при 317 вызовах вместо 550.
Источник 1: https://dream-rsi.com/ Источник 2: https://arxiv.org/abs/2609.14858
