📌 Dream-RSI: агент улучшает стратегию поиска решений на основе прошлых запусков Google опубликовала Dream-RSI - надстройку над агентами, которые ищут решения перебором: пишут код, прогоняют его через оценщик и дорабатывают лучшие варианты. Концепт управляет стратегией исследования, решая, какие варианты развивать, сколько попыток запускать параллельно и когда остановиться. Модель, агент и оценщик при этом не меняются, самосовершенствуется только код стратегии. 🟡Механика Каждый запуск сохраняется как дерево попыток, где узел хранит версию решения, диагностику и оценку. Это дерево используется как симулятор - альтернативная стратегия проходит по записанным ветвям в другом порядке, с другой параллельностью и другими точками остановки, а результаты берутся из записей без новых вызовов агента. Отдельный агент на базе языковой модели несколько раз переписывает код стратегии, каждую версию прогоняют по всем накопленным деревьям, и в следующий раунд уходит лучшая. Оценка складывается из лучшего найденного результата, штрафа за число попыток и бонуса за параллельность. Прежняя стратегия тоже участвует в отборе, поэтому на записях прошлых запусков новая версия по оценке не уступает старой. 🟡Тесты В задаче ускорения решателя Lasso версия на Gemini 3.1 Pro снизила среднее время работы на шести отложенных наборах данных с 3587 до 2931 мс и потратила 317 вызовов агента вместо 550. В математических задачах результат смешанный: в задаче сумм и разностей 1,145427 против 1,143975 у SimpleTES, в упаковке кругов ничья, в неравенстве автокорреляции результат хуже собственной базы. В третьей серии агент ускорял операции нейросетей на видеокарте из набора KernelBench. Для сети VGG16 и слоя нормализации LayerNorm Dream-RSI достиг той же скорости, что и база, за в 2,43 и 1,79 раза меньшее число попыток. Для двух связок свёртки с делением и с выбором максимума он при том же числе попыток нашёл код быстрее базового в 2,09 и 1,44 раза. Пока доступны только статья и страница проекта с интерактивной демонстрацией. Код и скрипты для воспроизведения Google обещает выложить позже. 🟡Страница проекта 🟡Техотчет 🟡Демо 🖥GitHub @ai_machinelearning_big_data #AI #ML #RSI #Agents #DreamRSI #Google
Open in Telegram
📌 Dream-RSI: агент улучшает стратегию поиска решений на основе прошлых запусков
Views16,479+2%vs avg
Forwards332
Reactions110
Comments0
Views growth
Hours after publication
Show as table
| Hours after publication | Views |
|---|---|
| 0 h | 0 |
| 8 h | 12,160 |
| 18 h | 14,939 |
| 30 h | 16,479 |
- After 6 hours12,160
- After 24 hours16,479
- Total to date16,479
Links and mentions
Reactions
- 🤔52
- 👍20
- ❤15
- 🤷♂11
- 👏9
- 💯2
- 👨💻1
More from Machinelearning
- 01Views27.9KForwards463Reactions197Comments100
- 02Views23.9KForwards236Reactions154Comments4
- 03Views23.8KForwards303Reactions130Comments13
- 04Views21.9KForwards257Reactions303Comments10
- 05Views21.1KForwards207Reactions165Comments13