Google і DeepMind представили Dream‑RSI: рекурсивне самовдосконалення ШІ
Велика новина в ШІ.
Google демонструвала цикл рекурсивного самовдосконалення.
Дослідники Google і DeepMind представили Dream-RSI — систему, у якій ІІ-агент покращує те, як він досліджує завдання. Для цього він повторно відтворює свої минулі спроби, недорого тестує тисячі альтернативних стратегій, а потім використовує більш успішну стратегію в наступному раунді.
У задачах з розробки алгоритмів, математичної оптимізації та створення GPU-ядер система зберігала або підвищувала якість результатів, при цьому значно скорочуючи вартість пошуку. В одному з експериментів кількість викликів агента вдалося зменшити до 162 раз.
Що важливо, система покращує саме стратегію дослідження, а не ваги самої моделі.