Я сомневаюсь, что даже с помощью ИИ китайские исследователи написали работу именно в ответ на шоу “давайте затормозим ИИ — а Трамп не согласится”.
Но честно скажу, что пользы о чтения этой работы с очень говорящим названием The Last AI Built by Humans: Toward Genuine Recursive Self-Improvement куда больше, чем от отслеживания и попыток интерпретации медийно-политической волны, поднятой Амодеи с компанией. И это китайское исследование удивительно попадает в контекст!
Представлено очень полезное структурирование реально происходящего с (само)улучшением моделей — и оно совсем не случайно сильно смахивает на давно официально принятую классификацию автономности автомобилей SAE J3016 (там формально 6 уровней: от L0 до L5, но 0 — это отсутствие автономности).
L1 — execution: Исполнение заданного людьми улучшения
L2 — strategy: Выбор стратегии улучшения в заданных рамках
L3 — experience acquisition: Выбор того, какие данные, задачи и опыт добывать дальше
L4 — environment adaptation: Закрепление изменений от собственного опыта реального использования: память, навыки, код, harness
L5 — recursive meta-improvement: Перестройка самого механизма улучшения: поиска, оценивания, исследовательской политики и способов создавать преемников
Настоящая автономность (как раз та, которой нас пугают) только на L5: на L5 объектом оптимизации становится уже не только модель, а процедура, которая генерирует следующие улучшения. Это и есть честная рекурсия, а не просто агент, который умеет переписывать свой промпт.
Так вот, авторы вполне основательно показывают, что нынешний фронтир реально находится на L1-L2, в исследовательских прототипах встречаются отдельные элементы L3-L4. Так что от сегодняшних петель обратной связи с участием человека еще надо добраться до реальной автономии улучшения.
https://arxiv.org/pdf/2609.11873
Но честно скажу, что пользы о чтения этой работы с очень говорящим названием The Last AI Built by Humans: Toward Genuine Recursive Self-Improvement куда больше, чем от отслеживания и попыток интерпретации медийно-политической волны, поднятой Амодеи с компанией. И это китайское исследование удивительно попадает в контекст!
Представлено очень полезное структурирование реально происходящего с (само)улучшением моделей — и оно совсем не случайно сильно смахивает на давно официально принятую классификацию автономности автомобилей SAE J3016 (там формально 6 уровней: от L0 до L5, но 0 — это отсутствие автономности).
L1 — execution: Исполнение заданного людьми улучшения
L2 — strategy: Выбор стратегии улучшения в заданных рамках
L3 — experience acquisition: Выбор того, какие данные, задачи и опыт добывать дальше
L4 — environment adaptation: Закрепление изменений от собственного опыта реального использования: память, навыки, код, harness
L5 — recursive meta-improvement: Перестройка самого механизма улучшения: поиска, оценивания, исследовательской политики и способов создавать преемников
Настоящая автономность (как раз та, которой нас пугают) только на L5: на L5 объектом оптимизации становится уже не только модель, а процедура, которая генерирует следующие улучшения. Это и есть честная рекурсия, а не просто агент, который умеет переписывать свой промпт.
Так вот, авторы вполне основательно показывают, что нынешний фронтир реально находится на L1-L2, в исследовательских прототипах встречаются отдельные элементы L3-L4. Так что от сегодняшних петель обратной связи с участием человека еще надо добраться до реальной автономии улучшения.
TL;DR Like human evolution, AI evolution will unfold through a vast and extraordinary history. Everything AI has achieved so far is but a drop in the ocean.
https://arxiv.org/pdf/2609.11873
❤28👍26👏3