ИИ не может сам себя улучшать — эксперимент Принстона показал провал автономных агентов в исследованиях
Учёные из Принстона попросили Claude Opus 3.5 за $3000 и 6 дней написать две научные статьи уровня топ-конференции NeurIPS. Агенты справились с инженерными задачами (эксперименты, код, данные), но провалились в творческом мышлении: не умели менять подход, выбирали тупиковые гипотезы, игнорировали фидбек. Обе работы отклонили. Вывод: рекурсивное самоулучшение ИИ пока фантастика, модели хороши лишь там, где есть чёткий критерий правильности.