Как создать синтетический датасет для файнтюна: избегаем шаблонности и максимизируем разнообразие рассуждений
Разработчик предлагает пайплайн для генерации данных на обучение рассуждениям: абстрактные задачи создаются учительской моделью или процедурно, переводятся в естественный язык, решаются формальными верификаторами, и только проверенные примеры попадают в датасет. Цель — избежать главной проблемы синтетики (однообразные шаблоны) и создать качественный корпус для дистилляции в малые открытые модели.