#файн-тюнинг

М модели ·29 июл 2026

LoRA — введение в технологию эффективной дообучения языковых моделей

Статья объясняет технологию LoRA (Low-Rank Adaptation) — метод, позволяющий адаптировать большие языковые модели под конкретные задачи без огромных затрат. Вместо изменения миллиардов параметров модели LoRA обучает лишь крошечный набор дополнительных весов, используя математику низкоранговых матриц.

0 36
И инструменты ·16 июл 2026

Дефолтный learning rate в QLora — ловушка для малых датасетов

Автор три недели бился с файн-тюнингом на ~7k примерах, пока не понял: дефолтный learning rate 2e-4 из всех туториалов взят из paper'а Alpaca (52k сэмплов) и безбожно переобучает малые датасеты. Переход на 1e-4 + больше эпох мгновенно разблокировал рост eval-метрик.

0 217