#эффективность обучения

М модели ·29 июл 2026

LoRA — введение в технологию эффективной дообучения языковых моделей

Статья объясняет технологию LoRA (Low-Rank Adaptation) — метод, позволяющий адаптировать большие языковые модели под конкретные задачи без огромных затрат. Вместо изменения миллиардов параметров модели LoRA обучает лишь крошечный набор дополнительных весов, используя математику низкоранговых матриц.

0 36
И исследования ·15 июл 2026

Почему ИИ проваливает тесты, которые проходит годовалый ребёнок

Исследователи из Meta, Stanford и других университетов создали тест EgoBabyVLM, который показывает видео с камер на головах младенцев современным AI-моделям. Результат: передовые модели провалились, не справившись с тем, что младенцы усваивают легко. Оказалось, что дети учатся из хаотичного потока информации — жестов, взглядов, разговоров о невидимых объектах — используя мультимодальный опыт и минимум данных. Это ставит под вопрос текущую архитектуру ИИ и намекает, что эволюция встроила в мозг что-то, чего нет в трансформерах.

0 158