Почему ваша ML-модель блестяще работает на тестах, но проваливается на реальных данных
Модели машинного обучения часто показывают отличные результаты на тестовых данных, но терпят фиаско в реальном мире из-за скрытых переменных, ложных корреляций и ошибок в данных. Сотни моделей для прогнозирования COVID, например, оказались бесполезными. Статья разбирает типичные ловушки ML и способы их избежать, включая новый REFORMS-чеклист для научных исследований.