#валидация моделей

И инструменты ·14 авг 2026

Oncothresh: open-source библиотека для оценки онкологических AI-моделей в клинических точках принятия решений

Разработчик выпустил Python-библиотеку oncothresh для оценки онкологических AI-моделей не по общим метрикам (AUC, ICC), а в конкретных клинических пороговых точках — где модель решает, назначать биопсию или нет. Включает no-code веб-дашборд для врачей без навыков программирования.

0 26
И исследования ·6 авг 2026

Round-Trip Consistency: как диффузионные модели сами находят свои ошибки без ground truth

Исследователи научили диффузионную модель ходить вперёд и назад во времени, используя один флаг направления. Прогнав последовательность вперёд, а затем обратно, модель должна вернуться к началу — расхождение показывает накопленную ошибку без необходимости в эталонных данных, ансамблях или физических уравнениях. Бонус: одна двунаправленная сеть работает лучше двух специализированных.

0 36
И исследования ·1 авг 2026

VLM-модели врут красиво: высокие оценки на бенчмарках скрывают потерю медицинских терминов и галлюцинации

Исследователи обнаружили, что визуально-языковые модели (VLM) при генерации рентгенологических заключений получают высокие оценки на метриках, но при этом удаляют важные клинические термины и добавляют шаблонные фразы без диагностической ценности. Проблема в том, что существующие метрики оценки поощряют повторяющиеся безопасные формулировки вместо клинически полезных отчётов.

0 49