#методология оценки

И исследования ·21 июл 2026

Физическая награда — это не физический движок

Обучение видеомодели предпочитать физически правдоподобные результаты через систему наград — это не то же самое, что встроенный симулятор физики. LingBot-Video использует награды за физическую рациональность, но не имеет явных параметров массы, трения или столкновений — модель просто учится закономерностям из данных.

0 112
И исследования ·15 июл 2026

Воспроизводимость начинается до запуска первого промпта

Автор объясняет, почему результаты оценки языковых моделей часто невозможно воспроизвести: ключевые решения принимаются ещё до тестирования. Две команды с одним и тем же вопросом к одной модели могут получить разные результаты из-за различий в версиях модели, системных промптах, параметрах, окружении и методике скоринга.

0 186