#видеогенерация

И инструменты ·21 авг 2026

Sparse Attention для Minimax H3: до 70% экономии памяти и 2x ускорение генерации видео

Разработчик Zironic представил оптимизированную реализацию Sparse Attention для Minimax H3 с гибким контролем плотности внимания (10-50%), INT8/FP8 квантизацией и снижением пикового потребления памяти до 70%. В отличие от других патчей, работает только с видеотокенами и интегрируется с Comfy Kitchen напрямую.

0 85
И инструменты ·15 авг 2026

ComfyUI-нода для MiniMax H3: генерация длинных видео с автокоррекцией швов и кешированием

Разработчик создал кастомную ноду для ComfyUI, которая позволяет генерировать длинные видео через MiniMax H3 без построения огромных воркфлоу. Ключевые фичи: последовательная генерация клипов с Motion Context, два режима работы (покадровый и батчевый), дисковый кеш, автоматическая коррекция швов между клипами и сохранение состояния после перезапуска.

0 105
И инструменты ·15 авг 2026

MiniMax H3 Creator: апдейт превратил три ноды в одну, добавил пресеты и исправление лиц

Пак нод для ComfyUI под модель MiniMax H3 получил крупное обновление: три ноды слились в одну с переключением режимов, появились сохраняемые пресеты (в том числе из готовых рендеров), встроенное улучшение лиц через SAM3, новые настройки сэмплинга и фиксы багов. Всё это упрощает работу с видеомоделью H3 внутри ComfyUI.

0 99
И инструменты ·12 авг 2026

Создатель Heretic объяснил, почему его инструмент не работает для обхода цензуры в видеомоделях

Автор популярного инструмента Heretic для разцензуривания LLM публично заявил: использование heretic-моделей как текстовых энкодеров в видеогенераторах (типа Minimax H3) не снимает цензуру, а может ухудшить качество. Heretic меняет внутренние представления моделей через направленную абляцию, но это не делает промпты более детальными для диффузионных моделей.

0 78
И инструменты ·10 авг 2026

Уменьшили текстовый энкодер MiniMax H3 в 8 раз: с 32B до 4B без потери качества видео

Энтузиаст заменил 32-миллиардный текстовый энкодер MiniMax H3 (занимает 15.7 GB) на компактный Qwen3-VL 4B/8B с обучаемым проектором. Результат: видео и голос почти неотличимы от оригинала, но требуется в разы меньше памяти и быстрее генерация.

0 64
И инструменты ·9 авг 2026

Как снизить VRAM для MiniMax H3 с 15.7 до 4.5 ГБ без потери качества

Энтузиаст заменил 32B CLIP-энкодер MiniMax H3 на 4B-модель Qwen3-VL с линейной проекцией. VRAM упал с 15.7 до 4.5 ГБ, а генерация работает почти так же. Метод: ridge regression для обучения проекции между скрытыми состояниями моделей с общим токенизатором. Код открыт, работает в ComfyUI.

0 65
И исследования ·27 июл 2026

Видеогенераторы назвали world models, но проверяют их по принципу «нравится — не нравится»

Термин «world model» незаметно сменил значение: раньше так называли системы, понимающие физику мира, теперь — любой видеогенератор с хорошим маркетингом. Вендоры вроде Black Forest Labs публикуют внутренние тесты предпочтений (77% пользователей выбрали наше видео против Runway), но эти цифры невоспроизводимы, непроверяемы и ничего не говорят о реальном понимании физики. Когда такие модели подключат к роботам или беспилотникам, процент «красивых» видео не предскажет, как система поведёт себя в реальности.

0 116
И исследования ·6 авг 2026

Round-Trip Consistency: как диффузионные модели сами находят свои ошибки без ground truth

Исследователи научили диффузионную модель ходить вперёд и назад во времени, используя один флаг направления. Прогнав последовательность вперёд, а затем обратно, модель должна вернуться к началу — расхождение показывает накопленную ошибку без необходимости в эталонных данных, ансамблях или физических уравнениях. Бонус: одна двунаправленная сеть работает лучше двух специализированных.

0 36
И исследования ·21 июл 2026

Физическая награда — это не физический движок

Обучение видеомодели предпочитать физически правдоподобные результаты через систему наград — это не то же самое, что встроенный симулятор физики. LingBot-Video использует награды за физическую рациональность, но не имеет явных параметров массы, трения или столкновений — модель просто учится закономерностям из данных.

0 114
М модели ·25 июл 2026

Open Dreamer: полная открытая реализация Dreamer 4 с рецептом обучения мировых моделей

Команда Reactor выложила полный код Dreamer 4 — системы, которая строит виртуальную модель игрового мира и умеет генерировать кадры игры, предсказывая физику и действия. Вместо закрытого исследования Google — рабочий пайплайн на JAX с конфигами, демо в браузере и честным разбором проблем обучения.

0 62