#генерация изображений

М модели ·21 июл 2026

Qwen-Image-3.0 от Alibaba генерирует многостраничные инфографики и читаемый текст в 10 пикселей за один проход

Alibaba выпустила Qwen-Image-3.0 — генератор изображений, который создаёт сложные макеты с несколькими панелями, читаемым текстом размером до 10 пикселей и поддержкой 12 языков за один запрос. Модель нацелена на практические задачи: газетные полосы, учебные материалы, сложные инфографики с формулами и вложенными интерфейсами.

0 48
И исследования ·15 июл 2026

Apple научила генеративные модели работать с одним слоем адаптации

Исследователи Apple представили FAE — метод адаптации предобученных визуальных энкодеров (DINO, SigLIP) для генерации изображений всего через один слой внимания. Подход достигает state-of-the-art FID 1.48 на ImageNet 256×256 без classifier-free guidance, работает быстрее и проще существующих решений.

0 90