#edge-inference

И инструменты ·29 июл 2026

SeedVR2-1.4B: upscaler-модель в 6 раз легче ByteDance, которая влезает в 16 ГБ RAM

Энтузиаст дистиллировал 7B-параметровую модель апскейла SeedVR2 ByteDance в 1.4B версию с 6 слоями вместо 36. Результат: 2.7 ГБ на диске вместо 15.3 ГБ, работает в 4.6 ГБ оперативки вместо 14–16 ГБ, в 1.6–5.6× быстрее. Качество близко к учителю на 2×–4× масштабе, на 8× деградирует, но остается юзабельным.

0 89
И инструменты ·29 июл 2026

Как запустить ML-модели на любом железе без CUDA: опыт PostSlate с Vulkan

Команда видеоредактора PostSlate показала, как ncnn с Vulkan-бэкендом решает проблему кросс-платформенного inference на клиентских устройствах. Вместо CUDA (только NVIDIA) они получили 10-кратное ускорение распознавания лиц на любых GPU — от Intel интегрированных до Apple Silicon — без установки дополнительных рантаймов.

0 121