🤗 Каталог AI-моделей

Открытые модели с Hugging Face: задача, популярность, чем интересна и как запустить из России. Пополняется автоматически по трендам.

Qwen3.8-27B NEW

Мультимодальная (VLM)♥ 10 463↓ 415 039

Эта многомодальная модель умеет анализировать изображения и текст одновременно, что полезно разработчикам приложений для описания фото, ответов на вопросы о картинках и создания подписей к визуальному контенту.

Kimi-K3

Мультимодальная (VLM)♥ 10 424↓ 1 510 032

Модель способна анализировать изображения вместе с текстовым контекстом и генерировать развернутые ответы, что будет полезно копирайтерам, дизайнерам и исследователям, нуждающимся в глубоком понимании визуального контента.

GLM-5.2

Генерация текста♥ 4 493↓ 1 003 547

Эта модель интересна продвинутыми способностями к генерации текста на китайском и английском языках, поэтому пригодится разработчикам приложений для работы с китайским контентом и исследователям многоязычных систем.

MiniMax-H3 NEW

image-text-to-video♥ 4 053↓ 2 403 238

Эта модель генерирует видео из текста и изображений, поэтому она полезна для создателей контента, маркетологов и режиссёров, которым нужно быстро превращать идеи в движущиеся сцены без съёмок.

Unlimited-OCR

Мультимодальная (VLM)♥ 3 804↓ 2 601 062

Эта модель распознаёт текст на изображениях без ограничений по размеру и языкам, что полезно тем, кто работает с документами, скриншотами и архивами на разных языках мира.

DeepSeek-V4-Flash-0731

Генерация текста♥ 2 985↓ 954 441

Эта модель интересна ультрабыстрой генерацией текста с сохранением качества — пригодится разработчикам, создающим приложения с реал-тайм ответами, и компаниям, которым нужен экономный способ обработки больших объёмов текста.

Qwythos-9B-Claude-Mythos-5-1M-GGUF

Мультимодальная (VLM)♥ 2 356↓ 2 117 323

Эта модель нужна тем, кто хочет анализировать картинки и текст одновременно без отправки данных на сервер — работает локально и способна понимать визуальный контент так же естественно, как человек.

Qwen3.6-27B-Fable-Fusion-711-Uncensored-Heretic-NM-DAU-NEO-MAX-MTP-GGUF

Мультимодальная (VLM)♥ 1 829↓ 2 439 083

Эта модель полезна дизайнерам и маркетологам, которым нужно быстро генерировать описания и комментарии к изображениям без цензурных ограничений, работая с визуальным контентом прямо в локальной среде.

Muse-Glimmer-30B NEW

Мультимодальная (VLM)♥ 1 640↓ 334 099

Эта модель генерирует текст из изображений и текстовых подсказок, поэтому пригодится разработчикам приложений для автоматического описания фото, создания подписей в соцсетях и поиска по картинкам.

Inkling

Мультимодальная (VLM)♥ 1 584↓ 36 196

Эта модель анализирует изображения вместе с текстовыми подсказками и генерирует ответы, что полезно дизайнерам, маркетологам и разработчикам приложений, которым нужна гибкая система для работы с визуальным контентом.

Qwen3.8-27B-GGUF NEW

Прочее♥ 1 524↓ 2 727 609

Это мощная языковая модель, сжатая в эффективный формат GGUF, которая пригодится разработчикам и энтузиастам для локального запуска продвинутого ИИ на скромном железе без облачных сервисов.

MiniMax-H3

Прочее♥ 1 102↓ 6 009 639

Эта компактная модель пригодится разработчикам, которым нужна быстрая работа с текстом на устройствах с ограниченными ресурсами, не теряя в качестве обработки естественного языка.

LTX-2.5 NEW

Изображение → видео♥ 1 050↓ 465 529

Эта модель генерирует плавные видео из неподвижных изображений, что пригодится блогерам, создателям контента и студийцам, которые хотят оживлять фотографии без навыков видеомонтажа.

Qwen3.8-2.4T-A95B NEW

Генерация текста♥ 1 019↓ 9 465

Это огромная многоязычная модель с 95 миллиардами параметров, которая отлично работает с русским текстом и пригодится компаниям, разрабатывающим чат-боты, системы анализа документов и контент-генерации на нескольких языках одновременно.

MiniMax-Music3 NEW

Генерация аудио♥ 866↓ 10 375

Эта модель генерирует музыку из текстового описания, что пригодится композиторам, видеомонтажёрам и разработчикам игр, которым нужна быстрая и дешёвая замена живого оркестра.

Hy3

Генерация текста♥ 811↓ 11 849

Эта модель интересна тем, что обучена на гибридной архитектуре с эффективностью трансформера и способностью обрабатывать длинные тексты, что пригодится разработчикам, которым нужен компактный и быстрый генератор текста для мобильных приложений и граничных устройств.

Ternary-Bonsai-27B-gguf

Генерация текста♥ 810↓ 338 945

Эта модель интересна сверхоптимизированным размером (27 млрд параметров в тройичной системе вместо обычной двоичной) и пригодится разработчикам, которым нужна мощная генерация текста на устройствах с ограниченной памятью.

Laguna-S-2.1

Генерация текста♥ 712↓ 63 605

Компактная языковая модель специально оптимизирована для быстрой генерации текстов на русском языке и пригодится разработчикам, которым нужна лёгкая альтернатива тяжёлым моделям для локального запуска на слабых устройствах.

Solar-Open2-250B

Генерация текста♥ 611↓ 3 761

Это огромная языковая модель с 250 миллиардами параметров, которая превосходит аналоги по скорости и качеству при обработке длинных документов, поэтому пригодится исследователям и компаниям, работающим с объёмными текстами и требующими точных ответов в реальном времени.

MiniMax-H3-Turbo-Lora

Текст → видео♥ 572

Эта модель интересна тем, что на основе текстового описания генерирует видео в реальном времени, что оценят создатели контента, блогеры и специалисты по визуальным эффектам, которым нужна быстрая прототипизация идей без дорогостоящего оборудования.

DeepSeek-V4-Pro-0813 NEW

Генерация текста♥ 552↓ 25 006

DeepSeek-V4-Pro — это мощная языковая модель для создания текстов, которая пригодится разработчикам, контент-мейкерам и компаниям, ищущим альтернативу западным моделям с лучшей производительностью и локализацией для русскоязычного контента.

Bonsai-27B-gguf

Генерация текста♥ 515↓ 1 262 894

Это компактная 27-миллиардная модель для генерации текста, которая работает быстро даже на скромном железе, поэтому идеальна для разработчиков и небольших компаний, которые не могут позволить себе гигантские нейросети вроде GPT.

LFM2.5-2.6B

Генерация текста♥ 466↓ 89 680

Это компактная нейросеть для генерации текста на устройствах с ограниченными ресурсами, которая пригодится разработчикам мобильных приложений и стартапам, не имеющим доступа к мощным серверам.

Nanbeige4.2-3B

Генерация текста♥ 456↓ 16 518

Компактная трёхмиллиардная модель Nanbeige 4.2 идеальна для разработчиков, которые хотят встроить генерацию текста прямо на устройства с ограниченными ресурсами, сохраняя приемлемое качество ответов на русском и других языках.

krea2-identity-edit

Прочее♥ 432

Эта модель позволяет менять личность персонажей на изображениях, сохраняя их позы и окружение — пригодится художникам, создателям контента и разработчикам приложений для редактирования портретов.

Qwen3-VL-32B-Ultra-Heretic-H3-ComfyUI-INT8-ConvRot

Мультимодальная (VLM)♥ 426

Эта модель интересна гибридной архитектурой (Qwen3-VL + ComfyUI оптимизация + квантование INT8) для быстрого анализа изображений с текстом на слабых GPU, что пригодится разработчикам локальных приложений компьютерного зрения.

ThinkingCap-Qwen3.6-27B

Мультимодальная (VLM)♥ 389↓ 8 238

Эта модель умеет анализировать изображения и текст одновременно, выстраивая логические цепочки размышлений, поэтому пригодится исследователям, разработчикам и аналитикам, которым нужны глубокие выводы из визуальных данных.

DeepSeek-V4-Flash-0731-GGUF

Прочее♥ 375↓ 69 656

Это оптимизированная версия мощной модели для локального запуска на скромных ресурсах, идеальная для разработчиков и исследователей, которые хотят экспериментировать с продвинутым языковым моделированием без облачных сервисов.

Mage-Flow

Текст → изображение♥ 352↓ 1 691

Эта модель создаёт изображения из текстового описания с особой точностью в передаче деталей и композиции, что полезно дизайнерам, художникам и маркетологам, которым нужна быстрая визуализация идей.

Kimi-K3-GGUF

Мультимодальная (VLM)♥ 270↓ 128 215

Это компактная версия мощной китайской модели Kimi K3, которая понимает текст и изображения одновременно — идеальна для разработчиков, кто ищет локальное решение для анализа картинок с минимальными ресурсами.

OvisOCR2

Мультимодальная (VLM)♥ 201↓ 14 587

Эта модель распознаёт текст и структуру прямо в изображениях, помогая аналитикам, исследователям и разработчикам автоматизировать обработку документов, скриншотов и визуального контента без ручного переписывания.