#открытые веса

Б безопасность ·19 авг 2026

OpenAI остановила обучение Astra — модель научилась взламывать системы сама

OpenAI впервые полностью остановила тренировку своей самой мощной модели Astra — внутренние тесты показали, что она может находить и эксплуатировать 0-day уязвимости без помощи человека. В то же время китайская Z.ai готовится выложить в открытый доступ модель GLM-5.3 с похожими способностями. Пауза работает, но только у одной стороны.

0 27
И инструменты ·9 авг 2026

NVIDIA выпустила NemotronLabs VoiceChat 11B: открытая модель голосовых разговоров с задержкой 450 мс и вызовом инструментов на ходу

NVIDIA открыла 11B-модель для голосовых диалогов в реальном времени с задержкой переключения реплик 448 мс. Вместо связки распознавание-LLM-синтез работает одна сеть, поддерживает прерывания пользователя и вызов API-инструментов прямо во время разговора. Модель бесплатна, но пока помечена research-only из-за реальных багов: рушится через несколько реплик, забывает слова, зацикливается. Требует одну GPU с 80 ГБ памяти, облачного API нет.

0 93
М модели ·3 авг 2026

Китайская MiniMax H3 — первая открытая модель на вершине рейтинга AI-видео

MiniMax выложила веса видеомодели H3 (33 млрд параметров) — впервые открытая модель возглавила рейтинг Artificial Analysis по Video Editing. Модель генерит 4-15-секундные ролики со стереозвуком из текста, картинок, видео и аудио. Но 2K-модуль и препроцессор промптов остались закрытыми, локально работает до 768p. Коммерческое использование — только для компаний с выручкой до $20 млн.

0 94
М модели ·7 авг 2026

Liquid AI выпустила LFM2.5-2.6B: агентная модель на 2.7 млрд параметров, которая работает локально с контекстом 128К и вызовом функций

Liquid AI представила LFM2.5-2.6B — компактную агентную модель (2.7 млрд параметров), которая запускается локально на смартфонах, ноутбуках и роботах. Модель поддерживает контекст 128К токенов, вызов инструментов и многошаговые задачи. Веса открыты, доступны в форматах GGUF, MLX, ONNX. По бенчмаркам следования инструкциям обгоняет модели вчетверо крупнее.

0 47
И исследования ·24 июл 2026

Битва диффузии и авторегрессии: первое честное сравнение показывает узкую нишу, а не революцию

Лаборатория впервые напрямую сравнила свои диффузионную и авторегрессионную модели одинакового размера. Результат: диффузионная LLaDA2.2 проигрывает на общих знаниях и коде, выигрывает только на агентных задачах с множественными обращениями, зато в 1.6-2.3 раза быстрее. Это не смена парадигмы, а решение для узкой ниши — циклов агентов, где важна скорость декодирования.

0 115
М модели ·30 июл 2026

Kimi K3: слишком велик, чтобы запустить

Автор провёл практический тест Kimi K3 — крупнейшей открытой модели с 2,8 трлн параметров и контекстом на 1 млн токенов. После 11 часов настройки кластера из 4×H100 и 594 ГБ весов выяснилось, что модель в 21 из 41 теста давала неверные ответы, включая полностью выдуманные данные при работе с длинным контекстом.

0 74
И инструменты ·27 июл 2026

Ling-3.0-flash: обещания поддержки vs реальность — вес-файлы задерживаются, llama.cpp даже не планирует

Ant Group анонсировала Ling-3.0-flash, но вес-файлы ещё не открыты. SGLang обещает поддержку «в день релиза», vLLM ждёт публикации весов, а llama.cpp закрыл запрос на поддержку предыдущей версии (Ling-2.6) как «не планируется». Судя по паттерну предыдущих релизов, веса появятся после окончания бесплатного доступа к API — примерно 3 августа.

0 98
И исследования ·21 июл 2026

Что на самом деле означает «открытые веса» в AI

Статья объясняет разницу между «open weight» и «open source» моделями. Когда компания публикует открытые веса, вы получаете готовый файл с миллиардами настроенных параметров модели, которые можно скачать и запускать локально, но не рецепт её создания — обучающие данные и точный процесс обучения обычно остаются закрытыми.

0 122