Популярное за неделю

И инструменты ·31 июл 2026

Заявление — это не контроль

MiniMax представила мультимодальную модель H3 с обещаниями длинных роликов, стереозвука и низкой цены. Автор напоминает, что коммерческим командам недостаточно красивых демо — нужна проверка качества вывода, надёжности процесса, прав на данные и реальной стоимости, прежде чем внедрять инструмент в платную работу.

0 57
И инструменты ·26 июл 2026

Самодельный Triton-бэкенд разогнал 10B-модель до 97 tok/s на RTX 5070

Энтузиаст написал специализированный GPU-бэкенд для запуска 1.58-битной Falcon3-10B, добившись 97.5 токенов/сек на RTX 5070 — почти в 10 раз быстрее стандартного Transformers. Использует упакованные тернарные веса, Triton-ядра и CUDA Graph. Код опубликован, автор ищет независимые проверки на других GPU.

0 74
И инструменты ·23 июл 2026

DFlash превратил 118B-модель на двух RTX 5090 в тормоз: как вернуть скорость или забить на спекуляцию

Энтузиаст запустил огромную MoE-модель Laguna S 2.1 (118B параметров, 71 ГБ) на двух RTX 5090 с технологией DFlash speculative decoding — и она замедлила генерацию в 2,5 раза вместо ускорения. Причина: дефолтные настройки llama.cpp заставляли драфтер генерировать слишком много токенов без уверенности, а верификация каждого токена обходилась дорого из-за оффлоада экспертов в CPU RAM. После тюнинга (ограничение длины драфта, порог уверенности 0.6, квантизация драфтера в Q8) скорость выросла с 23 до 64 tok/s — но это всё равно примерно как без драфта (62 tok/s), так что вывод: на такой конфигурации спекулятивная генерация бесполезна.

0 85
М модели ·21 июл 2026

NVIDIA выпустила Cosmos 3 Edge — мировую модель на 4 млрд параметров для роботов без облака

NVIDIA представила Cosmos 3 Edge — компактную 4B-параметровую модель, которая работает локально на GPU и позволяет роботам понимать окружение, предсказывать результаты действий и генерировать команды управления в реальном времени. Модель объединяет два трансформера (для рассуждений и генерации) и поддерживает разные типы роботов — от манипуляторов до гуманоидов.

0 98
М модели ·23 июл 2026

Etched: стартап из троих дропаутов Гарварда собрал $300 млн при оценке $10,3 млрд на чипах для AI

Etched, основанный в 2022 году тремя выпускниками Гарварда, привлёк $300 млн в раунде Series C при оценке $10,3 млрд — удвоив стоимость за 7 месяцев. Стартап создал специализированные чипы для ускорения AI-инференса с низковольтажной технологией и общей памятью между чипами. Уже есть заказы на $1 млрд, а скептики, сомневавшиеся в идее чипов под трансформеры, постепенно замолкают.

0 91
И инструменты ·26 июл 2026

Нейросети для 3D-печати — красиво, но не готово: инженер проверил, как AI превращает картинку в STL

Энтузиаст попытался наладить полностью открытый локальный пайплайн для превращения 2D-изображения в готовую к печати 3D-модель. TRELLIS визуально справился отлично, но выдал геометрически непригодный STL с сотнями дефектов. Итог: модель пришлось пересобирать вручную в Blender примитивами и булевыми операциями — AI пока не заменяет инженера.

0 74
И инструменты ·24 июл 2026

Инженер проверил GPT-5.6 на 70-страничном пакете сварочной документации — и впервые поверил в AI-ассистентов

Инженер поручил GPT-5.6 Thinking High проверить 70-страничный пакет сварочной документации с десятками спецификаций, таблиц и кросс-ссылок. Модель 5 минут думала, а затем выдала детальный разбор каждой спецификации, нашла опечатки в символах переменных, параметры TIG, скопированные в строки SMAW, несуществующие номера документов и расхождения между таблицами — именно те мелкие ошибки, которые проскакивают через человеческие проверки.

0 80
Б бизнес ·30 июл 2026

CoreWeave заходит в закрытые дата-центры Пентагона и разведки США

CoreWeave вместе с оборонным подрядчиком Leidos запускает специализированное AI-облако для американских спецслужб и военных — инфраструктура для тренировки и инференса моделей будет работать внутри центров обработки данных с допуском к секретным материалам. Это первый случай, когда коммерческий AI-провайдер такого масштаба официально заходит в закрытый госсектор.

0 47
И исследования ·23 июл 2026

Долг прозрачности: как недокументированные обновления моделей подрывают доверие

Когда языковая модель обновляется без чёткой фиксации версий, организации теряют возможность отследить, какая именно система проходила оценку. Результаты тестов становятся несопоставимыми, а выводы — ненадёжными. Это создаёт «долг прозрачности»: накопленное бремя необъяснимых изменений, которое разрушает аудируемость и воспроизводимость исследований.

0 86
И инструменты ·3 авг 2026

Как мы исправили тихого убийцу в нашем LLM-кластере на Mac Studio

Команда столкнулась с регулярными падениями распределённого LLM-кластера из пяти Mac Studio (96 ГБ памяти), связанных через Thunderbolt 5. Проблема оказалась многослойной: баг в mlx.launch не убивал удалённые процессы при сбое, orphan-процессы в состоянии Us+ накапливались сотнями и истощали пул RDMA protection domains, что приводило к RuntimeError при инициализации новых задач.

0 30