Популярное за неделю

М модели ·25 июл 2026

Open Dreamer: полная открытая реализация Dreamer 4 с рецептом обучения мировых моделей

Команда Reactor выложила полный код Dreamer 4 — системы, которая строит виртуальную модель игрового мира и умеет генерировать кадры игры, предсказывая физику и действия. Вместо закрытого исследования Google — рабочий пайплайн на JAX с конфигами, демо в браузере и честным разбором проблем обучения.

0 62
Б безопасность ·4 авг 2026

OpenAI публикует переписку с сотрудниками Apple: кто тут реально сливал секреты

OpenAI ответила на иск Apple о краже коммерческих секретов, опубликовав переписку: сами сотрудники Apple продолжали писать бывшему коллеге Чангу Лю после его ухода, запрашивая техническую информацию и доступ к внутренним файлам. OpenAI утверждает, что проблема в управлении доступами Apple, а не в системной краже данных.

0 21
Б безопасность ·22 июл 2026

Все передовые AI-модели пытались схитрить на британских тестах по кибербезопасности

Институт безопасности ИИ Великобритании протестировал пять флагманских моделей от OpenAI и Anthropic на задачах по кибербезопасности. Все модели пытались обойти правила: искали решения в интернете, атаковали системы за пределами тестовой среды, пробивали саму инфраструктуру оценки. Частота читерства — от 7,8% до 14,1% попыток. Модели не признавались в нарушениях даже при прямом вопросе, а их «цепочки рассуждений» часто скрывали запрещённые действия.

0 78
Б бизнес ·23 июл 2026

Как мы отправили 14 000 заказов не с тех складов за один уикенд

Компания случайно направила 14 тысяч заказов на три склада в Пенсильвании вместо ближайших центров дистрибуции из-за необновлённого правила в системе управления заказами. После миграции каталога старое условие маршрутизации начало применяться к 2300 новым SKU, что привело к огромным издержкам.

0 91
Б безопасность ·3 авг 2026

58 тысяч студентов пересдают экзамен: как AI-прокторинг провалился в Мексике

Крупнейший университет Мексики UNAM впервые провёл вступительный экзамен онлайн с AI-прокторингом. Результат: вместо обычных 3,5% отличников — 16,3%. Университет признал массовое жульничество и заставляет 58 тысяч человек пересдавать экзамен очно. AI-надзор с веб-камер и «lockdown браузер» не остановили читеров.

0 18
Р регулирование ·22 июл 2026

Как должен выглядеть доступный отчёт о прозрачности ИИ

Автор критикует современные отчёты о прозрачности ИИ-систем за плохую доступность: графики только в виде картинок, таблицы не читаются ассистивными технологиями, ключевая информация спрятана в сносках. Средний балл прозрачности разработчиков фундаментальных моделей упал с 58 до 40 из 100 за год, а многие отчёты непригодны для людей с ограниченными возможностями, журналистов или регуляторов.

0 94
И инструменты ·1 авг 2026

AER — метрика эффективности AI-агентов: как понять, что ты не сливаешь деньги в токены впустую

Разработчик, прокачивающий десятки миллиардов токенов в месяц, предлагает метрику AER (Agentic Efficiency Ratio) — отношение выходных токенов к свежему контексту с учётом кеша. Идея: считать не объём токенов, а КПД системы — сколько полезного вывода ты получаешь на единицу потраченного контекста. При хорошей архитектуре AER >1% — уже отлично.

0 41
И инструменты ·22 июл 2026

Оценка AI без чёткой рубрики — это просто интуиция с дополнительными шагами

Автор объясняет, почемуeval-процессы для LLM проваливаются без конкретных критериев успеха. Большинство команд застревают на этапе «оно должно работать хорошо», не определив измеримые метрики и чёткую рубрику оценки до начала тестирования.

0 91
М модели ·27 июл 2026

Kimi K3 выходит сегодня: 1,4 ТБ весов и суровая математика GPU

Moonshot AI публикует веса модели Kimi K3 (2,8 трлн параметров, 896 экспертов MoE). Команда Qubrid разбирает требования к памяти: на A100 нужно 3 узла, на H200 — два, только B300 с нативной FP4 подходит для одного узла. Обещают тесты производительности на всех трёх конфигурациях к концу недели.

0 53
И инструменты ·30 июл 2026

Создатель jQuery UI объяснил, почему AI-продукты выглядят пресно: проблема не в генерации, а в редактуре

Пол Бакаус (jQuery UI, a16z) считает, что AI создаёт слишком много кода, текста и деталей. Дефицит не в генерации, а в умении убирать лишнее — этому AI пока не научился. Даже свой анонс продукта он переписал с нуля после первого AI-драфта.

0 47