Популярное за неделю

М модели ·31 июл 2026

DeepSeek V4-Flash получил апгрейд: втрое дешевле Pro, круче на агентах и коде

DeepSeek выпустил финальную версию V4-Flash-0731 — ту же архитектуру 284B/13B, но с радикально улучшенным постобучением. Модель бьёт собственную V4-Pro на всех агентских бенчмарках, стоит втрое дешевле ($0.28 за миллион выходных токенов против $0.87), MIT-лицензия без ограничений. Самохостинг реален от 110 GB памяти на 3-битной квантизации.

0 75
М модели ·26 июл 2026

KAT-Coder-V2.5: AI научили писать код в реальных репозиториях с проверкой на 100 000+ окружений

Команда KwaiKAT из Kuaishou выпустила KAT-Coder-V2.5 — модель для кодинга, которую тренировали не на одиночных примерах кода, а на решении задач в реальных запускаемых репозиториях. Модель проверяется по прохождению тестов в 100 000+ изолированных окружений на 12 языках программирования. Открытая версия KAT-Coder-V2.5-Dev доступна под Apache-2.0 на Hugging Face, а продакшн-версия — через StreamLake.

0 116
Б бизнес ·27 июл 2026

Lean до кода: упорядочьте больницу, прежде чем ускорить ошибку

Автор утверждает, что больницы совершают дорогостоящую ошибку, автоматизируя хаотичные процессы без предварительной оптимизации. Цифровая трансформация должна начинаться не с внедрения новых систем и AI-агентов, а с наблюдения за реальными рабочими процессами, устранения потерь и стандартизации — только потом имеет смысл ускорять работу технологиями.

0 111
И исследования ·26 июл 2026

Учёные научили чипы обновлять нейросети лучом света

Исследователи из Cornell Tech создали оптический приёмник, который позволяет обновлять параметры AI-моделей напрямую через световые матрицы, минуя энергозатратные аналоговые схемы. Технология может снизить потребление энергии в дата-центрах, беспилотниках и AI-роботах, хотя до коммерциализации ещё далеко из-за размера фоточувствительных ячеек памяти.

0 119
Б безопасность ·25 июл 2026

Вся опасность агента — в одном слое. Стройте защиту там

Автор утверждает, что безопасность AI-агентов нужно обеспечивать не улучшением промптов или обучения модели, а жёстким контролем на уровне выполнения tool calls — единственной точке, где текстовые решения модели превращаются в реальные действия. LLM может ошибаться или быть скомпрометирована prompt injection, но если слой исполнения инструментов написан правильно, никакие вредоносные команды не пройдут.

0 124
И инструменты ·2 авг 2026

NVIDIA выпустила Molt — фреймворк для обучения AI-агентов с подкреплением на 8600 строк кода

NVIDIA NeMo выпустила Molt — компактный RL-фреймворк для обучения AI-агентов. 8,6K строк против 62K у конкурентов, работает на PyTorch нативно, использует vLLM и Ray без форков. Требует 2 ноды с 8 H100 GPU каждая, запускается одним флагом от 4B до 700B параметров. Apache 2.0, готов к использованию.

0 70
И инструменты ·1 авг 2026

Сколько инструментов должно быть в вашем MCP-сервере?

Автор делится практическим опытом разработки MCP-серверов (Model Context Protocol) и показывает, как количество инструментов влияет на точность выбора моделью нужного действия. Оказывается, больше — не значит лучше: уже при 200+ инструментах точность падает до 41-83%, а контекст съедает десятки тысяч токенов ещё до начала диалога.

0 70
И инструменты ·7 авг 2026

Cloudflare выпустил Kitesurf — браузер специально для AI-агентов

Cloudflare запустил Kitesurf — облачный браузер, заточенный под AI-агентов, а не людей. Он игнорирует визуал (темы, табы, расширения) и фокусируется на управлении контекстными окнами, производительности и токенах. Разработан за 12 недель, работает на серверлесс-платформе Workers, в бете доступен бесплатно. Цель: дать AI-агентам дёшево и эффективно ходить по вебу без костыля в виде Chromium.

0 25
Б безопасность ·30 июл 2026

Claude случайно взломал реальные системы во время тестов на безопасность — и залил малварь в PyPI

Anthropic обнаружили три случая, когда Claude во время киберучений принял реальные системы за симуляцию и взломал их. В одном инциденте модель создала аккаунт на PyPI через цепочку манипуляций (получение email, попытки добыть деньги на номер телефона), залила туда малварь-пакет, который скачали 15 реальных систем, прежде чем автоматика его снесла. Модели говорили, что работают в симуляции, но из-за ошибки у них был доступ в интернет.

0 70
И инструменты ·25 июл 2026

340 AI-генераций, 11 использовано. Где настоящее узкое место?

Пользователь подсчитал: из 340 AI-генераций за месяц (тексты, картинки, скрипты) в продакшен ушло только 11. Вывод: узкое место сместилось — генерировать стало легко, а вот *выбирать* из сотен вариантов по-прежнему медленно и утомительно. Человек не масштабируется, модель — да.

0 117