Популярное за неделю

И инструменты ·29 июл 2026

Агентные системы: использование инструментов, планирование и многошаговые рассуждения

Агентные LLM-системы отличаются от обычных RAG-пайплайнов тем, что не выполняют фиксированную последовательность шагов, а сами принимают решения о следующем действии в цикле: рассуждение → выбор инструмента → выполнение → наблюдение результата → новое рассуждение. Статья разбирает архитектуру таких систем и инженерные решения для их надёжной работы в продакшене.

0 101
И инструменты ·5 авг 2026

PRISM2: AI-модель читает стёкла как патологоанатом — диалог вместо классификации

Paige и Microsoft выпустили PRISM2 — модель, которая анализирует гистологические препараты (whole-slide images) не просто классифицируя пиксели, а отвечая на диагностические вопросы текстом, как это делает врач. Обучена на 2,3 млн снимков и 685 тыс. отчётов, показывает точность на уровне клинических продуктов для рака груди и простаты.

0 42
Б бизнес ·8 авг 2026

Математика замены человека на AI не сходится: взгляд из реальной клиники физиотерапии

Физиотерапевт разобрал реальную экономику внедрения роботов в клиниках: оборудование от $100k+, обслуживание, страховки, а робот не заменяет специалиста — только помогает. Человек обходится дешевле. Вопрос открыт: где реальная точка окупаемости AI, кроме производства с высоким объёмом повторяющихся задач.

0 24
И инструменты ·6 авг 2026

AWS запустил гибкие лимиты запросов для AI-трафика в AgentCore gateway

Amazon Bedrock AgentCore gateway теперь умеет ограничивать AI-трафик на уровне пользователей: запросы в минуту, токены, одновременные соединения. Можно раздавать разные лимиты разным группам (Basic/Advanced/Beta) через JWT или IAM, защищая модели и инструменты от перегрузок и контролируя расходы.

0 38
И исследования ·5 авг 2026

Видео Bad Apple в нейросети на 3 МБ: как уместить 2,7 млрд пикселей в 790к параметров

Разработчик сжал классическую анимацию Bad Apple (6524 кадра, 854×480) в нейросеть весом 3,2 МБ. Вместо хранения кадров MLP с SIREN-активациями принимает координаты (время, x, y) и генерирует пиксель на лету. После доработок (time-stretch и выборка по движению) MSE упала в 9 раз — статичные кадры стали точнее в 15 раз, динамичные в 3,6 раза.

0 52
И инструменты ·30 июл 2026

Surya-2 против GOT-OCR 2.0: сравнение двух компактных OCR-моделей на обычном ноутбуке

Автор протестировал две небольшие (~600M параметров) open-source OCR-модели на своём ноутбуке с RTX 4070. Обе можно запускать локально, но они решают противоположные задачи: GOT-OCR устанавливается за пять строк кода и возвращает чистый текст, а Surya-2 требует настройки сервера, зато выдаёт структурированный документ с типизированными блоками и координатами.

0 91
И инструменты ·27 июл 2026

Speculative decoding на Qwen3.6-27B: чем тяжелее квантизация, тем выше прирост скорости

Бенчмарк speculative decoding на Qwen3.6-27B показал парадоксальный результат: чем меньше сжата модель (Q8 против Q4), тем больший прирост даёт спекулятивная генерация. DFlash — самый быстрый алгоритм в общем случае, MTP — стабильная альтернатива, EAGLE3 и ngram проигрывают. Результаты справедливы для узкого сценария (короткие выходы, один поток), под нагрузкой выигрыш сожмётся.

0 117
И инструменты ·26 июл 2026

Рынок AI-инференса: технический разбор и сравнение провайдеров

Автор раскладывает по полочкам экономику и технологию облачного инференса LLM. Объясняет, почему выходные токены дороже входных, как батчинг снижает затраты в 4 раза, и почему сравнивать цены за токен и за GPU-час бессмысленно без учёта утилизации. Приводит конкретные цифры: кто сколько привлёк, кто как быстро растёт, и какие технические трюки применяет.

0 119
Б бизнес ·4 авг 2026

Техас останавливает новые датацентры: губернатор требует аудиты на фоне энергетического коллапса

Губернатор Техаса Грег Эбботт заморозил все новые проекты датацентров до аудита регуляторами. Очередь на подключение к энергосети выросла с 233 до 474 гигаватт за полгода — это в 5 раз больше пикового потребления штата. 90% заявок — дата-центры Google, Microsoft и крипто-майнеров. Цены на электричество растут, сеть перегружена. Техас, долго считавшийся раем для AI-инфраструктуры, может закрыться.

0 42
И исследования ·31 июл 2026

Дерево решений как метафора оптимизации политики в LLM

Автор объясняет, как работает пост-тренинг больших языковых моделей через обучение с подкреплением (RL), используя наглядную аналогию с деревом решений. Статья показывает, как модель учится перераспределять вероятности между токенами, чтобы максимизировать ожидаемую награду, и почему алгоритмы TRPO и PPO обновляют политику небольшими шагами.

0 101