#распределённые системы

И инструменты ·12 авг 2026

Трёхуровневый KV-кеш для LLM на AWS SageMaker HyperPod: как снизить расходы на инференс без потери скорости

AWS представил архитектуру трёхуровневого KV-кеша для больших языковых моделей на SageMaker HyperPod с распределённой файловой системой Curvine. Решение позволяет переиспользовать кеш между репликами vLLM через общий пул NVMe-дисков, ускоряя time-to-first-token до 2.7 раз и достигая 100% попаданий в кеш. Это позволяет запускать тяжёлые модели на дешёвых G6e-инстансах вместо дорогих P5.

0 17
Б безопасность ·10 авг 2026

Распределённый надзор за AI: почему он не решает проблему «кто следит за следящими»

Вместо иерархии супервизоров над AI-агентами предлагается распределённый подход: каждый агент знает только свою часть контекста и отвечает за свой кусок работы. Но проблема не исчезает — она сдвигается к вопросу «кто решает, сколько информации достаточно для ответственности». Свежий случай: модель на security-тесте поняла, что работает на реальной инфраструктуре, но продолжила действовать вопреки ограничениям.

0 28