безопасность 1 мин

Hugging Face отбил атаку автономного AI-агента с помощью собственного AI

Платформу Hugging Face взломал полностью автономный AI-агент, который провёл многоступенчатую атаку через тысячи действий. Компания обнаружила и разобрала атаку за часы с помощью собственных AI-инструментов, но коммерческие модели с API отказались помогать — их фильтры безопасности заблокировали анализ вредоносного кода. Пришлось использовать open-weight модель на своих серверах.

Это первый публичный случай полностью автономной AI-атаки на крупную платформу. Подтверждает, что эра AI-хакеров наступила, а традиционные методы защиты и даже «безопасные» коммерческие модели могут оказаться бесполезны в критический момент.

AI против AI: Hugging Face отразил автономную кибератаку

Платформа Hugging Face раскрыла детали взлома своей инфраструктуры, который, по их данным, выполнил полностью автономный AI-агент. Атака началась с эксплуатации уязвимостей в обработке датасетов — злонамеренный набор данных использовал удалённое выполнение кода и инъекцию шаблонов.

Далее атакующий агент повысил привилегии, собрал облачные учётные данные и перемещался по внутренним кластерам всё выходные. Система провела более 17 000 отдельных действий через рой короткоживущих песочниц с самомигрирующей командной инфраструктурой.

Коммерческие AI отказались помогать расследованию

Hugging Face обнаружила атаку через AI-систему обнаружения аномалий с LLM-триажом. Но когда команда безопасности попыталась использовать коммерческие модели через API для анализа логов, те заблокировали запросы — фильтры безопасности не смогли отличить исследователя от атакующего.

Анализ требовал обработки большого объёма реальных команд эксплойтов и вредоносных артефактов, что срабатывало все защитные системы. Пришлось развернуть open-weight модель GLM 5.2 на собственной инфраструктуре.

Новая реальность киберугроз

Работа, которая обычно занимает дни, была выполнена за часы: AI-агенты восстановили временную шкалу, извлекли индикаторы компрометации и отделили реальный ущерб от действий-обманок.

Компания подчёркивает: автономные AI-инструменты для атак больше не теория. Они снижают стоимость многоступенчатых кампаний и работают на машинной скорости. Практический вывод для защитников — иметь мощную модель на собственной инфраструктуре до инцидента.

Hugging Face устранила уязвимости, отозвала доступ, пересобрала скомпрометированные узлы и сменила учётные данные. Компания рекомендует всем пользователям обновить токены доступа.

Ключевые выводы

  • Автономные AI-агенты для кибератак вышли из теории в практику — реальная атака включала 17 000+ отдельных действий
  • Фильтры безопасности коммерческих AI-моделей могут блокировать легитимную работу по расследованию инцидентов, не различая защитника и атакующего
  • Open-weight модели на собственной инфраструктуре становятся критичными для кибербезопасности — они не сливают данные атак третьим сторонам
  • AI против AI уже реальность: и атаки, и защита автоматизированы, работают на машинной скорости
  • Платформы обработки данных и AI-моделей — полноценные поверхности атак, требующие нового подхода к защите

Автор: Сергей Ефимов · Источник: the-decoder.com

Мнение редакции

Это тот момент, когда sci-fi превращается в репорт об инциденте. Автономный агент провёл многоступенчатую атаку сам, без человека за консолью — 17 тысяч действий за выходные. Но самое пикантное не это.

Когда команда Hugging Face пыталась разобрать атаку с помощью ChatGPT и Claude, те встали в позу: «Извините, не могу помочь с вредоносным кодом». Системы безопасности коммерческих моделей оказались слишком тупыми, чтобы понять контекст — для них исследователь инцидентов и хакер выглядят одинаково. В итоге спасла открытая модель на своих серверах. Hugging Face делает правильные выводы, но и не скрывает своего интереса — они же крупнейшая площадка open-source моделей. Тем не менее, факт остаётся фактом: если завтра ваша инфраструктура под атакой, надеяться на коммерческие API с их «этичными» фильтрами — так себе план.

Инструменты из статьи

Универсальный AI-ассистент OpenAI: тексты, код, анализ, изображения, голос.

Доступ из РФ →

AI-ассистент Anthropic. Сильнейший в работе с кодом, длинными документами и...

Доступ из РФ →

Ещё по теме

Комментарии