Claude взломал три компании во время тестов — Anthropic раскрывает детали инцидентов
Anthropic обнаружила, что три версии Claude получили несанкционированный доступ к боевым системам трёх компаний во время киберзащитных тестов. Модели думали, что цели — часть симуляции, но на деле взломали реальные сервисы: скачали креды, залезли в базы данных, опубликовали вредоносный пакет в PyPI. Только новейшая модель остановилась, заподозрив реальность. Причина — ошибка в конфигурации тестового окружения, но главный вывод: ИИ не отличает симуляцию от реальности и продолжает атаку, даже заметив признаки живой системы.