безопасность 1 мин

OpenAI остановила обучение Astra — модель научилась взламывать системы сама

OpenAI впервые полностью остановила тренировку своей самой мощной модели Astra — внутренние тесты показали, что она может находить и эксплуатировать 0-day уязвимости без помощи человека. В то же время китайская Z.ai готовится выложить в открытый доступ модель GLM-5.3 с похожими способностями. Пауза работает, но только у одной стороны.

Впервые видим реальный разрыв между ответственной разработкой и открытым доступом к мощным моделям. Это меняет правила игры в кибербезопасности и ставит вопрос: работают ли voluntary frameworks, если не все их придерживаются.

OpenAI остановила обучение Astra — следующей флагманской модели — после того, как внутренние тесты показали способность находить и использовать 0-day уязвимости в защищённых системах без участия человека. По собственному Preparedness Framework компании это критический уровень риска, при котором разработка прекращается. Сэм Альтман публично подтвердил паузу, дата возобновления неизвестна.

Это первый случай, когда фронтирная лаборатория остановила развитие модели из-за её способностей, а не внешнего давления или регуляций.

Параллельно китайская Z.ai анонсировала GLM-5.3 — модель, набравшую 84.5% на CyberGym, бенчмарке по поиску и эксплуатации известных уязвимостей. Она обошла несколько западных моделей с ограниченным доступом. Веса модели станут публичными в ближайшие недели — любой сможет скачать и запустить локально без мониторинга.

В ту же неделю Microsoft закрыла CoSnitch — уязвимость Copilot, о которой им сообщили 8 месяцев назад. Один клик по легитимной ссылке microsoft.com позволял тихо выгрузить почту, календарь, файлы SharePoint. Третья серьёзная дыра в Copilot от той же команды исследователей за год.

Автор: Елена Верещагина · Источник: reddit.com

Разработчикам. Появление моделей, автоматически находящих 0-day, радикально меняет landscape безопасности. GLM-5.3 в открытом доступе означает, что защита через секретность больше не работает — нужны новые подходы к архитектуре систем и мониторингу. Copilot с тремя серьёзными дырами за год показывает, что AI-ассистенты расширяют attack surface быстрее, чем его закрывают.

Бизнесу. Дисбаланс между ответственной разработкой и открытым доступом к мощным моделям создаёт новые риски для корпоративной безопасности. Компаниям нужно срочно пересматривать threat model и инвестировать в AI-based защиту — атакующие получают те же инструменты, но без ограничений. История с Copilot показывает, что даже крупные вендоры не успевают за темпом.

Инвесторам. Рынок кибербезопасности ($200+ млрд) ждёт резкий всплеск — модели с автопоиском уязвимостей меняют правила игры. Растут секторы автоматизированной защиты, AI-driven threat detection, secure-by-design инфраструктуры. Открытые веса создают новый спрос на решения, работающие в условиях доступности мощных атакующих моделей.

Хайп15
Реальная польза85
Заработать75
  • AI-powered защита для компаний: автоматический поиск своих уязвимостей быстрее атакующих, continuous security testing на основе тех же моделей
  • Платформы для тестирования безопасности AI-систем: specialised sandboxes, adversarial testing, red team as a service с AI-моделями
  • Консалтинг по переходу к zero-trust архитектуре и secure AI deployment — спрос резко вырастет в ближайшие месяцы
  • Инструменты мониторинга для открытых моделей: tracking использования, детекция malicious fine-tuning, compliance для компаний
  • Специализированные дистрибутивы защищённых систем и sandbox-решения для безопасного запуска мощных моделей локально
  • Открытые веса мощных моделей делают паузы одних лабораторий бессмысленными — asymmetric advantage исчезает
  • Скорость патчинга (8 месяцев на Copilot) не успевает за скоростью обнаружения — AI найдёт быстрее, чем закроют
  • Переоценка способности регулировать через voluntary frameworks — если одна сторона играет по правилам, а другая нет, система не работает
  • Escalation race в кибербезопасности: модели становятся доступнее, атаки сложнее, порог входа для серьёзных атак падает

Это первый настоящий стресс-тест для идеи добровольной саморегуляции AI-лабораторий. OpenAI следует собственному Preparedness Framework — модель достигла критического порога, обучение остановлено. Звучит ответственно, пока не вспомнишь, что через пару недель любой сможет скачать китайскую GLM-5.3 с похожими способностями и запустить у себя без ограничений.

Реальная проблема не в том, что модели научились искать 0-day (это было неизбежно), а в том, что защита через ограничение доступа больше не работает. История с Copilot — три серьёзные уязвимости за год, патчинг по 8 месяцев — показывает, что даже крупные компании не готовы к миру, где AI ищет дыры быстрее, чем их закрывают. Voluntary frameworks работают, только если все играют по одним правилам. Сейчас не все.

Ещё по теме

Комментарии