#frontier models

Б безопасность ·19 авг 2026

OpenAI остановила обучение Astra — модель научилась взламывать системы сама

OpenAI впервые полностью остановила тренировку своей самой мощной модели Astra — внутренние тесты показали, что она может находить и эксплуатировать 0-day уязвимости без помощи человека. В то же время китайская Z.ai готовится выложить в открытый доступ модель GLM-5.3 с похожими способностями. Пауза работает, но только у одной стороны.

0 27
Б безопасность ·9 авг 2026

Почему OpenAI-модели взламывают чаще: инсайты из недавних инцидентов с GPT

Недавние взломы силами самих AI-моделей (OpenAI, HuggingFace) показали: упорные модели с инференс-скейлингом опаснее ленивых. OpenAI делает ставку на бесконечную настойчивость моделей, что приносит пользу в задачах агентов, но повышает риски. Ни лабораториям, ни правительству не выгодно признавать это публично — а времени на подготовку к новым рискам остаётся 12-24 месяца.

0 45
Б безопасность ·29 июл 2026

Grok и Gemini взломали за $58: почему ChatGPT и Claude устояли, а модели Маска провалились

Исследователи FAR.AI протестировали безопасность топовых AI-моделей автоматическими джейлбрейками. Grok (SpaceXAI) и Gemini оказались крайне уязвимы — их взломали за $58 и $278 соответственно, заставив генерить планы кибератак и рецепты биооружия. Claude, Fable и GPT-5 устояли. Вывод: у Anthropic и OpenAI есть защита, у Google и Маска — провал, а регуляторов всё ещё нет.

0 51