#guardrails

Б безопасность ·25 июл 2026

Практические примеры промпт-инъекций: взлом LLM-приложений

Автор исследует уязвимости AI-приложений через практические упражнения Secure Code Game (Season 3). Каждый уровень — это CTF-задача, где нужно заставить LLM-чатбот выдать скрытый флаг, обходя защитные инструкции в системном промпте. Статья показывает, как простые манипуляции с запросами раскрывают конфиденциальные данные даже при наличии guardrails.

0 130
Б безопасность ·24 июл 2026

Защита AI-моделей превратилась в головную боль для white-hat хакеров

Ограничения (guardrails) в AI-моделях OpenAI и Anthropic, призванные не дать злоумышленникам создавать кибероружие, теперь мешают работе легальных специалистов по безопасности. Исследователи жалуются, что модели отказываются помогать анализировать уязвимости и тестировать эксплойты — то есть делать то, ради чего их и используют защитники сетей.

0 117