Защитное тестирование AI с Garak: построение устойчивых LLM-приложений против новых угроз
Статья знакомит с Garak — открытым инструментом для автоматизированного red teaming больших языковых моделей. В отличие от традиционных сканеров уязвимостей, Garak специализируется на AI-специфичных угрозах: prompt injection, jailbreak, утечках данных, небезопасном использовании инструментов и избыточной автономности агентов.