Вся опасность агента — в одном слое. Стройте защиту там
Автор утверждает, что безопасность AI-агентов нужно обеспечивать не улучшением промптов или обучения модели, а жёстким контролем на уровне выполнения tool calls — единственной точке, где текстовые решения модели превращаются в реальные действия. LLM может ошибаться или быть скомпрометирована prompt injection, но если слой исполнения инструментов написан правильно, никакие вредоносные команды не пройдут.
0
124