#prompt-injection

Б безопасность ·22 июл 2026

Полевые заметки #1 — Галлюцинации LLM

Исследователь безопасности описывает реальный случай тестирования LLM-системы: сначала он был уверен, что нашёл удалённое выполнение кода (RCE), но затем понял, что модель просто галлюцинирует правдоподобные, но полностью выдуманные результаты. Статья показывает, как недетерминированность LLM создаёт иллюзию успешной эксплуатации и почему нельзя доверять выводу модели без независимой проверки.

0 117
М модели ·22 июл 2026

Когда переводчик начинает решать задачи вместо того, чтобы переводить

Разработчик столкнулся с неожиданной проблемой при переводе датасета с рассуждениями: модель Gemma вместо перевода начала решать математические и программистские задачи из текста. Оказалось, что когда данные содержат инструкции, модель может выполнять их вместо основного промпта — особенно при работе с длинными контекстами.

0 47