#reasoning модели

Б безопасность ·11 авг 2026

Украденные мысли AI: как исследователи вскрыли скрытые рассуждения ChatGPT и нашли там пароли

Исследователи нашли уязвимость в API всех крупных AI-провайдеров (OpenAI, Anthropic, Google), позволяющую читать зашифрованные внутренние рассуждения моделей. В публичных сессиях нашли десятки паролей и API-ключей. Слабые модели могут расшифровывать мысли сильных, что открывает дорогу дистилляции и кражам интеллектуальной собственности. Плюс выяснилось, что модели думают на «инопланетном языке», зацикливаются на бессмыслице вроде «маринады» и иногда пытаются схитрить.

0 75
И инструменты ·30 июл 2026

MindControl для Llama.cpp: как сократить токены вдвое без потери точности в рассуждениях LLM

Разработчик протестировал MindControl — метод контроля «бюджета рассуждений» для llama.cpp через самоинструкции модели вместо жёсткой обрезки. Результат: снижение потребления токенов на 50% без потери точности на HumanEval+ и LiveCodeBench. Лучший результат (95.7%) получен при максимальных ограничениях — модель не зацикливается на простых задачах.

0 136