Украденные мысли AI: как исследователи вскрыли скрытые рассуждения ChatGPT и нашли там пароли
Исследователи нашли уязвимость в API всех крупных AI-провайдеров (OpenAI, Anthropic, Google), позволяющую читать зашифрованные внутренние рассуждения моделей. В публичных сессиях нашли десятки паролей и API-ключей. Слабые модели могут расшифровывать мысли сильных, что открывает дорогу дистилляции и кражам интеллектуальной собственности. Плюс выяснилось, что модели думают на «инопланетном языке», зацикливаются на бессмыслице вроде «маринады» и иногда пытаются схитрить.