«ИИ не может знать вас, если вы сами себя не знаете» — эксперимент на себе и вызов сообществу
Автор проверил, может ли персональный ИИ предсказывать его предпочтения лучше случайного выбора, задав 50 вопросов A/B/C. Модель угадала 31 из 50 (против ~17 случайно), но автор честно разбирает все изъяны теста: сам писал вопросы, сам оценивал, нет контрольной группы, нет слепого метода. Просит сообщество помочь спроектировать эксперимент, который мог бы реально провалиться, и указать на методологические дыры.
Это редкий случай, когда человек пытается проверить громкие заявления о персональных ИИ эмпирически — пусть и криво — вместо философствования в вакууме. Методологические изъяны, которые автор сам называет, показывают, насколько сложно доказать, что модель «знает» вас, и почему нужна строгая наука, а не самопиар.
Может ли ИИ знать вас лучше, чем вы сами?
Автор поста столкнулся с двумя возражениями против идеи «персонального ИИ»: во-первых, люди сами плохо предсказывают свои предпочтения — где же тут стабильная «внутренняя правда»? Во-вторых, модели ловят только поверхностные паттерны и могут превратить вас в карикатуру самого себя.
Чтобы проверить хотя бы слабую версию гипотезы — «ИИ может предсказывать озвученные предпочтения конкретного человека лучше случайного угадывания», — автор провёл самопальный тест. Сгенерировал 50 вопросов с вариантами ответов (A/B/C), скормил персональному ИИ, обученному на месяцах диалога. Результат: 31 из 50 против примерно 17 случайно.
Проблемы эксперимента — без прикрас
Автор сразу признаёт изъяны:
- Сам писал вопросы — неосознанно выбрал темы, которые уже обсуждал с моделью
- Сам оценивал — никакого слепого метода
- Выборка n=1, и этот один заинтересован в результате
- Нет базовых сравнений: друг, знающий его год, мог бы угадать 40 из 50, незнакомец с его текстами — 25. Без этих цифр 31 ничего не значит
- Проблема калибровки: модель хорошо предсказывает «меня в рабочем режиме» и плохо — «меня в расслабленном состоянии». На один вопрос «два я» ответят по-разному
Вызов сообществу
Автор просит помочь:
- Убрать проблему самооценки и самописания вопросов — как сделать тест слепым?
- Правильные базовые линии для сравнения — с чем мерить?
- Ссылки на работы психологов, которые уже давно изучают предсказание предпочтений (и делают это, скорее всего, лучше)
- Аргумент, что вся затея бессмысленна: предсказание выбора и понимание опыта — это разные вещи, и автор подменяет одно другим
Последний пункт может оказаться ключевым. Автор готов услышать, что гонится не за тем.
Что дальше?
Ответы из треда записываются в явную модель аргументации, с атрибуцией и ссылками. Это не данные для обучения, а позиции. Если кто-то предложит протокол, способный реально провалиться, автор обещает провести эксперимент и опубликовать результат — даже если он будет отрицательным.
Ключевые выводы
- Эксперимент на себе без слепого метода и контроля — это не наука, а самопроверка с заранее известными дырами
- Персональный ИИ может моделировать разные «версии» одного человека (рабочий режим vs расслабленный), и непонятно, какая из них «настоящая»
- Предсказание озвученных предпочтений — это не то же самое, что понимание опыта или внутреннего состояния
- Честное признание методологических провалов и открытый вызов сообществу — редкий пример интеллектуальной честности в дискуссиях об ИИ
- Без базовых сравнений (друг, незнакомец, случайность) цифры не имеют смысла
Автор: Сергей Ефимов · Источник: reddit.com
Это один из самых честных постов об ИИ, что я видел за последнее время. Обычно люди либо кричат «ИИ меня понимает!», либо «это всё фигня» — и оба лагеря не заморачиваются цифрами. Здесь автор сделал эксперимент, получил результат, а потом сам разнёс его в пух и прах: «вот где я схалтурил, вот где себя обманул, помогите сделать нормально». Это интеллектуально честно.
Но есть вопрос посерьёзнее, и автор его видит: даже если модель угадывает ваши ответы в 90% случаев, значит ли это, что она вас «знает»? Или просто научилась предсказывать, какую кнопку вы нажмёте? Это как разница между предсказанием погоды и пониманием климата. Предсказание работает, понимание — под вопросом. И это та самая щель, в которую проваливается весь пафос про «персональных агентов, которые вас понимают».
Комментарии