Как люди реально используют ChatGPT и Claude — независимое исследование против корпоративных отчётов
Стэнфорд и MIT запустили AI Observatory — независимую платформу для анализа реального использования AI. Выяснилось: компании вроде Anthropic и OpenAI показывают только рабочие сценарии, фильтруя до 48% разговоров — про здоровье, отношения, секс, хейт-спич. Реальная картина: люди используют AI для companionship, roleplay, дезинформации — и каждая модель ведёт себя по-своему.
Если вы строите AI-продукт или инвестируете в AI, полагаться на корпоративные отчёты — значит не видеть половину рынка. Это исследование показывает, где реальный спрос и где риски.
Что произошло

Исследователи из Стэнфорда, MIT и Data Provenance Initiative создали AI Observatory — публичную платформу для анализа реальных разговоров с AI-моделями. Проанализировали 24,5 тысячи диалогов с ChatGPT, Claude, Gemini и Grok за 2023-2025 годы.
Главная находка: отчёты Anthropic и OpenAI показывают искажённую картину. Anthropic фокусируется на productivity, фильтруя 48% разговоров — именно там концентрируются темы здоровья, отношений, секса, хейт-спича. В отфильтрованных диалогах в 3,5 раза чаще встречается сексуальный контент (16,7% против 2,4% в отчёте Anthropic), почти в 5 раз чаще — травля и ненависть (27,5% против 5,66%).
Исследование показало: - Разговоры становятся длиннее и сложнее, растёт small talk — люди используют AI для companionship. - Каждая модель используется по-своему: Grok — для новостей и политики (но там концентрируется дезинформация), Claude — для кода, Gemini — для roleplay, ChatGPT — для домашки. - GPT-4o вызывает эмоциональную зависимость — разговоры длиннее и итеративнее, чем с GPT-3.5. - Модерация улучшается: чувствительный контент со временем снижается.
Компании анализируют миллионы диалогов, но публикуют только то, что выгодно. AI Observatory даёт независимый взгляд для исследователей и регуляторов.
Автор: Никита Громов · Источник: technologyreview.com
Разработчикам. Появился открытый датасет реальных диалогов с AI — можно изучать паттерны взаимодействия, тестировать модерацию, понимать, где модели фейлят. Видны различия между версиями одной модели (GPT-3.5 vs GPT-4o) — полезно для A/B-тестов и выбора архитектуры.
Бизнесу. Если строите AI-продукт, корпоративные отчёты врут — люди используют AI не для работы, а для отношений, roleplay, личных тем. Companionship и персонализация — реальный спрос. Модерация критична: без неё концентрируется токсичный контент.
Инвесторам. Рынок AI-компаньонов и персональных ассистентов недооценен — половина использования вне работы. Grok показывает риски дезинформации — репутационная бомба для платформ. Независимая аналитика станет обязательной при регулировании — возможности для audit-стартапов.
- Разработка AI-компаньонов с фокусом на эмоциональную поддержку и отношения — быстрорастущая ниша, которую скрывают крупные игроки
- Инструменты для независимого аудита AI-моделей — спрос от регуляторов, исследователей, СМИ
- Специализированные модели для конкретных сценариев: roleplay (как Gemini), coding (как Claude), образование (как ChatGPT) — вертикальная сегментация эффективнее универсальных моделей
- Платформы для фактчекинга AI-ответов в реальном времени — особенно критично для новостных и политических запросов на Grok
- B2B-решения для мониторинга использования корпоративных AI — чтобы компании понимали, как сотрудники реально используют ChatGPT/Claude
- AI Observatory анализирует в 40 раз меньше данных, чем сами компании (24,5K vs 1M+ диалогов) — выборка может быть нерепрезентативной
- Компании могут ещё жёстче закрыть данные после такой критики — меньше прозрачности вместо большей
- Рост использования AI для companionship может привести к регуляторному удару по эмоциональной привязанности — как с Character.AI
- Дезинформация на Grok — системная проблема xAI, но компания игнорирует критику; риск репутационного коллапса платформы
Это не разоблачение, а объяснение очевидного: компании показывают только то, что хорошо выглядит в презентациях для инвесторов и регуляторов. Productivity — это красиво, а companionship и roleplay — стыдно. Но деньги там, где стыдно: люди платят за эмоциональную связь, не за автоматизацию Excel-таблиц.
Важный момент: AI Observatory работает с крошечной выборкой (24K диалогов против миллионов у компаний), но даже это показывает паттерны, которые корпорации игнорируют. Если вы строите AI-продукт, не слушайте Anthropic Economic Index — смотрите на реальное поведение. Будущее AI — это не замена менеджеров, а замена психологов, друзей и партнёров. Инвестируйте туда, а не в очередной productivity tool.
Инструменты из статьи
Универсальный AI-ассистент OpenAI: тексты, код, анализ, изображения, голос.
Доступ из РФ →AI-ассистент Anthropic. Сильнейший в работе с кодом, длинными документами и...
Доступ из РФ →
Комментарии