Слова и есть мышление
Языковые модели не извлекают готовые мысли и не переводят их в слова — они формируют ответ слово за словом, где генерация текста и есть само мышление. Это похоже на то, как люди открывают свои мысли в процессе письма или разговора, а не просто озвучивают заранее сформированные идеи.
Статья даёт концептуальное понимание того, как на самом деле работают LLM, разрушая иллюзию «извлечения готовых знаний». Это важно для продуктовых команд, исследователей и всех, кто работает с AI — меняет подход к промптингу, оценке выходов и пониманию ограничений моделей.
Это аннотация к авторской статье. Мы не публикуем и не пересказываем чужие тексты целиком — полная версия у автора.
О чём статья
- Языковые модели не имеют «готовой мысли» за словами — ответ формируется пошагово через латентное пространство, где каждое слово определяет возможные следующие направления
- «Chain of thought» в новых моделях — это не транскрипт внутреннего размышления, а сам процесс мышления; запись и есть рассуждение
- Люди работают схожим образом: при письме, подготовке к разговору или пользовательских интервью мысль часто формируется в процессе артикуляции, а не существует заранее
- Корректность в модели — не этап проверки после генерации, а постоянное «тяготение» к направлению истинности в процессе генерации, подобно тому как водители в хаотичном трафике поддерживают порядок не правилами, а непрерывной корректировкой
Сергей Ефимов
Medium #artificial-intelligence
Читать оригинал
Комментарии