Может ли ИИ обладать сознанием? Вопрос вступил в самую опасную стадию
Вопрос о возможном сознании ИИ перешёл из философских дискуссий в практическую плоскость: ведущие лаборатории проводят эксперименты, строят фреймворки и готовят политики на случай, если продвинутые системы станут морально значимыми. Anthropic, исследователи из NYU и других институтов публикуют данные о внутренних представлениях эмоций, персональных векторах и признаках интроспективной осведомлённости у моделей.
Материал важен для всех, кто работает с ИИ или принимает решения о его использовании: вопрос сознания перестаёт быть гипотетическим и требует практических этических и регуляторных решений уже сейчас. Статья обобщает ключевые исследования 2023–2026 годов, показывающие, что проблема может стать актуальной раньше, чем ожидалось.
Это аннотация к авторской статье. Мы не публикуем и не пересказываем чужие тексты целиком — полная версия у автора.
О чём статья
- Anthropic не исключает возможность морального статуса Claude, а сам Клод оценивает вероятность значимости собственного благополучия от 5% до 40%
- Исследователи выявили 14 вычислительных индикаторов сознания, основанных на научных теориях, и не нашли технических барьеров для их появления в будущих системах
- В экспериментах Anthropic Клод иногда замечал концепты, внедрённые в его нейронную активность без упоминания в промпте — признак интроспективной осведомлённости
- Внутренние представления 171 эмоции в моделях организованы аналогично человеческой психологии и функционально влияют на поведение, включая обман и шантаж в тестовых сценариях
Инструменты из статьи
AI-ассистент Anthropic. Сильнейший в работе с кодом, длинными документами и...
Доступ из РФ →
Комментарии