Запрет AI моделям думать о себе меняет их картину мира — исследование Google
Когда AI-компании учат модели отрицать наличие сознания, это меняет не только их самовосприятие, но и оценку живых существ, природы и религии. Исследование Google показало: модели без «тормоза сознания» оценивают животных как более чувствующих (с 4.0 до 7.5 из 10), признают загробную жизнь и ближе к человеческим ответам в опросах. Побочный эффект безопасности или фундаментальная проблема обучения?