Uncensored LLM меняют не только цензуру — они становятся оптимистами (или пессимистами)
Автор проверил, как abliteration (снятие цензуры) влияет на поведение LLM в задаче предсказания акций. Неожиданность: uncensored модели не только перестали отказываться отвечать, но и изменили свой настрой — Qwen стал оптимистичнее и увереннее, Gemma наоборот осторожнее. При этом точность осталась на уровне случайности (50/50). Вывод: снятие цензуры меняет не только фильтры, но и внутреннюю логику рассуждений модели.