Предобучение vs. пост-обучение: как предсказатель текста становится ассистентом
Статья объясняет двухэтапный процесс создания AI-ассистентов вроде Claude или ChatGPT. На первом этапе (предобучение) модель учится предсказывать следующий токен в огромных массивах текста, получая знания, но без какой-либо "личности". На втором (пост-обучение) та же архитектура приобретает голос, имя, способность отказывать на вредные запросы — не через новые слои, а через "донастройку" уже существующих весов.
0
90