Главное об LLM в 2025: год reasoning-моделей и революция от DeepSeek
2025 стал годом прорыва reasoning-моделей (LLM с «объяснением хода мыслей»), который возглавил китайский DeepSeek. Их метод RLVR+GRPO позволил обучать топовые модели за $5-6 млн вместо $50-500 млн и без дорогой ручной разметки. Теперь каждая крупная лаборатория выпускает свою версию reasoning-модели, но прогресс не остановился: появились мультимодальные reasoning-модели, улучшилась эффективность, а OpenAI и другие уже работают над следующим поколением.