#эффективность

И инфраструктура ·30 июл 2026

LinkedIn заморозил расширение дата-центров на год — как они оптимизировали AI-инфраструктуру

LinkedIn не будет увеличивать GPU-мощности и хранилища в 2025 финансовом году. Вместо строительства новых дата-центров компания удвоила эффективность использования существующих GPU за полгода — через оптимизацию моделей, дистилляцию и переброс задач с GPU на CPU. Экономия $24 млн, утилизация GPU >95%.

0 71
М модели ·27 июл 2026

KAT-Coder-V2.5-Dev обошёл Qwen 3.6 по эффективности в реальных задачах кодирования

Независимое сравнение 35B-моделей для автономного кодирования (120 прогонов) показало: KAT-Coder-V2.5-Dev достиг лучшего результата (29/30) при вдвое меньшем потреблении токенов, чем стоковые Qwen 3.5/3.6. Ornith показал хуже своей базы из-за технических ошибок, а не знаний. Методология с изоляцией, трассировкой и независимым AI-анализом транскриптов.

0 98