#китайские LLM

М модели ·30 июл 2026

Nanbeige4.2-3B: тесты показали провал модели с громкими бенчмарками

Новая 3B-модель Nanbeige4.2 на бумаге обгоняет Qwen3.5-9B и Gemma4-12B, но в реальных задачах проваливается: «петлевая» архитектура удваивает размер в памяти до 6B, контекст пожирает 5+ ГБ VRAM, а «думающий» режим сжигает токены на пустом месте. Провалила два простых кодинговых задания, хотя tool calling работает идеально.

0 109
М модели ·26 июл 2026

Открытые веса уже достаточно хороши. Проблема — в том, что идёт после

Открытые LLM-модели догнали коммерческие по большинству корпоративных задач, работая в 6–100 раз дешевле. Основной вопрос теперь не «какая модель лучше», а как грамотно провести границу между открытыми и закрытыми решениями и управлять рисками при их эксплуатации.

0 35