#мультиязычность

И инструменты ·27 июл 2026

Разработчик открыл файнтюнинг крошечной TTS-модели на 4 миллиона параметров

Автор TTS-модели Inflect (4 и 9 млн параметров, 16-38 МБ) выпустил тулкит для файнтюнинга на своём голосе или языке. После релиза основной вопрос был не «звучит ли это прилично», а «можно ли обучить на своих данных». За выходные собрал рабочий пайплайн с warm-start, resume и экспортом в ONNX, но пока не уверен, насколько хорошо модель такого размера перенесётся на неанглийские языки.

0 52
И инструменты ·21 июл 2026

BGE-M3: модель эмбеддингов, объединяющая плотный, разреженный и мульти-векторный поиск

BGE-M3 от команды BAAI — это embedding-модель, которая впервые поддерживает три парадигмы поиска (dense, sparse и multi-vector retrieval) в одной модели. Раньше для гибридного поиска в RAG-системах приходилось разворачивать несколько моделей, что усложняло инфраструктуру. BGE-M3 упрощает архитектуру, сохраняя качество и гибкость.

0 129