Cartesia Sonic-3.6 возглавил оба рейтинга синтеза речи Artificial Analysis
Cartesia выпустила Sonic-3.6 — стриминговую TTS-модель на state space models, которая заняла первое место в обоих рейтингах Artificial Analysis (1283 и 1123 Elo). Модель показывает задержку менее 90 мс до первого аудио, поддерживает клонирование голоса за 10 секунд и доступна только как платный API.