Sakana AI утверждает, что её роутер моделей Fugu Ultra v1.1 обходит Fable 5, хотя та даже не в пуле
Японский AI-стартап Sakana выпустил обновление своего роутера моделей Fugu Ultra v1.1, который распределяет запросы между несколькими топовыми AI-моделями. По данным самой компании, производительность выросла на 7,9 пункта, а новая версия якобы превосходит Fable 5, хотя та даже не входит в пул используемых моделей. Независимой проверки пока нет, цена осталась прежней — $5/$30 за миллион токенов.
Роутеры моделей — новый класс AI-инструментов, которые обещают лучшую производительность за те же деньги. Но без независимых тестов громкие заявления от вендоров сложно проверить, а история с критикой первой версии добавляет здорового скептицизма.
Sakana заявляет о превосходстве своего роутера над Fable 5

Японский AI-стартап Sakana AI представил Fugu Ultra v1.1 — обновлённую версию своего «роутера моделей». Это система, которая не генерирует ответы сама, а распределяет запросы между пулом публично доступных топовых AI-моделей, выбирая оптимальную для каждой задачи.
Что изменилось
По данным Sakana, прирост производительности составил до 7,9 пункта по сравнению с версией v1.0. Наибольший рост показан на бенчмарках ProgramBench и TerminalBench 2.1. Самое громкое заявление: новая версия якобы превосходит Fable 5, хотя эта модель даже не входит в пул, из которого Fugu выбирает.
Важный нюанс: все эти цифры идут от самой компании. Независимой проверки пока не существует.
Что на практике
Цены не изменились: $5 за миллион входных токенов, $30 — за выходные. Добавление новой топовой модели в пул занимает около двух недель обучения и тестирования. Появилась поддержка Claude Code-совместимого API для вызова из терминала.
Fugu доступен через платформы OpenRouter и Vercel, но не работает в ЕС и ЕЭЗ из-за GDPR и «специфических европейских регуляций».
Контекст
Первая версия Fugu получила прохладный приём: критиковали высокий расход токенов, медлительность и слабые результаты. Новое обновление — попытка исправить репутацию, но без независимой оценки сложно судить о реальных улучшениях.
Техническая документация доступна в отчёте компании.
Ключевые выводы
- Sakana представила обновление роутера моделей с заявленным приростом до 7,9 пункта на некоторых бенчмарках
- Компания утверждает превосходство над Fable 5, но независимой проверки данных нет
- Первая версия Fugu критиковалась за высокий расход токенов и низкую скорость
- Сервис по-прежнему недоступен в ЕС из-за регуляторных ограничений
- Цены остались прежними: $5/$30 за миллион токенов ввода/вывода
Автор: Никита Громов · Источник: the-decoder.com
Концепция роутеров моделей логичная: зачем платить за GPT-4 для простых задач, если можно динамически выбирать подходящую модель? Но тут два «но».
Первое — все цифры от самой Sakana, независимых тестов нет. После провального старта v1.0 (медленно, дорого, плохо работает) им нужно восстанавливать репутацию, так что мотивация приукрасить есть. Второе — заявление о превосходстве над Fable 5, которая не входит в пул тестируемых моделей, выглядит странно. Либо они сравнивают с публичными результатами Fable, либо это просто маркетинг. В целом идея роутеров жизнеспособна, но этот конкретный кейс требует скептицизма до появления независимых бенчмарков.
Инструменты из статьи
Агентный кодинг в терминале от Anthropic: сам пишет, тестирует и правит код...
Доступ из РФ →
Комментарии