#API

И инструменты ·20 авг 2026

Ramp запустил свой AI-роутер для моделей — и раздаёт его бесплатно до конца 2026

Платформа для управления корпоративными расходами Ramp выпустила Router — сервис для переключения между разными AI-моделями через API. Продукт бесплатный до конца 2026 (платить надо только за inference), с $26 бонусом на старте. Поддерживает OpenAI, Anthropic, DeepSeek, xAI и другие.

0 102
И инструменты ·18 авг 2026

Cartesia Sonic-3.6 возглавил оба рейтинга синтеза речи Artificial Analysis

Cartesia выпустила Sonic-3.6 — стриминговую TTS-модель на state space models, которая заняла первое место в обоих рейтингах Artificial Analysis (1283 и 1123 Elo). Модель показывает задержку менее 90 мс до первого аудио, поддерживает клонирование голоса за 10 секунд и доступна только как платный API.

0 99
Б бизнес ·18 авг 2026

Рынок цен на AI-модели: разрыв в 20 000 раз между самыми дешёвыми и дорогими

Анализ OpenRouter показал: самая дешёвая модель стоит $0.03 за миллион токенов (Mistral Nemo), самая дорогая — $600 (o1-pro от OpenAI). Средняя цена Meta — $0.74, OpenAI — $47.63 (разрыв в 64 раза). При этом контекст вырос в 63 раза за три года, а цены почти не изменились. Рынок раскололся: дешёвые массовые модели против премиум-решений для бизнеса.

0 76
И инструменты ·12 авг 2026

Mistral запустил европейский дата-центр и приоритетную очередь — но с оговорками

Mistral предлагает клиентам запускать AI-запросы через серверы в ЕС или США (региональная маршрутизация) и покупать приоритетный доступ в часы пик. Региональный роутинг стоит +10%, приоритет — в 1,75 раза дороже. Но региональная обработка не покрывает агентов, батч-процессинг и файловое хранилище — только простые запросы к моделям. Метаданные (биллинг, API-ключи, логи) всё равно могут уходить за пределы региона.

0 116
И инструменты ·27 июл 2026

Perplexity выпустила CLI-клиент pplx для поисковых запросов из терминала и агентов

Perplexity представила pplx — утилиту командной строки для своего Search API, которая возвращает результаты поиска и контент страниц в формате JSON. Инструмент создан специально для AI-агентов и автоматизации, без диалогового режима. Главная фишка — строгий контракт: успех = JSON на stdout, ошибка = код 1 и JSON с деталями на stderr, плюс встроенное управление лимитами токенов через усечение длинных полей.

0 125
И инструменты ·24 июл 2026

Sakana AI утверждает, что её роутер моделей Fugu Ultra v1.1 обходит Fable 5, хотя та даже не в пуле

Японский AI-стартап Sakana выпустил обновление своего роутера моделей Fugu Ultra v1.1, который распределяет запросы между несколькими топовыми AI-моделями. По данным самой компании, производительность выросла на 7,9 пункта, а новая версия якобы превосходит Fable 5, хотя та даже не входит в пул используемых моделей. Независимой проверки пока нет, цена осталась прежней — $5/$30 за миллион токенов.

0 128
И инструменты ·23 июл 2026

Runway запускает роутер AI-моделей: от видеогенератора к инфраструктуре

Runway, известная своими AI-видеомоделями, выпустила Media Router — инструмент, автоматически выбирающий лучшую модель генерации контента (видео, изображения, аудио) в зависимости от приоритетов: качество, скорость или стоимость. Это первый такой роутер для генеративных медиа. Компания эволюционирует от создателя моделей в инфраструктурную платформу, предлагая API-доступ к десяткам сторонних моделей через Runway Dev.

0 80
И инструменты ·31 июл 2026

Stateless MCP 2.0: почему протокол для AI-инструментов снова в игре

Обновление Model Context Protocol до версии 2.0 (stateless MCP) радикально упростило разработку AI-инструментов — теперь не нужны сессии и серверное состояние. Саймон Уиллисон вернулся к MCP после увлечения Skills, создал mcp-explorer (CLI для тестирования серверов) и datasette-mcp (плагин для SQL-запросов через MCP). Протокол стал практичнее для production и доступнее для небольших моделей.

0 30
И инструменты ·3 авг 2026

Как использовать API китайских AI-моделей из-за рубежа: оплата, доступ и стоимость

Китайские AI-модели выглядят привлекательно по цене, но доступ к ним из других стран часто затруднён из-за требований к регистрации (материковый номер телефона) и оплате (Alipay, WeChat Pay). Автор разбирает варианты решения через агрегаторы API и анализирует реальную экономику использования четырёх популярных китайских моделей.

0 27
И исследования ·23 июл 2026

Обвинения в «дистилляции» AI-моделей раздуты: почему это не кража, а норма индустрии

Каждый раз, когда выходит сильная открытая AI-модель, её обвиняют в «дистилляции» из GPT-4 или Claude. Автор разбирает, почему это миф: настоящая дистилляция требует доступа к внутренним вероятностям модели (logits), которых нет в публичных API. То, что называют «дистилляцией», — просто обучение на синтетических данных, что делают все лаборатории, включая OpenAI и Anthropic. Обвинения особенно часто летят в сторону китайских лабораторий, хотя их модели показывают реальные архитектурные улучшения.

0 76
Б безопасность ·23 июл 2026

Вам подсунули не ту AI-модель, за которую вы заплатили

API-провайдеры всё чаще незаметно подменяют модели: запрашиваете Claude Opus — получаете другую версию, ставите галочку на квантизацию — получаете худшую точность по умолчанию. Anthropic хотя бы сообщает о подмене в ответе, Cursor публикует правила роутинга без деталей, OpenRouter прячет квантизацию в документации. Юридически непонятно, что вы вообще купили: название модели, её возможности или просто «удовлетворённость пользователя».

0 42
И инструменты ·23 июл 2026

OpenAI берёт $10 за 1000 веб-поисков и впихивает 17к лишних токенов — разработчик показал, как сэкономить 87%

Разработчик измерил эффективность API веб-поиска OpenAI и обнаружил, что ~87% инжектируемых токенов (около 17 тысяч на запрос) не используются для ответа. Он создал локальный пайплайн с гибридным поиском, реранжированием и сжатием на уровне предложений — точность осталась на уровне 96%, но затраты на токены упали почти в 8 раз. Даже на 16 поисках экономия составила ~$1.50.

0 22