Okta сократила расходы AI-агентов на токены до 90% через фильтрацию доступа к инструментам MCP
Okta предложила решение проблемы «налога на инструменты» в AI-агентах: фильтровать список доступных MCP-инструментов на основе прав доступа пользователя ДО отправки в модель. По внутренним расчётам компании, это сокращает видимые инструменты на 90%+ и пропорционально снижает расход токенов на схемы инструментов в каждом запросе.
Если вы разворачиваете AI-агентов в компании, расходы на токены могут выйти из-под контроля незаметно. Okta показывает, как identity-layer может срезать эти траты превентивно — до того, как модель получит список инструментов.
Что произошло
Okta представила подход к снижению расходов AI-агентов на токены через управление доступом к инструментам Model Context Protocol (MCP). Проблема в том, что каждый запрос агента к модели включает полное описание (схемы, параметры, названия) всех инструментов, доступных через MCP-сервер — даже тех, которыми агент не имеет права пользоваться. Okta называет это «налогом на инструменты»: токены сгорают ещё до попытки вызова функции.
Решение: фильтровать список инструментов на основе прав конкретного агента и пользователя ДО формирования промпта. Администратор настраивает разрешённые инструменты для каждой идентичности в панели Okta, агент получает только свой урезанный список.
По внутреннему моделированию Okta (на своих данных и публичной документации, без реальных клиентов), в некоторых сценариях это сокращает число видимых инструментов на 90%+, пропорционально снижая расход токенов на схемы. Okta не назвала абсолютных цифр в токенах или долларах, но подчеркнула: стоимость схемы инструмента линейно зависит от их количества.
Компания противопоставляет свой подход шлюзам (gateways), которые лимитируют расходы постфактум: шлюз считает токены и доллары уже после отправки запроса в модель. Идентификационный уровень Okta режет затраты в момент формирования промпта, не давая «мусорным» инструментам попасть в контекст.
Автор: Анна Мельникова · Источник: artificialintelligence-news.com
Разработчикам. Можно интегрировать identity-based scoping в свои MCP-серверы: подавать модели только разрешённый набор инструментов на основе OAuth-скоупов или ролей пользователя. Это снижает overhead промпта, ускоряет инференс и режет счета за API. Подход работает на уровне клиента MCP, до вызова модели.
Бизнесу. Для компаний с большими каталогами корпоративных инструментов (Google Workspace, Slack, внутренние API) это способ контролировать расходы на AI-агентов не после факта, а превентивно. Okta предлагает готовую панель управления правами доступа на уровне отдельных инструментов, а не целых серверов.
Инвесторам. Okta встраивает identity governance в стек AI-агентов, конкурируя с шлюзами вроде Portkey и Kong. Если подход зайдёт, компания закрепится в инфраструктуре AI, где каждый токен стоит денег. Потенциал роста в сегменте enterprise AI security и cost optimization.
- Разработать MCP-клиенты с встроенной identity-фильтрацией для Anthropic Claude, OpenAI Assistants — продавать как плагины или SaaS для корпораций
- Создать аналитическую панель для отслеживания «налога на инструменты» в реальном времени: показывать, сколько токенов сгорает на неиспользуемые схемы
- Консалтинг по настройке прав доступа для AI-агентов: аудит корпоративных MCP-серверов, выявление раздутых каталогов инструментов
- Построить open-source библиотеку для identity-scoped MCP на базе OAuth 2.0, продвигать как стандарт для enterprise AI
- Интегрировать подход в существующие AI-гейтвеи (Portkey, LangSmith): добавить identity layer поверх rate limiting
- Okta не показала ни одного реального кейса — только внутреннее моделирование, без клиентских данных и абсолютных цифр экономии
- Заявленное сокращение на 90% может быть завышено: зависит от конкретного каталога инструментов, распределения прав и модели; реальные результаты могут быть скромнее
- Решение добавляет сложность: нужно настраивать права доступа на уровне отдельных инструментов, что может стать overhead для малых команд
- Если MCP не станет стандартом для AI-агентов, вся инфраструктура identity-scoping потеряет ценность — ставка на молодой протокол
Okta нашла элегантное решение реальной проблемы: AI-агенты сжигают токены на описание функций, которые им запрещены. Фильтровать инструменты по identity до промпта — логично, и в теории может сильно снизить расходы для корпораций с раздутыми каталогами MCP-серверов. Но вот что настораживает: компания не показала ни одного боевого кейса, только внутреннее моделирование на своих данных. Нет абсолютных цифр — ни в токенах, ни в долларах. Заявленное сокращение на 90% звучит впечатляюще, но без контекста это маркетинговая метрика. Плюс подход добавляет накладные расходы: нужно настраивать права на уровне каждого инструмента, а не просто дать доступ к серверу целиком.
С другой стороны, если MCP станет стандартом для enterprise AI (а Anthropic его активно продвигает), identity-layer для агентов превратится в обязательную часть стека. И тогда Okta получит крепкую позицию на стыке безопасности и cost optimization. Пока это концепт с потенциалом, но без доказанного ROI. Следим за первыми клиентскими кейсами — если они покажут реальную экономию в десятки тысяч в месяц, это выстрелит.
Комментарии