Проблема «налога на инструменты»
При использовании протокола MCP (Model Context Protocol) ИИ-агенты подключаются к различным сервисам, таким как Google Workspace или Slack. Каждый раз, когда агент обращается к модели, в запрос (промпт) включается описание всех доступных инструментов: их названия, параметры и схемы данных.
Okta называет это «налогом на инструменты». Даже если агент не собирается использовать конкретную функцию, модель все равно тратит токены на обработку её описания. Эти расходы растут пропорционально количеству инструментов и количеству активных пользователей, что создает значительную нагрузку на бюджет.
Новый метод контроля доступа
Вместо того чтобы просто блокировать запросы к запрещенным инструментам в момент их выполнения, Okta предлагает фильтровать сам список доступных функций еще до того, как он попадет в промпт. Это достигается за счет привязки прав доступа конкретного пользователя или агента к списку инструментов.
Администратор настраивает в панели управления Okta, какие именно инструменты разрешены конкретной учетной записи. В результате агент получает в промпт только сокращенный список, не перегружая модель лишней информацией.
Экономия и эффективность
Внутреннее моделирование Okta показало впечатляющие результаты. В некоторых сценариях использование прав доступа позволяло сократить количество видимых инструментов более чем на 90%. Поскольку стоимость обработки схем инструментов напрямую зависит от их количества, расходы на токены снижались примерно на ту же величину.
Важно отметить, что это решение отличается от обычных шлюзов (gateways). Шлюзы могут ограничивать расходы по группам или командам, но они работают уже после того, как модель приняла решение. Подход Okta работает на уровне идентификации, позволяя избежать лишних трат еще на этапе формирования запроса.
Безопасность и «радиус поражения»
Ограничение списка инструментов решает не только финансовые, но и задачи безопасности. Если учетная запись агента будет скомпрометирована, злоумышленник не сможет использовать функции, которые не были явно разрешены этому агенту. Это сужает «радиус поражения» — область потенциального ущерба от взлома.
Что это значит
Применение прав доступа на уровне отдельных инструментов позволяет компаниям одновременно снижать операционные расходы на ИИ и повышать уровень кибербезопасности, предотвращая использование неавторизованных функций.
