Intelligence artificielle13 août 2026· via AI News

Okta réduit drastiquement les coûts des agents IA avec un accès MCP granulaire

Okta réduit drastiquement les coûts des agents IA avec un accès MCP granulaire

Image : AI News

Les agents IA s’appuyant sur des serveurs MCP (Model Context Protocol) peuvent désormais éviter un coût caché à chaque requête. Selon Okta, ses listes d’outils MCP filtrées par identité réduisent les tokens consommés par ce que l’entreprise appelle la « taxe outil » – c’est-à-dire le poids des schémas, noms et descriptions envoyés au modèle à chaque interaction. En filtrant les outils avant qu’ils n’atteignent la requête, Okta affirme que certains scénarios de permissions suppriment plus de 90 % des outils visibles, réduisant d’autant la part des coûts de schéma. Les données d’Okta proviennent de modélisations internes basées sur des rôles et des portées OAuth représentatifs, et non sur des données clients en temps réel.

Un effet secondaire coûteux : l’exposition large des outils

Les serveurs MCP servent d’intermédiaires entre les agents IA et les outils ou données externes, exposant tout, des intégrations Google Workspace aux API internes. Chaque outil exposé arrive dans la requête du modèle sous forme de schéma et de métadonnées, gonflant l’usage de tokens même si l’agent ne l’utilise jamais. Lorsque de nombreux outils sont visibles par de nombreux utilisateurs, le coût cumulé explose rapidement. Okta présente ce problème comme une combinaison de deux facteurs : le nombre d’outils et le nombre d’utilisateurs – chaque utilisateur actif ajoute une surcharge de requête à chaque appel au modèle.

Filtrage par identité en amont

Okta restreint l’accès des serveurs complets à des outils individuels, attribuant des permissions de moindre privilège au niveau de chaque outil. Les administrateurs configurent, via le tableau de bord Okta, les outils accessibles à une identité ; le système renvoie ensuite une liste restreinte au lieu du catalogue complet du serveur. Le modèle ne reçoit que le sous-ensemble autorisé, réduisant ainsi le coût des schémas avant même la construction de la requête. Une vérification en temps réel bloque toujours les appels non autorisés, mais les tokens des outils exclus ne sont jamais consommés.

Pourquoi cette avancée compte

Pour les entreprises déployant à grande échelle des agents IA sur des catalogues MCP volumineux, les économies de tokens se traduisent directement par des factures d’inférence moins élevées et des réponses plus rapides. Les estimations basées sur des modèles d’Okta suggèrent des réductions spectaculaires de la surcharge, bien que les chiffres absolus ne soient pas communiqués. Plus largement, cette fonctionnalité souligne l’importance d’un contrôle d’accès granulaire et centré sur l’identité dans les systèmes agentiques, où chaque schéma superflu représente à la fois un risque de sécurité et un poste de dépense. Les plateformes d’identité devraient continuer à resserrer l’étau sur l’économie des MCP à mesure que leur adoption progresse.


Source : AI News. Synthèse éditoriale assistée par IA — TechnoExpress.

Lire la source originale sur AI News →

← Retour à l'accueil