- Anthropic (Claude) · adaptateur actif
- Google Gemini · adaptateur actif
- OpenAI · Mistral · Groq · xAI · Cohere · adaptateurs livrés, à activer par tenant
- Modèles locaux via vLLM · Ollama · TGI
- Routage selon les capacités, le coût ou le repli
Une couche modèle gouvernée pour chaque fournisseur.
Acheminez chaque exécution d'agent vers Anthropic, Gemini, OpenAI, Mistral, Groq, xAI et Cohere — ou vos propres modèles locaux — via un unique courtier de politiques et de quotas. Choisissez le modèle selon ses capacités et son coût, épinglez-le par zone de résidence des données, et ne laissez jamais un agent atteindre un modèle qu'il n'a pas le droit d'utiliser.
Adaptateurs actifs : Anthropic · Gemini · clés chiffrées AES-256-GCM au repos
Coder un seul modèle en dur, c'est créer un point de défaillance unique.
Quand les clés des fournisseurs sont éparpillées dans des fichiers .env et que le choix du modèle est figé dans chaque agent, vous ne pouvez pas changer de fournisseur lorsque l'un se dégrade, ni imposer une frontière de résidence des données, ni empêcher un agent d'appeler un modèle que votre politique interdit. Model Ops fait du modèle un paramètre gouverné et interchangeable : des clés chiffrées au repos, jamais renvoyées, et chaque routage appliqué par la porte de contrôle qui pilote le reste de la plateforme.
Un routeur qui décide quel modèle — et s'il est seulement autorisé.
Chaque exécution est résolue vers un modèle par un courtier unique : la politique et la liste d'autorisation portée par l'identité de l'agent déterminent les fournisseurs éligibles, les quotas et la dépense en direct déterminent la capacité, et les capacités et le coût déterminent le choix. Renseignez une clé de fournisseur une seule fois dans Paramètres · Fournisseurs d'IA, et les agents concernés passent immédiatement du mock déterministe aux appels de modèle réels — sans redéploiement.
- Les listes d'autorisation d'Agent IAM imposent l'ensemble de modèles — hors liste, la résolution renvoie 403 MODEL_NOT_ALLOWED
- Les clés sont chiffrées au repos en AES-256-GCM et ne sont jamais renvoyées — l'interface n'affiche que •••• et les quatre derniers caractères
- Le mode d'exécution est gouverné : auto passe en réel dès qu'une clé existe, live en exige une, mock force le déterministe
- Remplacez ou désactivez un fournisseur de façon centralisée — tous les agents concernés sont réacheminés sans modifier le code
Routage, quotas, points de terminaison et vos propres modèles — sous un seul courtier.
Toute la couche modèle : quels fournisseurs sont accessibles, combien chaque agent et chaque locataire peut y dépenser, où les requêtes ont le droit de s'exécuter, et comment intégrer vos propres modèles locaux au même runtime gouverné.
- Quotas de modèle par agent et par tenant
- La dépense en direct alimente les plafonds de gouvernance des coûts
- Routage tenant compte de la capacité en cas de pression sur les quotas
- Sélection du modèle selon les capacités et le coût
- Renseignez les clés dans Paramètres · Fournisseurs d'IA — aucune modification de .env
- Chiffrées au repos en AES-256-GCM, jamais renvoyées
- Statut : non défini · configuré · désactivé · actif
- Activation / désactivation / rotation par fournisseur
- Endpoints vLLM · Ollama · TGI
- Modèles auto-hébergés dans le même broker
- Déploiement isolé du réseau et en VPC
- Épinglage de la résidence par fournisseur / région
Configurez une fois. Tous les agents concernés sont réacheminés.
- 01
Enregistrer les fournisseurs
Ajoutez des clés hébergées (Anthropic, Gemini, …) ou pointez le broker vers un endpoint local vLLM / Ollama / TGI. Les clés sont chiffrées au repos et masquées partout.
- 02
Définir listes d'autorisation et quotas
Agent IAM fixe les modèles autorisés de chaque agent ; les quotas et les budgets sur 30 jours plafonnent la dépense. Les règles de résidence fixent les zones où les requêtes peuvent s'exécuter.
- 03
Router et appliquer
Le broker choisit un modèle éligible selon ses capacités et son coût. Les appels hors liste échouent en 403 ; les exécutions au-delà du plafond échouent en 402. Chaque choix est consigné dans le Trust Ledger.
Chaque routage est appliqué et enregistré.
Le courtier renvoie les mêmes verdicts en refus par défaut que le reste du runtime — et chaque résolution est auditable.
Model Ops est une porte de contrôle de la chaîne.
La couche modèle se branche sur les mêmes mécanismes d'identité, de budget et d'audit qui gouvernent chaque exécution.
- Les listes de modèles autorisés sont appliquées au moment du routage
- /platform/agent-iam ›
- La dépense modèle alimente les budgets sur 30 jours et les plafonds stricts
- /platform/cost-governance ›
- Les outils sont gouvernés avec les modèles dans un même runtime
- /platform/mcp-gateway ›
- Chaque résolution de modèle est consignée et prouvable
- /platform/trust-ledger ›
Une couche modèle que votre revue de sécurité peut valider.
Identifiants chiffrés, routage en refus par défaut, épinglage de la résidence des données et modèles locaux apportés par vos soins pour les déploiements isolés du réseau — mis en correspondance avec les référentiels que vos auditeurs utilisent déjà.
Gouvernez le modèle, pas seulement l'agent.
Placez chaque fournisseur — hébergé ou local — derrière un courtier unique qui achemine selon la politique, plafonne selon le budget et prouve chaque choix.