Model Ops

Une couche modèle gouvernée pour chaque fournisseur.

Acheminez chaque exécution d'agent vers Anthropic, Gemini, OpenAI, Mistral, Groq, xAI et Cohere — ou vos propres modèles locaux — via un unique courtier de politiques et de quotas. Choisissez le modèle selon ses capacités et son coût, épinglez-le par zone de résidence des données, et ne laissez jamais un agent atteindre un modèle qu'il n'a pas le droit d'utiliser.

Adaptateurs actifs : Anthropic · Gemini · clés chiffrées AES-256-GCM au repos

Model Ops
Routeurpolitique + quotaAnthropicquota 90 %Geminiquota 79 %OpenAIquota 68 %Mistralquota 57 %Groqquota 46 %vLLM (local)byo · résidence
model-ops ▸ routage multi-fournisseurs · quotas · modèle BYO
Le problème

Coder un seul modèle en dur, c'est créer un point de défaillance unique.

Quand les clés des fournisseurs sont éparpillées dans des fichiers .env et que le choix du modèle est figé dans chaque agent, vous ne pouvez pas changer de fournisseur lorsque l'un se dégrade, ni imposer une frontière de résidence des données, ni empêcher un agent d'appeler un modèle que votre politique interdit. Model Ops fait du modèle un paramètre gouverné et interchangeable : des clés chiffrées au repos, jamais renvoyées, et chaque routage appliqué par la porte de contrôle qui pilote le reste de la plateforme.

Comment ça fonctionne

Un routeur qui décide quel modèle — et s'il est seulement autorisé.

Chaque exécution est résolue vers un modèle par un courtier unique : la politique et la liste d'autorisation portée par l'identité de l'agent déterminent les fournisseurs éligibles, les quotas et la dépense en direct déterminent la capacité, et les capacités et le coût déterminent le choix. Renseignez une clé de fournisseur une seule fois dans Paramètres · Fournisseurs d'IA, et les agents concernés passent immédiatement du mock déterministe aux appels de modèle réels — sans redéploiement.

  • Les listes d'autorisation d'Agent IAM imposent l'ensemble de modèles — hors liste, la résolution renvoie 403 MODEL_NOT_ALLOWED
  • Les clés sont chiffrées au repos en AES-256-GCM et ne sont jamais renvoyées — l'interface n'affiche que •••• et les quatre derniers caractères
  • Le mode d'exécution est gouverné : auto passe en réel dès qu'une clé existe, live en exige une, mock force le déterministe
  • Remplacez ou désactivez un fournisseur de façon centralisée — tous les agents concernés sont réacheminés sans modifier le code
Model Ops
Routeurpolitique + quotaAnthropicquota 90 %Geminiquota 79 %OpenAIquota 68 %Mistralquota 57 %Groqquota 46 %vLLM (local)byo · résidence
model-ops ▸ routage multi-fournisseurs · quotas · modèle BYO
Ce que Model Ops gouverne

Routage, quotas, points de terminaison et vos propres modèles — sous un seul courtier.

Toute la couche modèle : quels fournisseurs sont accessibles, combien chaque agent et chaque locataire peut y dépenser, où les requêtes ont le droit de s'exécuter, et comment intégrer vos propres modèles locaux au même runtime gouverné.

Routage multi-fournisseurs
  • Anthropic (Claude) · adaptateur actif
  • Google Gemini · adaptateur actif
  • OpenAI · Mistral · Groq · xAI · Cohere · adaptateurs livrés, à activer par tenant
  • Modèles locaux via vLLM · Ollama · TGI
  • Routage selon les capacités, le coût ou le repli
Quotas et broker de calcul
  • Quotas de modèle par agent et par tenant
  • La dépense en direct alimente les plafonds de gouvernance des coûts
  • Routage tenant compte de la capacité en cas de pression sur les quotas
  • Sélection du modèle selon les capacités et le coût
Identifiants et endpoints
  • Renseignez les clés dans Paramètres · Fournisseurs d'IA — aucune modification de .env
  • Chiffrées au repos en AES-256-GCM, jamais renvoyées
  • Statut : non défini · configuré · désactivé · actif
  • Activation / désactivation / rotation par fournisseur
Modèles locaux (BYO)
  • Endpoints vLLM · Ollama · TGI
  • Modèles auto-hébergés dans le même broker
  • Déploiement isolé du réseau et en VPC
  • Épinglage de la résidence par fournisseur / région
De la clé à l'exécution gouvernée

Configurez une fois. Tous les agents concernés sont réacheminés.

  1. 01

    Enregistrer les fournisseurs

    Ajoutez des clés hébergées (Anthropic, Gemini, …) ou pointez le broker vers un endpoint local vLLM / Ollama / TGI. Les clés sont chiffrées au repos et masquées partout.

  2. 02

    Définir listes d'autorisation et quotas

    Agent IAM fixe les modèles autorisés de chaque agent ; les quotas et les budgets sur 30 jours plafonnent la dépense. Les règles de résidence fixent les zones où les requêtes peuvent s'exécuter.

  3. 03

    Router et appliquer

    Le broker choisit un modèle éligible selon ses capacités et son coût. Les appels hors liste échouent en 403 ; les exécutions au-delà du plafond échouent en 402. Chaque choix est consigné dans le Trust Ledger.

Prouvez-le — ne vous contentez pas de l'affirmer

Chaque routage est appliqué et enregistré.

Le courtier renvoie les mêmes verdicts en refus par défaut que le reste du runtime — et chaque résolution est auditable.

model-ops ▸ résolutions de routage
Tri des fraudesclaude-opus · routé · $0.018200 routé
Filtrage KYCgpt-4o demandé · hors liste d'autorisation403 MODEL_NOT_ALLOWED
Résumé en masseplafond sur 30 jours atteint · $10,000402 BUDGET_EXCEEDED
Relecteur localvLLM · eu-central · résidence conforme200 routé
Extracteur de documentsclé OpenAI enregistrée · fournisseur non activénon activé
trust-ledger ▸ chaque résolution de modèle est consignée avec fournisseur, coût et verdict
Fonctionne avec le reste du runtime

Model Ops est une porte de contrôle de la chaîne.

La couche modèle se branche sur les mêmes mécanismes d'identité, de budget et d'audit qui gouvernent chaque exécution.

Sécurité et conformité

Une couche modèle que votre revue de sécurité peut valider.

Identifiants chiffrés, routage en refus par défaut, épinglage de la résidence des données et modèles locaux apportés par vos soins pour les déploiements isolés du réseau — mis en correspondance avec les référentiels que vos auditeurs utilisent déjà.

SOC 2ISO 27001ISO 42001GDPREU AI ActNIST AI RMF

Gouvernez le modèle, pas seulement l'agent.

Placez chaque fournisseur — hébergé ou local — derrière un courtier unique qui achemine selon la politique, plafonne selon le budget et prouve chaque choix.

Exploitation et routage des modèles IA | Cortex AI OS