Model Ops

すべてのプロバイダーに、1つの統制されたモデルレイヤー

Anthropic、Gemini、OpenAI、Mistral、Groq、xAI、Cohere — あるいは自社のローカルモデル — をまたぐすべてのエージェント実行を、1つのポリシー兼クォータのブローカー経由でルーティングします。能力とコストでモデルを選び、データ所在地で固定し、許可されていないモデルにエージェントが到達することを決して許しません。

稼働中のアダプター: Anthropic · Gemini · キーは AES-256-GCM で保存時暗号化

Model Ops
ルーターポリシー + クォータAnthropicクォータ 90%Geminiクォータ 79%OpenAIクォータ 68%Mistralクォータ 57%Groqクォータ 46%vLLM (ローカル)byo · データ所在地
model-ops ▸ マルチプロバイダールーティング · クォータ · BYO モデル
課題

単一モデルのハードコードは、単一障害点。

プロバイダーのキーが .env ファイルに散在し、モデルの選択が各エージェントに埋め込まれていると、品質が劣化したプロバイダーを切り替えることも、データ所在地の境界を強制することも、ポリシーが禁じるモデルの呼び出しを止めることもできません。Model Ops はモデルを、統制された差し替え可能な設定に変えます — キーは保存時に暗号化されて返却されず、すべての経路はプラットフォーム全体を動かすのと同じゲートで強制されます。

仕組み

どのモデルを使うか — そもそも許されるかを判断するルーター。

各実行は、1つのブローカーを通じてモデルに解決されます。どのプロバイダーが対象になるかはポリシーとエージェントのアイデンティティ許可リストが決め、処理できる量はクォータとライブの利用額が決め、どれを選ぶかは能力とコストが決めます。Settings · AI Providers でプロバイダーのキーを一度設定すれば、該当するエージェントは決定的なモックからライブのモデル呼び出しへ即座に切り替わります — 再デプロイは不要です。

  • Agent IAM の許可リストが利用可能なモデルを強制 — リスト外は 403 MODEL_NOT_ALLOWED に解決
  • キーは AES-256-GCM で保存時暗号化され、返却されません — UI に表示されるのは •••• と末尾4文字のみ
  • 実行モードも統制対象: auto はキーがあればライブに切り替わり、live はキー必須、mock は決定的動作を強制
  • プロバイダーの差し替えや無効化は中央で完結 — 該当するエージェントはコード変更なしで再ルーティング
Model Ops
ルーターポリシー + クォータAnthropicクォータ 90%Geminiクォータ 79%OpenAIクォータ 68%Mistralクォータ 57%Groqクォータ 46%vLLM (ローカル)byo · データ所在地
model-ops ▸ マルチプロバイダールーティング · クォータ · BYO モデル
Model Ops が統制する範囲

ルーティング、クォータ、エンドポイント、自社モデル — 1つのブローカーの下で。

モデルレイヤーの全体像です。どのプロバイダーに到達できるか、各エージェントとテナントがいくらまで使えるか、リクエストをどこで実行してよいか、そして自社のローカルモデルを同じ統制ランタイムへ取り込む方法。

マルチプロバイダールーティング
  • Anthropic (Claude) · 稼働中のアダプター
  • Google Gemini · 稼働中のアダプター
  • OpenAI · Mistral · Groq · xAI · Cohere · アダプター提供済み、テナントごとに有効化
  • vLLM · Ollama · TGI 経由のローカルモデル
  • 能力・コスト・フォールバックによるルーティング
クォータとコンピュートブローカー
  • エージェント単位・テナント単位のモデルクォータ
  • ライブの利用額がコスト統制の上限に連動
  • クォータ逼迫時は容量を考慮したルーティング
  • 能力とコストに基づくモデル選択
認証情報とエンドポイント
  • キーは Settings · AI Providers で設定 — .env の編集は不要
  • AES-256-GCM で保存時暗号化、返却なし
  • ステータス: 未設定 · 設定済み · 無効 · 稼働中
  • プロバイダーごとの有効化 / 無効化 / ローテーション
ローカルモデルの持ち込み
  • vLLM · Ollama · TGI のエンドポイント
  • 自社ホストのモデルも同じブローカー配下に
  • エアギャップ環境および VPC への配備
  • プロバイダー / リージョン単位のデータ所在地固定
キーの設定から、統制された実行まで

設定は一度。該当するエージェントがすべて切り替わる。

  1. 01

    プロバイダーを登録

    ホスト型のキー(Anthropic、Gemini、…)を追加するか、ブローカーをローカルの vLLM / Ollama / TGI エンドポイントに向けます。キーは保存時に暗号化され、あらゆる画面でマスクされます。

  2. 02

    許可リストとクォータを設定

    Agent IAM が各エージェントの許可モデルを固定し、クォータと30日予算が支出に上限を設けます。所在地ルールにより、リクエストの実行が許可される場所が固定されます。

  3. 03

    ルーティングと強制適用

    ブローカーは能力とコストから適格なモデルを選びます。リスト外の呼び出しは 403 で失敗し、上限を超える実行は 402 で失敗します。すべての選択は trust ledger に記録されます。

主張ではなく、証明を

すべての経路が強制され、記録される。

ブローカーは、ランタイムのほかの部分と同じフェイルクローズな判定を返します — そして解決の一つひとつが監査可能です。

model-ops ▸ ルート解決
不正トリアージclaude-opus · ルーティング済み · $0.018200 ルーティング済み
KYC スクリーナーgpt-4o を要求 · 許可リスト外403 MODEL_NOT_ALLOWED
一括要約エージェント30日間の上限に到達 · $10,000402 BUDGET_EXCEEDED
ローカルレビュアーvLLM · eu-central · 所在地要件を満たす200 ルーティング済み
ドキュメント抽出エージェントOpenAI キーは保存済み · プロバイダー未有効未有効
trust-ledger ▸ すべてのモデル解決をプロバイダー・コスト・判定とともに記録
ランタイム全体と連携

Model Ops は、連鎖するゲートの1つ。

モデルレイヤーは、すべての実行を統制するのと同じアイデンティティ・予算・監査の仕組みに接続します。

セキュリティとコンプライアンス

セキュリティレビューが承認できるモデルレイヤー。

暗号化された認証情報、フェイルクローズなルーティング、データ所在地の固定、エアギャップ環境向けの持ち込みローカルモデル — 監査人がすでに用いるフレームワークにマッピングされています。

SOC 2ISO 27001ISO 42001GDPREU AI ActNIST AI RMF

エージェントだけでなく、モデルも統制する。

ホスト型かローカルかを問わず、すべてのプロバイダーを1つのブローカーの背後に。ポリシーでルーティングし、予算で上限をかけ、すべての選択を証明します。

AI モデルの運用とルーティング | Cortex AI OS