- Anthropic (Claude) · 稼働中のアダプター
- Google Gemini · 稼働中のアダプター
- OpenAI · Mistral · Groq · xAI · Cohere · アダプター提供済み、テナントごとに有効化
- vLLM · Ollama · TGI 経由のローカルモデル
- 能力・コスト・フォールバックによるルーティング
すべてのプロバイダーに、1つの統制されたモデルレイヤー。
Anthropic、Gemini、OpenAI、Mistral、Groq、xAI、Cohere — あるいは自社のローカルモデル — をまたぐすべてのエージェント実行を、1つのポリシー兼クォータのブローカー経由でルーティングします。能力とコストでモデルを選び、データ所在地で固定し、許可されていないモデルにエージェントが到達することを決して許しません。
稼働中のアダプター: Anthropic · Gemini · キーは AES-256-GCM で保存時暗号化
単一モデルのハードコードは、単一障害点。
プロバイダーのキーが .env ファイルに散在し、モデルの選択が各エージェントに埋め込まれていると、品質が劣化したプロバイダーを切り替えることも、データ所在地の境界を強制することも、ポリシーが禁じるモデルの呼び出しを止めることもできません。Model Ops はモデルを、統制された差し替え可能な設定に変えます — キーは保存時に暗号化されて返却されず、すべての経路はプラットフォーム全体を動かすのと同じゲートで強制されます。
どのモデルを使うか — そもそも許されるかを判断するルーター。
各実行は、1つのブローカーを通じてモデルに解決されます。どのプロバイダーが対象になるかはポリシーとエージェントのアイデンティティ許可リストが決め、処理できる量はクォータとライブの利用額が決め、どれを選ぶかは能力とコストが決めます。Settings · AI Providers でプロバイダーのキーを一度設定すれば、該当するエージェントは決定的なモックからライブのモデル呼び出しへ即座に切り替わります — 再デプロイは不要です。
- Agent IAM の許可リストが利用可能なモデルを強制 — リスト外は 403 MODEL_NOT_ALLOWED に解決
- キーは AES-256-GCM で保存時暗号化され、返却されません — UI に表示されるのは •••• と末尾4文字のみ
- 実行モードも統制対象: auto はキーがあればライブに切り替わり、live はキー必須、mock は決定的動作を強制
- プロバイダーの差し替えや無効化は中央で完結 — 該当するエージェントはコード変更なしで再ルーティング
ルーティング、クォータ、エンドポイント、自社モデル — 1つのブローカーの下で。
モデルレイヤーの全体像です。どのプロバイダーに到達できるか、各エージェントとテナントがいくらまで使えるか、リクエストをどこで実行してよいか、そして自社のローカルモデルを同じ統制ランタイムへ取り込む方法。
- エージェント単位・テナント単位のモデルクォータ
- ライブの利用額がコスト統制の上限に連動
- クォータ逼迫時は容量を考慮したルーティング
- 能力とコストに基づくモデル選択
- キーは Settings · AI Providers で設定 — .env の編集は不要
- AES-256-GCM で保存時暗号化、返却なし
- ステータス: 未設定 · 設定済み · 無効 · 稼働中
- プロバイダーごとの有効化 / 無効化 / ローテーション
- vLLM · Ollama · TGI のエンドポイント
- 自社ホストのモデルも同じブローカー配下に
- エアギャップ環境および VPC への配備
- プロバイダー / リージョン単位のデータ所在地固定
設定は一度。該当するエージェントがすべて切り替わる。
- 01
プロバイダーを登録
ホスト型のキー(Anthropic、Gemini、…)を追加するか、ブローカーをローカルの vLLM / Ollama / TGI エンドポイントに向けます。キーは保存時に暗号化され、あらゆる画面でマスクされます。
- 02
許可リストとクォータを設定
Agent IAM が各エージェントの許可モデルを固定し、クォータと30日予算が支出に上限を設けます。所在地ルールにより、リクエストの実行が許可される場所が固定されます。
- 03
ルーティングと強制適用
ブローカーは能力とコストから適格なモデルを選びます。リスト外の呼び出しは 403 で失敗し、上限を超える実行は 402 で失敗します。すべての選択は trust ledger に記録されます。
すべての経路が強制され、記録される。
ブローカーは、ランタイムのほかの部分と同じフェイルクローズな判定を返します — そして解決の一つひとつが監査可能です。
Model Ops は、連鎖するゲートの1つ。
モデルレイヤーは、すべての実行を統制するのと同じアイデンティティ・予算・監査の仕組みに接続します。
- 許可モデルのリストはルーティング時に強制
- /platform/agent-iam ›
- モデルの支出は30日予算とハード上限に反映
- /platform/cost-governance ›
- ツールもモデルと同じランタイムで統制
- /platform/mcp-gateway ›
- すべてのモデル解決を記録し、証明可能に
- /platform/trust-ledger ›
セキュリティレビューが承認できるモデルレイヤー。
暗号化された認証情報、フェイルクローズなルーティング、データ所在地の固定、エアギャップ環境向けの持ち込みローカルモデル — 監査人がすでに用いるフレームワークにマッピングされています。
エージェントだけでなく、モデルも統制する。
ホスト型かローカルかを問わず、すべてのプロバイダーを1つのブローカーの背後に。ポリシーでルーティングし、予算で上限をかけ、すべての選択を証明します。