Todas las capacidades del runtime gobernado y lo que estamos mejorando. Este registro refleja la versión pública actual — agrupado por área, con cada entrada ligada a una capacidad disponible hoy y sin historial de versiones inventado.
Agrupado por área · Entregado frente a Mejorado · enlaces a la plataforma
Runtime de gobernanza
Las puertas que supera cada ejecución.
Creas un agente y cada ejecución recorre la misma cadena de gobernanza de fallo cerrado: identidad, presupuesto, guardarraíles, registro, control tower, ejecución, guarda de salida, auditoría. Denegar es lo predeterminado.
Policy-as-CodeEntregado
Reglas de política verificables, con simulación y pruebas golden
Escribe reglas que se evalúan por orden de prioridad y en las que gana el efecto más restrictivo (deny > require_approval > allow), previsualiza una decisión y su traza por regla antes de publicarla, y somete cada cambio a una suite de pruebas golden.
Las acciones, como objetos gobernados de primera clase
Cada acción recorre dry-run → propose → approve/deny → execute → compensate, con un registro de invocaciones inmutable y un paquete de evidencia. Las acciones de alto riesgo llegan a una bandeja de aprobaciones humana; las claves de reversión declaradas habilitan la compensación.
Niveles de autonomía explícitos con un umbral de riesgo mínimo
Ajusta la autonomía de cada agente, de suggest_only a autonomous. La supervisión solo puede endurecer una decisión, nunca rebajar el umbral de aprobación de la propia acción — y el break-glass de administración fuerza la ejecución con un motivo obligatorio y auditado.
Cada agente lleva su propia identidad, sus herramientas permitidas, sus modelos permitidos, sus datos permitidos y su canal de despliegue. El runtime se niega a ejecutar agentes inexistentes, en borrador, sin publicar, de otro tenant, caducados, pausados o no autorizados.
Servidores y herramientas Model Context Protocol gobernados
Los servidores MCP se registran como pending y no pueden invocarse hasta su aprobación; bloquearlos es un interruptor de emergencia inmediato. Las invocaciones gobernadas analizan la entrada con DLP, aplican una lista de herramientas permitidas por servidor y registran cada llamada con la E/S redactada.
Una vista agregada por tenant de agentes, ejecuciones, gasto, herramientas y controles activos — con pausa y desactivación de herramientas en un clic que el runtime aplica de verdad (un agente pausado se rechaza con 409 AGENT_PAUSED).
Cada resultado gobernado queda registrado para que un tercero pueda comprobarlo. El registro de auditoría está encadenado por hash, los resultados emiten recibos firmados y un grafo de procedencia cose la cadena desde la persona hasta el resultado.
Trust LedgerEntregado
Auditoría encadenada por hash y a prueba de manipulación
Cada evento de auditoría está encadenado por hash, de modo que cualquier inserción, edición o borrado es detectable, con un endpoint verify que demuestra la integridad de un rango y devuelve la secuencia rota si la cadena fue alterada.
Recibos de resultado firmados, verificables sin conexión
Cada resultado gobernado — una ejecución de agente, la ejecución de una acción, una decisión de aprobación — emite un recibo compacto con firma separada que un tercero puede validar sin conexión; la clave de firma la aporta el operador y en producción es de fallo cerrado.
Un grafo de linaje consultable cose la cadena Human → Agent → Skill → Prompt → Policy → Model → Tool → Artifact → Outcome → Approval, y cada dato mostrado enlaza con su documento de origen, su página y su recuadro.
Crea agentes que se ganen el derecho a salir a producción.
Crea agentes gobernados en lenguaje natural o en código y hazlos avanzar por un ciclo de vida real —borrador, prueba, revisión, publicación— con un umbral de fiabilidad que decide qué llega a producción.
Agent StudioEntregado
Estudio no-code con el ciclo de vida completo del agente
Crea agentes con skills, conocimiento, guardrails y política de modelos, y recórrelos por el ciclo de vida draft → test → review → approve → publish → deploy → pause → retire, con versionado de prompts e instrucciones y un banco de evaluación integrado.
Un umbral de fiabilidad que controla la publicación en producción
Una puntuación de 0–100 combina la tasa de éxito, la tasa de aprobación de evaluaciones y los incidentes en una ventana móvil. El registro rechaza publicar un agente que tiene señal suficiente y puntúa por debajo del umbral (409 RELIABILITY_TOO_LOW); los agentes nuevos se publican sin restricción y, si la puntuación no está disponible, la publicación no se bloquea.
Modela tipos de objeto, relaciones y métricas verificadas con permisos a nivel de objeto, propiedad y acción, además de versionado, promoción, rollback y migración de la ontología para que el modelo evolucione con seguridad.
Orquesta trabajo de varios pasos y deja que los eventos disparen acciones gobernadas, sin salirte nunca de los controles.
AutomatizaciónEntregado
Flujos de trabajo y reglas evento-condición-acción
Compón flujos de trabajo de varios pasos y automatizaciones evento-condición-acción que proponen acciones gobernadas, se ejecutan por programación o por cola y fluyen por el Real-Time Hub, con cada paso pasando los mismos controles.
No puedes gobernar lo que no puedes medir. La puntuación de calidad por ejecución, las compuertas de evaluación, un laboratorio de simulación y un depurador con la traza completa convierten la calidad del agente en un número que puedes vigilar y usar como condición.
ObservabilidadEntregado
Puntuación de calidad por ejecución y compuertas de publicación por evaluación
Cada ejecución gobernada se puntúa por calidad — fidelidad, cobertura de citas, seguridad — y se captura la traza para reproducirla; las suites de evaluación de referencia actúan como compuertas de publicación que bloquean una regresión antes del lanzamiento. Las ejecuciones en vivo devuelven quality { overall: 100 }.
El depurador reconstruye la ejecución completa — prompt → context → model → tools → approval → output — con cada paso sellado con su coste, su latencia y su veredicto, y cada salto enlazando de vuelta con el trust ledger.
Compara prompts y modelos en A/B contra tráfico real y contrasta los resultados antes de promover un cambio, de modo que un candidato se gane su sitio antes de tocar las ejecuciones de producción.
Pon un presupuesto al runtime y vincula cada dólar al trabajo que compró.
Gobernanza de costosEntregado
Topes de gasto móviles con alertas y límites duros
Define presupuestos con alcance de tenant o de agente, con un umbral de alerta y un límite duro opcional. El gasto se calcula en vivo sobre una ventana móvil de 30 días y una ejecución se bloquea en cuanto el gasto previsto superaría un límite duro, emitiendo eventos BudgetExceeded.
Gobierna qué modelos puede usar un agente y enruta las ejecuciones a través de un bróker de cómputo, de modo que la elección de modelo sea una decisión de política, con el uso, la adopción y el ROI consolidándose junto al costo.
Publica una solución gobernada una sola vez y despliégala donde quieras.
Empaqueta la solución gobernada de un tenant en un artefacto versionado, firmado y portable que puedes verificar y volver a desplegar — entre tenants y en entornos aislados (air-gapped).
Solution PacksEntregado
Solution Packs firmados y verificables
Un pack agrupa tipos de ontología, políticas, acciones y metadatos de agentes; su contenido se canonicaliza, se convierte en hash y se firma con HMAC. verifyPack comprueba tanto el hash del contenido como la firma: cualquier manipulación rompe hashOk y cualquier secreto incorrecto rompe signatureOk.
Importación con verificación previa y vista previa de diferencias
Al importar un pack ves las diferencias sección por sección —añadido, cambiado, sin cambios— frente a tus definiciones en vivo; luego se verifica antes de aplicar y se rechaza un pack inválido (409). La transferencia ocurre a través del artefacto, nunca con una escritura directa entre tenants.
Este es el registro de capacidades del runtime gobernado actual, no un historial de versiones con fechas. ¿Quieres novedades a medida que se publiquen nuevas capacidades?Suscríbete a las novedades
¿Quieres verlo en profundidad?
Lee cómo encaja el runtime gobernado, o míralo funcionar sobre tu propio trabajo.