Saltar al contenido principal
AegisPlane
Cómo Funciona

Cambia una URL. Gobierna cada petición de IA.

Apunta la URL base de tu SDK a AegisPlane y sigue construyendo. Cada petición pasa entonces por 9 etapas en línea (auth, política, protección de amenazas, redacción de PII, routing, control de costes, inferencia, rehidratación, auditoría) antes de que la respuesta llegue a tus usuarios.

Gateway en vivo

Observa una petición de principio a fin

Este es el pipeline real. Pulsa cualquier paso para hacer zoom y ver qué hace.

Tu App IA

Llamada API →

AegisPlane AI Control planeRequest limpia
click para ver el interior
07

LLM · Ejecución del Modelo

OpenAIOpenAI
AnthropicAnthropic
OllamaOllama
GroqGroq
GeminiGemini
MistralMistral

← respuesta protegida

↑ haz click en cualquier bloque para ver el interior

Explora cada etapa

Abre cualquier etapa para ver qué comprueba, por qué importa y qué devuelve.

01 AUTH & ACCESS

Solo pasan las solicitudes autorizadas

La identidad y el control de acceso ocurren primero, antes de cualquier otro procesamiento. Las solicitudes inválidas se rechazan al instante.

  • Compatible con API key, JWT, OAuth y mTLS de serie
  • Resolución de tenant y permisos en un único paso
  • El tráfico no autorizado se rechaza antes de tocar ningún recurso
  • Cada intento de acceso queda registrado y es auditable
RequestEntranteVerificar IdentidadAPI KeyComprobar Acceso de TenantPermisosÉXITOAutorizadoFALLOAcceso Denegado
02 POLICY & COMPLIANCE

Gobernanza aplicada antes de que el modelo vea algo

Ocho frameworks se comprueban en tiempo real en cada solicitud. Ante una violación, el gateway bloquea o avisa (tú defines la acción por política) antes de iniciar la inferencia.

  • EU AI Act, NIST, GDPR, HIPAA, ISO 42001/27001, SOC 2 y políticas internas, evaluadas en paralelo
  • Clasificación de riesgo dinámica que se adapta a cada solicitud
  • Las violaciones se señalan en tiempo real: bloquear o avisar según tu política
  • Cada comprobación genera evidencia trazable y exportable
Contexto del RequestTenant + Caso de UsoEvaluar PolíticasMulti-FrameworkÉXITOCompliantFALLOViolación de Política
03 THREAT PROTECTION

Detén inputs hostiles y patrones de abuso

Cada prompt se escanea en busca de inyecciones, jailbreaks e intentos de exfiltración. Las amenazas se bloquean en milisegundos.

  • Detecta inyecciones, jailbreaks, bypasses de rol y exfiltración
  • Regex, detección ML y rulepacks configurables por tenant
  • Bloquea al instante o registra como advertencia según el tipo de amenaza
  • Cada evento se registra con contexto completo para ajuste de reglas
Escanear InputPromptDetectar RiesgoAmenazasÉXITOSeguroFALLOBloqueado
04 PII REDACTION

Los datos sensibles nunca entran en el modelo

El PII se detecta automáticamente y se enmascara antes de que el LLM procese la solicitud. Los datos de tus usuarios permanecen privados.

  • Detecta nombres, emails, DNIs, IBANs, tarjetas e identificadores médicos
  • Totalmente configurable por tenant, cliente y caso de uso
  • Redactado antes de cualquier proveedor, rehidratado en la respuesta: por solicitud, nunca almacenado como tokens persistentes
  • Cada detección queda registrada con tipo de entidad y nivel de riesgo
Detectar Datos SensiblesEscaneo PIIEnmascararTokenizarÉXITORedactadoFALLOFallback
05 SMART ROUTING

Enruta al mejor proveedor por solicitud

AegisPlane elige el modelo óptimo basándose en latencia, coste, calidad y salud. El fallback es automático.

  • Enruta automáticamente al proveedor más rápido y disponible en tiempo real
  • Cambia a un proveedor de respaldo en cuanto uno se degrada
  • Añade o elimina proveedores sin tocar tu código
  • Cada decisión de enrutamiento queda registrada y es explicable
Evaluar OpcionesLatencia · Salud · CosteEnrutar RequestMotor de DecisiónFallback si Hace FaltaAuto-FailoverÉXITOProveedor/Modelo SeleccionadoFALLOProveedor No Disponible
06 LIMITS & COST CONTROL

El gasto se controla antes de que ocurra

Los presupuestos y límites de tasa se aplican pre-ejecución. Las solicitudes se rechazan si superarían límites, no después.

  • Presupuestos por tenant, proveedor o modelo con la granularidad que necesites
  • Las solicitudes se bloquean antes de llamar al proveedor
  • Alertas al 80% de uso para actuar antes de alcanzar el límite
  • Visibilidad de gasto en tiempo real por equipo y modelo
Comprobar LímitesTasa + PresupuestoAprobar GastoPre-EjecuciónÉXITODentro de LímitesFALLOLímite Excedido
07 LLM EXECUTION

El modelo solo ejecuta solicitudes limpias y aprobadas

La inferencia LLM ocurre solo después de que los 6 controles previos han pasado. Ninguna solicitud no autorizada, insegura o fuera de presupuesto llega a este paso.

  • La inferencia solo se ejecuta sobre solicitudes que pasaron todos los controles previos
  • Ninguna solicitud no autorizada, non-compliant o fuera de presupuesto llega al modelo
  • Los errores del modelo son gestionados de forma controlada por el gateway
  • Cada inferencia queda registrada para seguimiento de costes y auditoría
Request EnrutadaDesde el RouterInferencia LLMEjecución del ModeloÉXITORespuesta ListaFALLOError del Modelo
08 PII REHYDRATION

Restaura PII de forma segura en la respuesta final

Después de que el modelo responde, los datos enmascarados se restauran solo cuando es seguro y la respuesta pasó todos los controles.

  • Los valores enmascarados se restauran exactamente donde estaban en el original
  • La rehidratación solo ocurre si la respuesta pasó todos los controles de salida
  • Configurable por tenant, cliente y tipo de respuesta
  • El usuario recibe una respuesta completa y útil con la privacidad intacta
Salida SanitizadaEntradaDetectar PlaceholdersMapa de TokensRehidratarRestaurar ValoresÉXITORespuesta FinalFALLOFallback
09 AUDIT & EVIDENCE

Cada decisión se registra y es trazable

Desde autenticación hasta salida, cada paso se registra con contexto completo. Listo para auditores e investigadores.

  • Tipos de eventos estructurados en todas las etapas del pipeline [PLACEHOLDER: confirmar el recuento exacto, la copia actual dice 12]
  • Filtra por tenant, cliente, tipo de evento o severidad en segundos
  • Trazas completas correlacionadas de extremo a extremo vía OpenTelemetry, exportadas a tu stack
  • Exportación con un clic para EU AI Act, SOC 2 e ISO 27001
Capturar EventosTodas las EtapasEnriquecer ContextoMetadatosAlmacenar EvidenciaAudit TrailÉXITOAuditableFALLOCola Resiliente
Un cambio de una línea

Apunta una URL. Conserva tu código.

Cambia la URL base de tu proveedor por tu endpoint de AegisPlane. Tu SDK de OpenAI, Anthropic o cualquiera compatible con OpenAI sigue funcionando sin cambios. Sin reescrituras, sin nuevas dependencias, sin agente que desplegar.

client.config
Antesbase_url = "https://api.openai.com/v1"
Despuésbase_url = "https://api.aegisplane.com/v1"

Un único endpoint para 11 proveedores: compatible con el SDK de OpenAI, Anthropic y cualquier SDK compatible con OpenAI. El streaming y el function-calling pasan sin cambios.

Despliega a tu manera

Ejecútalo donde lo necesites

El mismo gateway, los mismos controles. Tú eliges dónde vive.

Cloud gestionado

Lo alojamos, escalamos y parcheamos. Recibes un endpoint y empiezas a enviar tráfico: nada que operar.

  • Recibe un endpoint y una API key, y empieza a enviar tráfico
  • Actualizaciones, escalado y fallback de proveedor automáticos
  • Baja latencia, redundante por defecto

Self-hosted

Ejecuta el gateway en tu propia VPC u on-prem. Se despliega como infraestructura (Helm/Terraform, configuración como código), así los datos nunca salen de tu red.

  • Tu infraestructura, tu red, tus claves
  • mTLS, RBAC y OTel integrados
  • mTLS SPIFFE/SPIRE por defecto
Listo para producción

Gobernanza sin penalización de latencia

Las nueve etapas se ejecutan en línea en cada petición, en paralelo cuando es posible, para mantener bajo el overhead añadido. Si el gateway se degrada, falla en modo abierto, así que un problema del gateway nunca se convierte en una caída de tu aplicación.

Bajo
Overhead añadido del gateway
0
Etapas de gobernanza en línea
Auto
Fallback y reintentos de proveedor
Preguntas frecuentes

Cómo funciona el flujo en la práctica

Las preguntas que se hacen los equipos antes de enviar tráfico de producción al gateway.

Está diseñado para alta disponibilidad y falla en modo abierto: un problema del gateway no debe tumbar tu aplicación. En el cloud gestionado corre en instancias redundantes y autoescaladas; en self-hosted ejecutas tus propias réplicas. Si un proveedor upstream falla, las peticiones hacen fallback y se reintentan automáticamente.

El gateway procesa cada petición en memoria para aplicar las políticas y luego la reenvía. La PII se detecta y redacta antes de que ningún proveedor la vea, y se rehidrata en la respuesta: por solicitud (request-scoped), no se almacena como tokens persistentes. Tú controlas qué se registra: evidencia de auditoría trazable completa, o solo metadatos. En self-hosted, los datos nunca salen de tu red.

Sí. Las respuestas token a token pasan por las mismas etapas de gobernanza sin romper el stream, así que las experiencias de chat y sensibles a la latencia siguen funcionando igual.

No. Apuntas la URL base de tu proveedor a tu router de AegisPlane y sigues usando el SDK de OpenAI, Anthropic o cualquiera compatible con OpenAI exactamente igual. Sin nuevas dependencias, sin reescrituras.

Overhead bajo y medido. Las nueve etapas se ejecutan en línea y en paralelo cuando es posible, así que la gobernanza no se convierte en un impuesto de latencia para tus usuarios, y el gateway falla en modo abierto si alguna vez se degrada. [PLACEHOLDER: publica aquí una cifra medida de p50/p95 una vez evaluada.]

Sí. Las políticas, guardrails, rulepacks de PII, routing y presupuestos son configurables por tenant, por cliente y por nivel de riesgo: bloquear, avisar o permitir según tu contexto.

Listo para comenzar

Despliégalo, cambia una URL y sigue construyendo.

Cada etapa se ejecuta en línea y de forma automática. Sin cambios de código, sin cambiar de SDK, sin agente que desplegar, y puedes alojarlo en tu propia VPC.