Cambia una URL. Gobierna cada petición de IA.
Apunta la URL base de tu SDK a AegisPlane y sigue construyendo. Cada petición pasa entonces por 9 etapas en línea (auth, política, protección de amenazas, redacción de PII, routing, control de costes, inferencia, rehidratación, auditoría) antes de que la respuesta llegue a tus usuarios.
Observa una petición de principio a fin
Este es el pipeline real. Pulsa cualquier paso para hacer zoom y ver qué hace.
↑ haz click en cualquier bloque para ver el interior
Explora cada etapa
Abre cualquier etapa para ver qué comprueba, por qué importa y qué devuelve.
Solo pasan las solicitudes autorizadas
La identidad y el control de acceso ocurren primero, antes de cualquier otro procesamiento. Las solicitudes inválidas se rechazan al instante.
- Compatible con API key, JWT, OAuth y mTLS de serie
- Resolución de tenant y permisos en un único paso
- El tráfico no autorizado se rechaza antes de tocar ningún recurso
- Cada intento de acceso queda registrado y es auditable
Gobernanza aplicada antes de que el modelo vea algo
Ocho frameworks se comprueban en tiempo real en cada solicitud. Ante una violación, el gateway bloquea o avisa (tú defines la acción por política) antes de iniciar la inferencia.
- EU AI Act, NIST, GDPR, HIPAA, ISO 42001/27001, SOC 2 y políticas internas, evaluadas en paralelo
- Clasificación de riesgo dinámica que se adapta a cada solicitud
- Las violaciones se señalan en tiempo real: bloquear o avisar según tu política
- Cada comprobación genera evidencia trazable y exportable
Detén inputs hostiles y patrones de abuso
Cada prompt se escanea en busca de inyecciones, jailbreaks e intentos de exfiltración. Las amenazas se bloquean en milisegundos.
- Detecta inyecciones, jailbreaks, bypasses de rol y exfiltración
- Regex, detección ML y rulepacks configurables por tenant
- Bloquea al instante o registra como advertencia según el tipo de amenaza
- Cada evento se registra con contexto completo para ajuste de reglas
Los datos sensibles nunca entran en el modelo
El PII se detecta automáticamente y se enmascara antes de que el LLM procese la solicitud. Los datos de tus usuarios permanecen privados.
- Detecta nombres, emails, DNIs, IBANs, tarjetas e identificadores médicos
- Totalmente configurable por tenant, cliente y caso de uso
- Redactado antes de cualquier proveedor, rehidratado en la respuesta: por solicitud, nunca almacenado como tokens persistentes
- Cada detección queda registrada con tipo de entidad y nivel de riesgo
Enruta al mejor proveedor por solicitud
AegisPlane elige el modelo óptimo basándose en latencia, coste, calidad y salud. El fallback es automático.
- Enruta automáticamente al proveedor más rápido y disponible en tiempo real
- Cambia a un proveedor de respaldo en cuanto uno se degrada
- Añade o elimina proveedores sin tocar tu código
- Cada decisión de enrutamiento queda registrada y es explicable
El gasto se controla antes de que ocurra
Los presupuestos y límites de tasa se aplican pre-ejecución. Las solicitudes se rechazan si superarían límites, no después.
- Presupuestos por tenant, proveedor o modelo con la granularidad que necesites
- Las solicitudes se bloquean antes de llamar al proveedor
- Alertas al 80% de uso para actuar antes de alcanzar el límite
- Visibilidad de gasto en tiempo real por equipo y modelo
El modelo solo ejecuta solicitudes limpias y aprobadas
La inferencia LLM ocurre solo después de que los 6 controles previos han pasado. Ninguna solicitud no autorizada, insegura o fuera de presupuesto llega a este paso.
- La inferencia solo se ejecuta sobre solicitudes que pasaron todos los controles previos
- Ninguna solicitud no autorizada, non-compliant o fuera de presupuesto llega al modelo
- Los errores del modelo son gestionados de forma controlada por el gateway
- Cada inferencia queda registrada para seguimiento de costes y auditoría
Restaura PII de forma segura en la respuesta final
Después de que el modelo responde, los datos enmascarados se restauran solo cuando es seguro y la respuesta pasó todos los controles.
- Los valores enmascarados se restauran exactamente donde estaban en el original
- La rehidratación solo ocurre si la respuesta pasó todos los controles de salida
- Configurable por tenant, cliente y tipo de respuesta
- El usuario recibe una respuesta completa y útil con la privacidad intacta
Cada decisión se registra y es trazable
Desde autenticación hasta salida, cada paso se registra con contexto completo. Listo para auditores e investigadores.
- Tipos de eventos estructurados en todas las etapas del pipeline [PLACEHOLDER: confirmar el recuento exacto, la copia actual dice 12]
- Filtra por tenant, cliente, tipo de evento o severidad en segundos
- Trazas completas correlacionadas de extremo a extremo vía OpenTelemetry, exportadas a tu stack
- Exportación con un clic para EU AI Act, SOC 2 e ISO 27001
Apunta una URL. Conserva tu código.
Cambia la URL base de tu proveedor por tu endpoint de AegisPlane. Tu SDK de OpenAI, Anthropic o cualquiera compatible con OpenAI sigue funcionando sin cambios. Sin reescrituras, sin nuevas dependencias, sin agente que desplegar.
base_url = "https://api.openai.com/v1"base_url = "https://api.aegisplane.com/v1"Un único endpoint para 11 proveedores: compatible con el SDK de OpenAI, Anthropic y cualquier SDK compatible con OpenAI. El streaming y el function-calling pasan sin cambios.
Ejecútalo donde lo necesites
El mismo gateway, los mismos controles. Tú eliges dónde vive.
Cloud gestionado
Lo alojamos, escalamos y parcheamos. Recibes un endpoint y empiezas a enviar tráfico: nada que operar.
- Recibe un endpoint y una API key, y empieza a enviar tráfico
- Actualizaciones, escalado y fallback de proveedor automáticos
- Baja latencia, redundante por defecto
Self-hosted
Ejecuta el gateway en tu propia VPC u on-prem. Se despliega como infraestructura (Helm/Terraform, configuración como código), así los datos nunca salen de tu red.
- Tu infraestructura, tu red, tus claves
- mTLS, RBAC y OTel integrados
- mTLS SPIFFE/SPIRE por defecto
Gobernanza sin penalización de latencia
Las nueve etapas se ejecutan en línea en cada petición, en paralelo cuando es posible, para mantener bajo el overhead añadido. Si el gateway se degrada, falla en modo abierto, así que un problema del gateway nunca se convierte en una caída de tu aplicación.
Cómo funciona el flujo en la práctica
Las preguntas que se hacen los equipos antes de enviar tráfico de producción al gateway.
Está diseñado para alta disponibilidad y falla en modo abierto: un problema del gateway no debe tumbar tu aplicación. En el cloud gestionado corre en instancias redundantes y autoescaladas; en self-hosted ejecutas tus propias réplicas. Si un proveedor upstream falla, las peticiones hacen fallback y se reintentan automáticamente.
El gateway procesa cada petición en memoria para aplicar las políticas y luego la reenvía. La PII se detecta y redacta antes de que ningún proveedor la vea, y se rehidrata en la respuesta: por solicitud (request-scoped), no se almacena como tokens persistentes. Tú controlas qué se registra: evidencia de auditoría trazable completa, o solo metadatos. En self-hosted, los datos nunca salen de tu red.
Sí. Las respuestas token a token pasan por las mismas etapas de gobernanza sin romper el stream, así que las experiencias de chat y sensibles a la latencia siguen funcionando igual.
No. Apuntas la URL base de tu proveedor a tu router de AegisPlane y sigues usando el SDK de OpenAI, Anthropic o cualquiera compatible con OpenAI exactamente igual. Sin nuevas dependencias, sin reescrituras.
Overhead bajo y medido. Las nueve etapas se ejecutan en línea y en paralelo cuando es posible, así que la gobernanza no se convierte en un impuesto de latencia para tus usuarios, y el gateway falla en modo abierto si alguna vez se degrada. [PLACEHOLDER: publica aquí una cifra medida de p50/p95 una vez evaluada.]
Sí. Las políticas, guardrails, rulepacks de PII, routing y presupuestos son configurables por tenant, por cliente y por nivel de riesgo: bloquear, avisar o permitir según tu contexto.
Listo para comenzar
Despliégalo, cambia una URL y sigue construyendo.
Cada etapa se ejecuta en línea y de forma automática. Sin cambios de código, sin cambiar de SDK, sin agente que desplegar, y puedes alojarlo en tu propia VPC.
