Supervisión
humana HITL
Human-in-the-loop by design: ninguna acción de consecuencias irreversibles se ejecuta sin confirmación explícita de una persona identificada. El Art. 14 del AI Act no es opcional.
Tres niveles según criticidad de la decisión
Asistencia sin bloqueo
La IA proporciona información o redacta un borrador. El usuario puede actuar sin aprobación explícita. Registro en audit trail pero sin firma. Aplica a consultas científicas sin impacto directo en proceso GxP.
Aprobación con clic
La acción propuesta queda en pausa hasta que el usuario la confirma explícitamente. La confirmación se registra con identidad Azure AD y timestamp. Aplica a modificaciones de parámetros de proceso.
Dos aprobadores + e-signature
Acciones de alto impacto requieren dos aprobadores con roles distintos. Cada uno firma electrónicamente. El sistema bloquea la acción hasta recibir ambas firmas. Aplica a liberación de lotes o decisiones clínicas.
Componentes del sistema HITL
Claude (confidence scoring)
El modelo informa su nivel de confianza y señala cuando una respuesta está fuera de su distribución de entrenamiento. Las respuestas de baja confianza disparan automáticamente revisión de Nivel 2.
Azure Logic Apps (workflow)
Orquestación del flujo de aprobación: notificación al revisor, timeout configurable, escalado a supervisor si no hay respuesta en el plazo establecido. Todo auditado en Azure Monitor.
Microsoft Power Apps (UI)
Interfaz de revisión con el contexto completo: la pregunta, el contexto RAG recuperado, las fuentes y la respuesta propuesta. El revisor puede aprobar, rechazar o corregir con trazabilidad total.
Azure AD (identidad del revisor)
Cada aprobación va firmada con la identidad verificada del revisor: nombre, rol, MFA y timestamp. Vinculado al audit trail inmutable del evento que aprobó.
LangChain (guardrails)
Guardrails pre-configurados que detectan respuestas fuera del scope regulatorio, alucinaciones de referencias o contenido clínicamente sensible — y los marcan para revisión obligatoria.
Fabric (dashboard de revisiones)
Panel centralizado de elementos pendientes de revisión, SLA de respuesta y métricas de rechazo. Permite al responsable de calidad identificar patrones de fallos del modelo.