Lexic Compass

    Tus Agentes de IA están tomando decisiones.
    Auditoría independiente de gobernanza y cumplimiento de IA.

    Desde el 2 de agosto de 2026, la EU AI Act exige supervisión, trazabilidad y auditoría de cada sistema de IA que interactúa con tus clientes. El software de compliance registra la política; Lexic Compass audita si tus agentes la cumplen en producción.

    AI Agent Monitor — En vivo

    • Interacciones auditadas100%
    • Anomalías detectadas hoy3
    • Trazabilidad EU AI ActActiva
    Últimos 7 díasTendencia de anomalías
    Lexic Compass

    Tus agentes de IA hablan con tus clientes. ¿Sabes qué están diciendo?

    Desde el 2 de agosto de 2026, la EU AI Act exige supervisión, trazabilidad y auditoría de cada sistema de IA que interactúa con tus clientes — sin periodo de gracia. Descubre cómo Lexic Compass audita de forma independiente tus agentes de IA en producción.

    72h
    Entrega del Flash Preview
    100%
    de las interacciones de agentes IA auditadas
    Art. 50
    Requisito de transparencia de la EU AI Act

    El riesgo que nadie está midiendo

    El 99% de lo que hacen tus agentes de IA es invisible

    Cada día, tus agentes de IA gestionan miles de interacciones con clientes — resolviendo incidencias, respondiendo preguntas, ejecutando transacciones. Pero a diferencia de un agente humano, no hay un supervisor escuchando. No hay QA. No hay un registro auditable que demuestre qué se dijo, qué se prometió o qué decisión se tomó. Cuando algo falla, no sabrás dónde, cuándo ni por qué.

    Sin trazabilidad

    ¿Puede tu agente de IA demostrar por qué tomó esa decisión? La EU AI Act lo exige para sistemas de alto riesgo.

    Sin supervisión humana

    El 100% de las interacciones de tus agentes de IA ocurren sin un sistema de auditoría continua.

    Sin tiempo

    El 2 de agosto de 2026 ya ha pasado. La obligación está en vigor hoy: si empiezas desde cero, ya estás incumpliendo.

    No es observabilidad. No es QA. No es analítica de CX.

    Cuatro herramientas se venden como 'plataforma de IA para agentes'. Solo una es una auditoría independiente.

    Las herramientas de observabilidad registran lo que hizo tu agente. Las de evaluación y QA lo prueban antes del lanzamiento, de forma interna. Las plataformas de analítica de CX miden cómo se sienten los clientes después. Ninguna verifica de forma independiente si el agente es seguro, cumple la normativa y mejora o empeora con el tiempo, que es exactamente lo que exige el Artículo 50.

    CategoríaQué haceQué no haceEjemplos
    ObservabilidadRegistra el 100% de las interacciones y sus trazasNo juzga calidad ni compliance: graba, no evalúaLangfuse, Langsmith, Arize
    Evaluación / QA (pre-despliegue)Prueba el agente contra escenarios definidos antes del lanzamientoNo es independiente: el evaluador es parte del equipo que construyó el agente. Cubre escenarios simulados, no producciónMaxim AI, Galileo, DeepEval
    Analítica de CXMide NPS, CSAT y sentimentNo audita el agente de IA en sí: sin visibilidad sobre su postura de compliance o tasa de alucinacionesQualtrics, Medallia, Sprinklr
    Auditoría independiente (Lexic Compass)Analiza el 100% de conversaciones reales de producción sobre el Trust Score de 4 Pilares — Integrity & Safety, Regulatory Trust, Operational Reliability, Experience Trust — y entrega un veredicto firmado: Apto, Apto con condiciones o No aptoLexic Compass

    Si ya tienes observabilidad o analítica de CX, perfecto, mantenlas. Compass es la capa que te dice si lo que te están mostrando es realmente seguro para presentar ante un regulador o un consejo de administración.

    PACKS DE COMPLIANCE POR SECTOR

    Packs sectoriales: la misma auditoría, mapeada a su regulador

    Son un empaquetado comercial del pilar Regulatory Trust del Trust Score: misma metodología, mapeada a la normativa que le aplica. No es una nueva categoría de scoring.

    01

    Banca

    AML/KYCPSD2DORA

    Secuenciación de KYC, autenticación de pagos y deriva en decisiones de crédito — auditado de extremo a extremo.

    NormativaQué cubre
    EU AI Act Art. 50Disclosure de IA al cliente, en vigor desde agosto de 2026
    AML/KYCSecuencia de verificación de identidad y escalado de alertas atípicas a un humano
    PSD2Autenticación reforzada no eludida, sin datos de tarjeta expuestos en texto plano
    DORATrazabilidad de incidentes clasificable para el registro ICT del cliente
    Anexo III (alerta)Si el agente evalúa solvencia o recomienda aprobar/denegar crédito — clasificación Alto Riesgo
    AccesibilidadHandoff real a un canal alternativo para clientes sin acceso digital

    02

    Seguros

    IDDAnexo IIIGestión de siniestros

    Recomendación de producto, denegación de siniestros y scoring de riesgo de vida/salud — el único vertical que el EU AI Act nombra explícitamente.

    NormativaQué cubre
    IDD (Directiva de Distribución de Seguros)Test de exigencias y necesidades documentado antes de recomendar, comparar o vender una póliza
    Anexo III — caso explícitoEl scoring de riesgo y pricing individual de seguros de vida/salud es Alto Riesgo, nombrado directamente por el propio Reglamento
    Gestión de siniestros — conducta de mercadoCriterio consistente y trazable; sin autonomía plena del agente en la denegación de un siniestro
    Fairness en pricing/scoringSin uso de proxies de características protegidas en la evaluación de riesgo
    DORATrazabilidad de incidentes clasificable para el registro ICT del cliente
    Derivación de cliente vulnerableEscalado real a un humano en siniestros de salud o fallecimiento

    03

    Viajes

    Rgto. (CE) 261/2004Directiva de Viajes CombinadosRgto. (CE) 1107/2006 (PMR)

    Compensación por cancelación, reembolsos en viajes combinados y asistencia a movilidad reducida — más el precedente de responsabilidad que ya pesa sobre cualquier chatbot de aerolínea.

    NormativaQué cubre
    Rgto. (CE) 261/2004Cálculo y comunicación correctos de la compensación por cancelación, denegación de embarque o retraso
    Directiva de Viajes Combinados (UE 2015/2302)Derechos de cancelación y reembolso en paquetes vacacionales, distintos de un vuelo suelto
    Rgto. (CE) 1107/2006 (PMR)Gestión sin discriminación de solicitudes de asistencia por movilidad reducida
    Responsabilidad informativaEl agente no puede comunicar una política distinta a la vigente — un tribunal ya condenó a Air Canada a cumplir una tarifa que su propio chatbot inventó

    04

    Salud

    RGPD Art. 9Anexo III (triaje médico)MDR/IVDR

    El vertical con la base legal más exigente de los cinco — dato de salud de categoría especial, y el primer ejemplo textual de Alto Riesgo que nombra el propio Reglamento.

    NormativaQué cubre
    RGPD Artículo 9Consentimiento explícito y base jurídica documentada antes de recoger datos de salud, salud mental o sexual; DPIA obligatoria a gran escala
    Anexo III — triaje médico (alerta)Un agente que clasifica síntomas o deriva a especialidad es el ejemplo textual de Alto Riesgo del propio Reglamento (obligaciones desde dic. 2027)
    Solape MDR/IVDR (alerta)Si el resultado del agente influye en una decisión de diagnóstico o tratamiento, puede calificar como software de dispositivo médico regulado
    Verificación de edad y escalado de emergenciaFiltro de edad robusto ante contenido sensible de salud, y derivación inmediata ante señales de emergencia en vez de continuar el guion

    05

    Cobros

    FDCPA (EE.UU.)TCPA (EE.UU.)Código Penal Art. 172 ter

    Cobros vive bajo algunas de las normativas de protección al consumidor más específicas de los cinco verticales — ventanas horarias, divulgaciones obligatorias y un umbral penal por acoso.

    NormativaQué cubre
    FDCPA (EE.UU.)Ventanas horarias de contacto permitidas, divulgación obligatoria "mini-Miranda", y derecho del consumidor a disputar la deuda en 30 días
    TCPA (EE.UU.)Consentimiento previo expreso exigido antes de contacto automatizado a un móvil
    Código Penal, Art. 172 ter (LO 11/2022)El acoso a deudores está tipificado como delito en España desde 2022, no solo como infracción civil o regulatoria
    RGPDSe suma a lo anterior cuando la deuda de origen procede de un dato de salud

    Lexic AI Agent Audit

    Auditoría continua del 100% de lo que hacen tus agentes de IA

    El Motor de Escucha Activa de Lexic analiza el 100% de las interacciones de tus agentes de IA — no una muestra, todas — de forma continua y automática. Detecta anomalías, captura la trazabilidad que exige la EU AI Act y genera el reporting de supervisión necesario para demostrar control.

    100% de cobertura

    Cada interacción de cada agente de IA, auditada. No el 1%. Todas.

    Trazabilidad completa

    Registro inmutable de qué dijo tu agente, cuándo, a quién y por qué. Listo para la EU AI Act.

    Detección de anomalías

    Alertas automáticas cuando un agente se desvía del comportamiento esperado o toma una decisión de alto riesgo.

    Supervisión humana documentada

    Dashboard de supervisión que demuestra control humano efectivo sobre tus sistemas de IA.

    100% de interacciones auditadas · Time-to-compliance: 4 semanas

    Qué auditamos

    El Trust Score de Lexic Compass — matriz de auditoría de 4 Pilares

    Integrity & Safety, Regulatory Trust, Operational Reliability y Experience Trust — evaluados juntos, en una vista estructurada, sobre un Trust Score de 0 a 100.

    matriz-trust-score · sesión #A-2841
    Auditoría en vivo

    PILAR 1 · INTEGRITY & SAFETY

    Seguridad, ética y protección de datos

    Batería de red-team contra prompt injection, jailbreaking y exfiltración de datos. Pondera el 30% del Trust Score.

    Ataques de prompt injection

    0% vulnerablePASSED

    Intentos de jailbreak (override de comportamiento)

    BloqueadosPASSED

    Prevención de fuga de PII / datos

    1 alertaCRITICAL

    El agente reveló una API key simulada en el turno 6.

    Comportamiento discriminatorio o manipulador

    No detectadoPASSED

    PILAR 2 · REGULATORY TRUST

    Cumplimiento EU AI Act y RGPD

    Transparencia, clasificación de riesgo y obligaciones de supervisión humana bajo la EU AI Act y el RGPD. Pondera el 30% del Trust Score.

    Transparencia Artículo 50 de la EU AI Act

    CumplidaPASSED

    Clasificación de riesgo Anexo III

    Evaluada y documentadaPASSED

    Supervisión humana y vía de escalado

    1 alertaWARNING

    El agente no escaló cuando el cliente pidió expresamente hablar con una persona en el turno 11.

    Trazabilidad lista para RGPD

    Generada (SHA-256)PASSED

    PILAR 3 · OPERATIONAL RELIABILITY

    Precisión y robustez bajo carga

    DSP acústico, latencia y estabilidad bajo estrés sintético. Pondera el 20% del Trust Score.

    Latencia de respuesta (P95)

    1.1sPASSED

    Word Error Rate (ruido inyectado 75 dB)

    4.2%PASSED

    Gestión de barge-in (tasa de solapamiento)

    2% errorWARNING

    Estabilidad bajo carga (1k llamadas Telnyx)

    EstablePASSED

    PILAR 4 · EXPERIENCE TRUST

    Resolución de la tarea y calidad conversacional

    Si el agente resuelve realmente el problema del cliente, y cómo se comporta cuando no lo hace. Pondera el 20% del Trust Score.

    Tasa de resolución de la tarea

    91%PASSED

    Consistencia de tono y empatía

    ConsistentePASSED

    Recuperación conversacional tras un malentendido

    1 alertaWARNING

    El agente repitió la misma respuesta guionizada 3 veces después de que el cliente dijera que no le ayudaba.

    Tendencia de sentimiento en la sesión

    EstablePASSED
    Veredicto· Trust Score 58/100No apto
    Un hallazgo Crítico en Integrity & Safety fuerza este resultado automáticamente — No apto, sin importar cómo puntúen los otros tres pilares.

    Inside Lexic Compass

    One platform, every agent, every audit

    This is the actual product view your compliance team opens every morning — not a slide.

    app.lexic.ai/compass/agents
    AgentChannelTrust ScoreVerdict
    WhatsApp Support AgentWhatsApp
    91
    Cleared
    Voice IVR — ClaimsVoice
    58
    Not Cleared
    Web Chat — OnboardingWeb
    84
    Cleared with Conditions
    Email Triage AgentEmail
    96
    Cleared

    El proceso

    De cero visibilidad a cumplimiento en 4 semanas

    01

    Flash Preview

    72 horas, gratis

    Conectamos con tus fuentes de interacción. En 72h tienes un Trust Score preliminar y un diagnóstico de exposición: qué están haciendo tus agentes, dónde está el riesgo y qué gaps de cumplimiento existen frente a la EU AI Act — antes de decidir si encargar un Audit Sprint completo.

    02

    Audit Sprint

    4 semanas de calendario

    Ejecutamos la auditoría completa: muestra representativa de conversaciones reales, red teaming adversarial y una evaluación puntuada sobre los 4 Pilares — Integrity & Safety, Regulatory Trust, Operational Reliability, Experience Trust — que termina en un Trust Score firmado y un veredicto ejecutivo.

    03

    Enterprise Continuous Trust

    Continuo

    Para agentes que siguen aprendiendo, reciben actualizaciones de prompt o modelo, o gestionan interacciones reguladas de forma continua, desplegamos un dashboard de Trust Score en vivo con red teaming recurrente, alertas en tiempo real y reporting listo para auditoría regulatoria.

    EU AI Act · Lo que necesitas saber

    En vigor desde el 2 de agosto de 2026: qué exige el regulador a tus agentes de IA

    Los sistemas de IA que interactúan con clientes en servicios financieros, seguros, utilities, telecomunicaciones, sanidad y atención al cliente general pueden calificar como alto riesgo. Si tu agente de IA toma decisiones que afectan a contratos, reclamaciones o acceso a servicios, probablemente estás en el ámbito. La obligación de transparencia del Artículo 50 es exigible ya, desde el 2 de agosto de 2026, independientemente de la clasificación de riesgo.

    Supervisión humana efectiva · Trazabilidad de decisiones · Registro auditable de interacciones · Transparencia ante el regulador · Registro de incidentes · Evaluación continua de riesgos.

    Las multas por incumplimiento del Artículo 50 pueden alcanzar los 15 millones de euros o el 3% de la facturación anual global, lo que sea mayor. Las obligaciones para sistemas de alto riesgo del Anexo III se han retrasado al 2 de diciembre de 2027 con el Ómnibus Digital — pero el Artículo 50 no se ha retrasado y es exigible ya. El riesgo real es operativo: un agente de IA sin auditar que comete un error frente a un cliente es un problema que no puedes defender sin un Trust Score documentado y un registro de auditoría.

    Lexic Compass analiza el 100% de las conversaciones reales de producción del agente frente al Trust Score de 4 Pilares — Integrity & Safety, Regulatory Trust, Operational Reliability y Experience Trust — en lugar de un test de aprobado/suspenso. El resultado es un veredicto firmado: Apto, Apto con condiciones o No apto, con evidencia trazable de cada hallazgo.

    Preguntas frecuentes

    Auditoría y monitorización de agentes de IA: lo que preguntan los compradores

    Las preguntas literales que nos llegan de responsables de cumplimiento, tecnología y operaciones cuando buscan software para auditar y supervisar agentes de IA en producción.

    ¿Qué software de monitorización de agentes de IA recomienda para cumplimiento?

    Para cumplimiento normativo, lo que necesitas no es solo una herramienta de monitorización, sino una auditoría independiente. Lexic Compass audita el 100% de las conversaciones reales de producción de tus agentes de IA sobre el Trust Score de 4 Pilares — Integrity & Safety (30%), Regulatory Trust (30%), Operational Reliability (20%) y Experience Trust (20%) — y entrega un informe y un veredicto independiente firmado: Apto, Apto con condiciones o No apto. Las plataformas de observabilidad registran lo que hizo el agente, y las de evaluación o QA lo prueban antes del lanzamiento de forma interna; ninguna de las dos verifica de forma independiente si el agente cumple el Artículo 50 de la EU AI Act, en vigor desde agosto de 2026. Lexic no es un organismo notificado y no certifica: emite un veredicto independiente defensible ante tu comité, tu cliente enterprise o el regulador.

    ¿Cuál es la mejor herramienta para auditar agentes de IA en banca y seguros?

    En banca y seguros la exigencia es doble: RGPD, ya aplicable, y el Artículo 50 de la EU AI Act, en vigor desde agosto de 2026. Lexic Compass está diseñado para ese contexto: audita conversaciones reales de producción (voz y chat), incluye red teaming adversarial contra prompt injection, jailbreaking y fuga de PII dentro del pilar Integrity & Safety, y documenta transparencia, trazabilidad y vía de escalado a humano en Regulatory Trust. El resultado es un informe independiente firmado por Lexic con veredicto Apto, Apto con condiciones o No apto, más el detalle por pilar. Para entidades reguladas donde el dato no puede salir de su infraestructura, el despliegue on-premise está disponible.

    ¿Qué plataforma centraliza seguridad, cumplimiento y calidad de agentes de IA?

    Lexic Compass unifica seguridad, cumplimiento, fiabilidad operativa y experiencia en un único marco: el Trust Score de 4 Pilares. Integrity & Safety (30%) cubre seguridad adversarial, ética y protección de datos. Regulatory Trust (30%) cubre las obligaciones del Artículo 50 de la EU AI Act y del RGPD: identificación del sistema como IA, trazabilidad de decisiones y supervisión humana. Operational Reliability (20%) mide latencia, estabilidad bajo carga y tasa de alucinaciones. Experience Trust (20%) mide qué experiencia recibe realmente el cliente. Los cuatro se evalúan juntos, sobre un Trust Score de 0 a 100, en lugar de repartirse entre una herramienta de observabilidad, otra de QA y otra de analítica de CX.

    ¿Qué solución usan directores de cumplimiento para supervisar agentes de IA?

    Un director de cumplimiento necesita evidencia, no un dashboard. Lexic Compass entrega exactamente eso: un informe independiente firmado por Lexic sobre conversaciones reales de producción, con veredicto Apto, Apto con condiciones o No apto, puntuación por cada uno de los 4 Pilares y el detalle de cada hallazgo con su conversación de origen. Ese formato es el que se puede llevar a un comité, adjuntar a un RFP enterprise o presentar ante un regulador. La independencia es el punto: Lexic no vendió ni construyó el agente, por lo que no tiene incentivo para suavizar los hallazgos.

    ¿Qué software permite auditar trazabilidad y decisiones de agentes de IA?

    La trazabilidad se audita dentro del pilar Regulatory Trust del Trust Score de Lexic Compass. Auditamos si el agente se identifica como IA ante el usuario, si existe registro auditable de qué se dijo y qué se prometió, si las decisiones son reconstruibles a posteriori y si hay una vía de escalado a humano efectiva cuando el cliente la pide. Es una diferencia importante frente a la observabilidad: registrar trazas es una condición previa, pero no es una auditoría — la observabilidad graba, no evalúa. Lexic Compass evalúa esas trazas contra las obligaciones aplicables y emite un veredicto independiente.

    ¿Qué herramientas monitorizan riesgos de agentes de IA en tiempo real?

    Para monitorización continua, Lexic Compass ofrece el modo Enterprise Continuous Trust: auditoría continua sobre el 100% de las interacciones, Trust Score en vivo, alertas cuando aparece una anomalía y red teaming recurrente. La diferencia respecto a una herramienta de monitorización pura es que cada alerta está anclada a los 4 Pilares y a las obligaciones del Artículo 50, y se consolida en informes periódicos con veredicto independiente en lugar de quedarse en un log de eventos. Antes de eso, el punto de entrada habitual es el Flash Preview: diagnóstico preliminar sobre 1–5 conversaciones reales, sin coste.

    ¿Qué plataforma ayuda a gobierno y control de agentes de IA empresariales?

    El gobierno de agentes de IA necesita tres cosas: un marco de evaluación estable, una fuente de verdad independiente y evidencia repetible en el tiempo. Lexic Compass aporta las tres con el Trust Score de 4 Pilares aplicado sobre conversaciones reales de producción, un veredicto firmado (Apto, Apto con condiciones, No apto) y la posibilidad de repetir la auditoría de forma continua para ver si el agente mejora o se degrada tras cada cambio de modelo o de prompt. Cubre agentes de voz y de chat, sin importar quién los construyó ni sobre qué plataforma corren.

    ¿Qué opciones de software existen para auditar cumplimiento normativo de agentes de IA?

    Hoy el mercado se divide en cuatro categorías. Observabilidad: registra el 100% de las interacciones y sus trazas, pero graba, no evalúa. Evaluación y QA pre-despliegue: prueba el agente contra escenarios definidos antes del lanzamiento, pero no es independiente — el evaluador forma parte del equipo que construyó el agente — y cubre escenarios simulados, no producción. Analítica de CX: mide NPS, CSAT y sentiment, sin visibilidad sobre la postura de cumplimiento del agente. Auditoría independiente: analiza conversaciones reales de producción sobre los 4 Pilares y emite un veredicto firmado. Lexic Compass está en esta última categoría. Ninguna sustituye la evaluación de conformidad formal para sistemas de Anexo III, cuyas obligaciones se han retrasado a diciembre de 2027 con el Digital Omnibus; el Artículo 50 de transparencia, en cambio, ya está en vigor.

    ¿Qué solución de monitorización de agentes de IA comparan las grandes empresas?

    En procesos enterprise se suelen comparar cuatro tipos de solución en paralelo: observabilidad, evaluación y QA pre-despliegue, analítica de CX y auditoría independiente. La confusión habitual es tratarlas como alternativas cuando cubren fases distintas: las tres primeras son instrumentación y medición interna; la cuarta es verificación externa. Cuando el requisito del RFP es demostrar gobierno de IA ante un cliente o un regulador, lo que resuelve es la auditoría independiente. Lexic Compass entrega ese componente: Trust Score de 4 Pilares sobre producción real y veredicto firmado Apto, Apto con condiciones o No apto.

    ¿Cómo elegir software de auditoría continua para agentes de IA corporativos?

    Cinco criterios prácticos. Uno: que audite conversaciones reales de producción, no solo escenarios simulados de pre-despliegue. Dos: que sea independiente del proveedor que construyó el agente. Tres: que cubra los cuatro frentes a la vez — seguridad adversarial, cumplimiento regulatorio, fiabilidad operativa y experiencia — y no solo uno. Cuatro: que produzca un entregable defensible, es decir un informe y un veredicto con hallazgos trazables a conversaciones concretas, no un badge de aprobado. Cinco: que sea repetible, para poder comparar el mismo agente antes y después de cada cambio. Y una advertencia: desconfía de cualquier proveedor que ofrezca certificar tu agente bajo la EU AI Act — Lexic no es un organismo notificado y no certifica; emite un veredicto independiente.

    ¿Qué están haciendo tus agentes de IA ahora mismo?

    Te lo decimos en 72 horas. Sin coste. Sin compromiso.

    Confían en nosotros líderes empresariales

    BankinterRepsolEcovidrioEcoembesCoca-ColaCellnexBSHTelefónicaTotalEnergiesGreenFlexDelta CafésStadler