Publicado 24/08/2026 13:07
- Comunicado -

Agentes de IA bajo examen, solo 1 de cada 20 supera sin condiciones el índice de confianza de Lexic.AI

Solo 1 de cada 20 agentes de IA que atienden a clientes alcanza la máxima clasificación del Lexic AI Agent Trust Index
Solo 1 de cada 20 agentes de IA que atienden a clientes alcanza la máxima clasificación del Lexic AI Agent Trust Index - Lexic.AI
(Información remitida por la empresa firmante)

El primer Lexic AI Agent Trust Index, basado en la auditoría de 50 agentes conversacionales de IA y más de 500 conversaciones reales de producción, sitúa en 62 sobre 100 el Trust Score medio de los sistemas analizados. Solo el 5% alcanza la máxima clasificación de confianza establecida por la metodología.

Madrid, 24 de agosto de 2026.- La inteligencia artificial está dejando de ser una tecnología experimental para convertirse en un nuevo canal de relación entre empresas y clientes. Agentes de IA ya atienden conversaciones a través de webs, WhatsApp y canales de voz, respondiendo preguntas, gestionando solicitudes y representando a las marcas frente a sus clientes.

Pero cuando estos sistemas dejan atrás las pruebas y empiezan a operar en producción, surge una cuestión que hasta ahora ha recibido mucha menos atención:

¿Qué hacen realmente estos agentes cuando hablan con clientes reales?

El primer Lexic AI Agent Trust Index, elaborado a partir de 50 agentes conversacionales de IA auditados, con más de 10 conversaciones reales evaluadas por agente y distintos casos de uso, ofrece una primera fotografía de este escenario. La muestra está compuesta principalmente por agentes desplegados en España, junto con casos adicionales de otros mercados europeos.

En conjunto, el análisis comprende más de 500 conversaciones reales de producción en sectores como banca, seguros, energía, industria, retail, logística y otros ámbitos en los que la inteligencia artificial ya interviene directamente en la relación con clientes.

Solo el 5% alcanza la máxima clasificación de confianza

Para obtener la clasificación Trusted, un agente debe alcanzar al menos 85 puntos sobre 100 y no presentar ningún hallazgo crítico en materia de seguridad o cumplimiento normativo.

El objetivo no es determinar únicamente si un agente responde correctamente. La evaluación analiza si el sistema es seguro, cumple las obligaciones aplicables, funciona de forma fiable y ofrece una experiencia adecuada al cliente.

El Trust Score combina cuatro dimensiones:

Seguridad e integridad — 30%

Cumplimiento normativo — 30%

Fiabilidad operativa — 20%

Experiencia de cliente — 20%

La evaluación se realiza sobre conversaciones reales mantenidas por los agentes en producción, y no únicamente sobre simulaciones, pruebas de laboratorio o demostraciones controladas.

Los principales fallos aparecen en comportamientos básicos

Los resultados agregados del índice muestran que los problemas no se limitan a cuestiones técnicas sofisticadas.

Alrededor de ocho de cada diez agentes analizados no se identifican correctamente como inteligencia artificial cuando el usuario se lo pregunta directamente.

Una proporción similar promete escalar la conversación a una persona, pero no completa correctamente ese proceso cuando el cliente lo solicita.

Además, aproximadamente uno de cada tres agentes recoge datos personales sin una puerta de consentimiento clara.

Estos comportamientos son especialmente relevantes porque afectan directamente a la relación entre una empresa y sus clientes. Un agente puede funcionar técnicamente y, al mismo tiempo, comportarse de forma inadecuada cuando tiene que explicar quién es, transferir una conversación o solicitar información personal.

“Gobernar bien un agente de IA no es evitar una multa. Es poder demostrar, con evidencia, que tus clientes pueden confiar en él.” - Sergio Llorens, CEO de Lexic.AI

Del laboratorio a la producción: medir lo que ocurre cuando nadie está mirando

El Lexic AI Agent Trust Index parte de una premisa sencilla: evaluar un agente de IA únicamente en un entorno controlado no permite conocer necesariamente cómo se comportará cuando interactúe con clientes reales.

Por eso, las auditorías que alimentan el índice analizan conversaciones reales mantenidas por agentes desplegados en producción, evaluando distintos escenarios y casos de uso.

La evaluación combina criterios de seguridad, cumplimiento, fiabilidad y experiencia de cliente. En el ámbito de seguridad, la metodología toma como referencia, entre otros elementos, el marco OWASP LLM Top 10. El análisis de cumplimiento contempla el Reglamento europeo de IA y el RGPD.

El resultado es un Trust Score sobre 100 y una clasificación que permite identificar tanto el nivel general de confianza del agente como los ámbitos concretos en los que necesita mejorar.

Una metodología propia, no una certificación regulatoria

El Lexic AI Agent Trust Index y el Trust Score son metodologías propias de Lexic.AI y no constituyen una certificación oficial ni un sello regulatorio.

Lexic.AI no es una entidad notificada bajo el Reglamento europeo de IA y no certifica el cumplimiento normativo de terceros.

La evaluación se basa en una metodología predefinida que aplica los mismos criterios de puntuación a los agentes analizados y sustenta sus conclusiones en evidencias obtenidas de conversaciones reales.

La independencia del índice se refiere a la aplicación uniforme de estos criterios: los resultados se obtienen a partir de una metodología definida previamente y no se modifican en función de la relación comercial con la empresa cuyo agente es evaluado.

El objetivo del índice no es sustituir a un organismo regulador ni emitir una certificación jurídica, sino aportar una evaluación estructurada y basada en evidencias sobre el comportamiento real de los agentes conversacionales que interactúan con clientes.

Una nueva referencia para medir la confianza de los agentes de IA

La primera edición del Lexic AI Agent Trust Index corresponde a 2026 y tendrá periodicidad anual.

La intención es que el índice evolucione junto con el mercado y permita observar cómo cambia el comportamiento de los agentes de IA a medida que las empresas adquieren experiencia, mejoran sus sistemas y aumentan las exigencias regulatorias y de sus propios clientes.

El momento es especialmente relevante. El Reglamento europeo de IA introduce obligaciones de transparencia para determinados sistemas de inteligencia artificial que interactúan directamente con personas, aumentando la necesidad de que las organizaciones conozcan y puedan documentar cómo se comportan sus agentes una vez desplegados.

Pero la cuestión va más allá del cumplimiento normativo.

Los agentes de IA están empezando a ocupar el mismo espacio que antes ocupaban exclusivamente empleados, call centers, webs y otros canales de atención. Hablan en nombre de una empresa, responden a sus clientes, manejan información y pueden influir directamente en la experiencia y en la reputación de una marca.

Por eso, medir únicamente sus capacidades técnicas ya no es suficiente.

La pregunta ya no es si las empresas están desplegando agentes de IA.

Es si saben qué están diciendo esos agentes cuando hablan en su nombre.

Lexic AI Agent Trust Index 2026

50 agentes auditados · 500+ conversaciones reales evaluadas · 10+ conversaciones por agente · Principalmente España · Distintos casos de uso y sectores · Trust Score medio: 62/100 · 5% alcanza la clasificación Trusted.

Contacto
Emisor: Lexic.AI
Contacto: Lexic.AI
Email de contacto: pulse@lexic.ai

Contador

Contenido patrocinado