La resolución de entidades es el proceso de determinar cuándo distintos registros —escritos de forma diferente, capturados por separado o disfrazados a propósito— en realidad se refieren a la misma persona, empresa, cuenta, ubicación o activo del mundo real. Toma "Roberto Gómez", "R. Gomez" y "Robert Gomez S.A. de C.V." y decide, con evidencia, cuáles son una misma entidad y cuáles no; luego enlaza todo lo que esa entidad toca en una sola vista.
Si alguna vez buscaste a un cliente, proveedor o sospechoso y encontraste cinco versiones casi idénticas repartidas en cinco sistemas, ese es el problema que resuelve la resolución de entidades. Es la diferencia entre contar registros y saber con quién y con qué estás tratando realmente.
¿Por qué importa la resolución de entidades?
La mayoría de las organizaciones no tienen falta de datos: tienen un problema de fragmentación de datos. La misma persona existe en tu CRM, en tu sistema de alta, en una lista de sanciones, en un contrato en PDF y en una hoja de cálculo que un analista guardó en su escritorio. Cada copia es un poco distinta. Hasta que esas copias se resuelven a una sola entidad, no puedes responder preguntas básicas:
- ¿Este cliente nuevo es la misma persona que rechazamos el año pasado con otra ortografía?
- ¿Tres proveedores "sin relación" comparten en realidad un director, un domicilio y una cuenta bancaria?
- ¿El beneficiario final de esta cuenta está en una lista de vigilancia bajo un alias?
- ¿Cuánta exposición total tenemos realmente a una contraparte repartida en seis filiales?
Sin resolución de entidades, la respuesta a todo esto es una investigación manual y lenta —o una omisión.
¿Cómo funciona la resolución de entidades?
A grandes rasgos, la resolución de entidades ocurre por etapas:
- Ingesta — traer registros de todas las fuentes: bases de datos, almacenes, APIs, expedientes, contratos, registros públicos, estructurados y no estructurados por igual.
- Estandarización — normalizar formatos (nombres, fechas, domicilios, RFC/identificadores fiscales) para poder compararlos con justicia.
- Coincidencia — comparar registros usando múltiples señales (claves exactas, coincidencia difusa de nombres, atributos compartidos como teléfono, domicilio o RFC) para calificar qué tan probable es que dos registros sean la misma entidad.
- Resolución — agrupar los registros coincidentes en una sola entidad resuelta, manteniendo cada registro fuente rastreable debajo.
- Enlace — mapear cómo se conectan las entidades resueltas: propiedad, domicilios compartidos, transacciones, familia, empleo.
El último paso es el que convierte una lista limpia en inteligencia. Una vez resueltas las entidades, las relaciones entre ellas se vuelven visibles —y ahí suele estar el riesgo.
La resolución de entidades responde "¿quién es esto, realmente?". El análisis de vínculos responde "¿y con quién está conectado?". Necesitas ambos para ver una red.
Resolución de entidades vs. deduplicación: ¿cuál es la diferencia?
Suenan parecidas y a menudo se confunden:
- La deduplicación elimina copias redundantes de un registro dentro de un sistema para almacenar cada cosa una sola vez. Es una tarea de orden.
- La resolución de entidades decide si registros de muchos sistemas se refieren a la misma entidad real —incluso cuando no coinciden exactamente, e incluso cuando alguien intenta activamente parecer dos personas distintas. Es una tarea de inteligencia.
La deduplicación ordena tu base de datos. La resolución de entidades la hace veraz respecto a quién está en ella.
¿Dónde se usa la resolución de entidades?
Donde el costo de confundir dos entidades —o de no conectar dos— es alto:
- KYC / PLD / alta de clientes — resolver clientes a sus beneficiarios finales reales y cotejarlos contra listas de sanciones y PEP bajo alias.
- Fraude — detectar redes que reutilizan domicilios, dispositivos o cuentas bancarias entre identidades "separadas".
- Debida diligencia y riesgo de terceros — ver la propiedad y las conexiones reales detrás de un proveedor antes de firmar.
- Investigaciones y anticorrupción — mapear cómo se conectan de verdad personas, empresas y contratos.
- Riesgo de cadena de suministro — encontrar concentración oculta cuando proveedores "distintos" remiten a una sola matriz.
¿Qué hace confiable a la resolución de entidades?
Una coincidencia solo sirve si puedes defenderla. Una buena resolución de entidades es:
- Rastreable a la fuente — cada entidad resuelta y cada vínculo apunta a los registros originales que lo sustentan, para que resista auditorías, procesos de contratación y tribunales.
- Explicable — puedes ver por qué se unieron dos registros, no solo que se unieron.
- Revisable — los analistas confirman o separan coincidencias inciertas; la máquina propone, la persona decide.
- Segura — los datos sensibles y regulados pueden procesarse on-prem, soberanos o aislados (air-gapped), sin enviarse a la nube de un tercero.
Cómo hace Sherloc la resolución de entidades
Sherloc es la plataforma de inteligencia y búsqueda de grafos de entidades de Axentra, y la resolución de entidades es su núcleo. Ingiere todo lo que ya posees —bases de datos, almacenes, APIs, contratos, PDFs, expedientes, registros públicos, estructurado o no—, resuelve las personas, empresas, cuentas, ubicaciones y activos reales que hay dentro (entre registros duplicados, mal escritos y con alias) y mapea cómo se conectan todos en un solo grafo.
Desde ahí buscas un nombre y recuperas toda la red: análisis de vínculos de múltiples saltos donde cada nodo y cada arista es rastreable a su fuente —defendible en auditoría, contratación y tribunales. Puedes buscar en lenguaje natural en español o inglés, y como está hecho para datos sensibles, Sherloc corre on-prem, soberano o totalmente aislado. Se usa para investigaciones, anticorrupción y contrataciones, crimen organizado, inteligencia financiera y debida diligencia empresarial, KYC, PLD, fraude y riesgo de cadena de suministro.
El objetivo no es reemplazar a tus analistas, sino entregarles la imagen resuelta y conectada en segundos en lugar de semanas, con la evidencia adjunta.
Si buscas convertir registros dispersos y desordenados en una sola vista, con rendición de cuentas, de quién es quién y cómo se conectan, hablemos.