XetrokXetrok — inicio
Todos los artículos
Saneamiento de datos

Por qué tu CRM tiene 30% de datos duplicados

1 de septiembre de 2026 · 5 min de lectura

Cuando abres el CRM de una empresa mediana mexicana y cuentas registros únicos de verdad, la cifra casi siempre cae entre 25% y 35% respecto al total. No es negligencia: es la consecuencia natural de cómo se captura la información en una operación comercial real.

Las tres causas estructurales

1. La razón social no es un identificador

«Industrias López S.A. de C.V.», «IND Lopez», «Lopez SA» y «industrias lópez» son la misma empresa. Para una base de datos son cuatro cadenas de texto distintas, y ninguna búsqueda de coincidencia exacta las va a relacionar.

El identificador real existe —el RFC— pero rara vez se captura completo, y cuando se captura viene con espacios, guiones o dígitos verificadores inventados.

2. Cada vendedor tiene su propio criterio

Uno escribe el nombre comercial, otro la razón social fiscal, otro el nombre de la planta. Uno pone el teléfono con lada, otro sin ella. Uno registra al comprador, otro al gerente de planta, otro al dueño.

Nada de eso está mal desde la perspectiva de quien vende. Está mal desde la perspectiva de quien luego quiere contar, pronosticar o segmentar.

3. Las importaciones se apilan

Una lista de una feria industrial. Un padrón que compró marketing. La base que trajo el vendedor que llegó de la competencia. Cada importación entra sin cruzarse con lo que ya había, y el duplicado se multiplica.

Por qué importa más de lo que parece

Un 30% de duplicados no significa «30% de trabajo extra». Significa que:

  • Tu pronóstico está inflado. Cuentas oportunidades que son la misma cuenta vista dos veces.
  • Tu equipo se pisa. Dos vendedores llaman al mismo comprador en la misma semana, con precios distintos.
  • Ningún modelo de IA te va a servir. Un modelo entrenado sobre registros duplicados aprende que esa empresa aparece cuatro veces, no que es importante.

Ningún algoritmo de predicción arregla una base sucia. Primero se recicla el dato; después se predice. En ese orden.

Cómo se resuelve de verdad

La desduplicación seria no se hace comparando textos idénticos: hay que reconocer que dos registros son la misma empresa aunque no compartan un solo campo exactamente igual, y luego fusionarlos sin perder información.

Esa fusión es la parte que casi nadie hace bien. No se trata de borrar el registro repetido: el teléfono lo tenía el primero, el correo el segundo y el monto facturado el tercero. El registro bueno es el que junta lo mejor de los tres.

Es exactamente el trabajo que Xetrok automatiza. Si quieres ver cuántos duplicados tiene tu base hoy, agenda una demo y lo revisamos con tus propios datos.

¿Te sirvió? Recibe el siguiente

Sin spam. Puedes darte de baja cuando quieras.

Sigue leyendo

Bring Your Own Data: el modelo que rompe el mercado B2B

Las plataformas gringas te venden contactos que no conoces. El modelo contrario —trabajar tu propia base— tiene mejores números.

Trampas de margen: cuando un descuento destruye tu rentabilidad

Hay cuentas grandes que dejan menos dinero que las chicas. El problema es que el CRM no te lo dice.