Ir al contenido
Empezar

Cómo decide el matching

El archivo de su cliente lo llama Zahlungsziel. Su esquema lo llama Payment terms. Esas dos cadenas no se parecen en nada — y aun así la importación tiene que conectarlas, cientos de veces por archivo, sin corromper los datos de nadie. Esta página explica, en lenguaje llano, cómo Mildport toma esa decisión: qué intenta primero, cuándo se niega a adivinar y cómo se vuelve más inteligente con cada importación confirmada.

Llegue lo que llegue — CSV, Excel, JSON, un PDF con tablas, un escaneo leído por OCR — se convierte en una de dos formas:

  • Una tabla: filas con encabezados de columna. Los encabezados se emparejan con sus campos; esa escalera es esta página.
  • Un documento: una factura, una tarjeta de visita, un contrato. No hay columnas — Mildport extrae hechos («número de factura: 2024-117») con un puntero visible al lugar donde se encontró cada uno, y el usuario los confirma. Ese flujo se describe en importaciones capture-first.

Un principio cubre ambas: nada aterriza en su sistema sin que una persona haya tenido la oportunidad de verlo.

Para cada encabezado de columna, Mildport sube una escalera — de lo más barato y seguro a lo más inteligente — y se detiene en cuanto un peldaño responde.

  1. Primero, ordenar. Mayúsculas, puntuación y separadores se normalizan: E-Mail_Adresse y email adresse son la misma palabra para el matcher.
  2. Nombres exactos y sus sinónimos. Cada campo puede declarar nombres alternativos (surname, family name, …). Un acierto aquí queda decidido.
  3. Lo que sus usuarios ya le enseñaron. Cada asignación confirmada por una persona se recuerda — por tenant, como vocabulario. Si alguien dijo una vez «Zahlungsziel significa Payment terms», esa columna coincide al instante desde entonces. También se recuerdan diseños completos: llega otra vez el mismo export mensual y toda la asignación se repite sin preguntas.
  4. Palabras compartidas y un diccionario interlingüe integrado. Invoice no. e Invoice number comparten lo suficiente para puntuar bien; el diccionario integrado conoce pares como PLZzip.
  5. Los propios datos votan. Si una columna con nombre críptico contiene valores con forma de correos, IBAN o teléfonos, los campos que esperan esas formas reciben un impulso.

Cada peldaño produce una puntuación visible de 0 a 100, mostrada en el paso de asignación — la confianza nunca se oculta.

Dos reglas protegen sus datos de disparates seguros de sí mismos:

  • Bajo el umbral de confianza no hay conjetura. Un mejor candidato débil no se aplica en silencio; la columna se presenta como una pregunta abierta con los candidatos más cercanos listos para elegir.
  • Un casi-empate es una pregunta, no un volado. Si dos campos puntúan casi igual, Mildport pregunta — un clic lo resuelve, y la respuesta se recuerda.

Así, el peor caso nunca es «datos erróneos en su CRM»; es «un clic más para su usuario».

Con la asistencia de IA activada, un modelo de lenguaje revisa solo la cola de baja confianza — las columnas que la escalera no pudo resolver. Ve los candidatos y valores de muestra, debe citar evidencia para su elección, pasar los mismos validadores que cualquier otra coincidencia, y su razonamiento queda registrado. Reordena sugerencias; nunca se salta el paso de revisión. Está desactivado por defecto — vea Cómo funciona para el panorama completo.

Cada confirmación retroalimenta el sistema por tres vías: el encabezado se convierte en sinónimo aprendido, el cálculo de confianza gana un punto de datos, y el diseño del archivo se recuerda como plantilla. En la práctica: la primera importación de un cliente nuevo hace un puñado de preguntas; la segunda normalmente ninguna.

El matching se ejecuta dentro de su despliegue — los encabezados y valores no se envían a terceros para calcular una coincidencia. Siguiente: configurar el widget.