Comparador de diferencias CSV
Compara dos archivos CSV y visualiza al instante las filas añadidas, las filas eliminadas y las celdas modificadas. Elige cualquier columna como clave para emparejar filas, compara valores antes y después, e incluso archivos con columnas distintas. Todo se procesa en tu navegador.
Qué es un comparador de diferencias CSV
Un comparador de diferencias CSV es una herramienta que coteja dos conjuntos de datos CSV (o TSV) columna por columna y fila por fila, y detecta automáticamente las "filas añadidas", las "filas eliminadas" y las "celdas cuyo valor ha cambiado". La comparación de líneas de un editor de texto convencional (como el diff de Git) solo puede determinar si una línea entera se añadió o se eliminó, pero esta herramienta primero empareja las filas mediante una columna clave (equivalente a un ID o clave primaria) y después realiza la comparación a nivel de celda, de modo que dentro de una misma fila puede identificar con precisión qué columna en concreto ha cambiado de valor.
Los datos CSV que introduzcas se procesan íntegramente mediante JavaScript en tu propio navegador y nunca se envían a ningún servidor, por lo que puedes comparar con tranquilidad información sensible, como datos de clientes o registros de ventas, sin preocuparte por filtraciones externas. Otra característica destacable es que, aunque los dos archivos CSV tengan el orden de las columnas distinto o un número diferente de columnas, la herramienta los empareja automáticamente a partir de los nombres de encabezado, sin necesidad de reordenar manualmente ninguno de los dos archivos antes de compararlos.
Cómo usar el comparador de diferencias CSV
- Prepara el CSV de origen (A) y el de destino (B) Pega directamente en el cuadro de la izquierda el CSV anterior a la actualización y en el de la derecha el CSV posterior, o bien súbelos como archivo CSV o TSV mediante el botón "Seleccionar archivo".
- Elige el delimitador Selecciona coma o tabulador en "Delimitador" según se trate de un CSV separado por comas o de un TSV separado por tabuladores.
- Indica si existe fila de encabezado Marca "Tratar la primera línea como encabezado" si la primera fila contiene los nombres de las columnas. Si no hay encabezado, déjala sin marcar y la herramienta asignará automáticamente nombres consecutivos como col1, col2, etc.
- Selecciona la columna clave Elige en el menú desplegable la columna que identifica cada fila (equivalente a un ID o clave primaria). El valor de esta columna es el que se usa para emparejar las filas de A con las de B.
- Revisa el resultado de la comparación Las listas de "Filas eliminadas", "Filas añadidas" y "Filas modificadas" se generan automáticamente. En las filas modificadas se muestran, celda por celda, el valor anterior y el valor posterior colocados uno junto al otro.
Consejos para aprovecharla mejor
- La columna clave usa por defecto la primera columna, pero si tus datos tienen un ID o clave primaria, selecciónala en su lugar: las filas seguirán emparejándose correctamente aunque cambie su orden o cantidad.
- Si ninguno de los CSV tiene fila de encabezado, desmarca "Tratar la primera línea como encabezado" para comparar usando nombres automáticos como col1, col2, etc.
- La sección "Filas modificadas" compara columna por columna las filas coincidentes y solo muestra las columnas que difieren, en formato "antes hacia después".
- Los archivos TSV (separados por tabulador) también funcionan: basta con cambiar el delimitador a "Tabulador" y pegar los datos tal cual.
- En lugar de subir un archivo, puedes pegar un rango copiado directamente de Excel o Google Sheets, y la comparación funcionará igual de bien.
Casos de uso del comparador de diferencias CSV
Verificación antes y después de actualizar datos maestros
Exporta a CSV el maestro de productos o el maestro de clientes y compara el contenido antes y después de una tarea de actualización para comprobar que no se ha colado ningún cambio no deseado.
Conciliación de datos en una migración de sistemas
Compara el CSV exportado desde el sistema antiguo con el exportado desde el nuevo sistema para la tarea de "conciliación de datos", confirmando que la migración no ha provocado pérdidas ni duplicados.
Validación de resultados de procesos por lotes
Exporta una tabla a CSV antes y después de ejecutar un proceso por lotes diario o mensual, y comprueba que únicamente se han añadido o actualizado las filas previstas.
Control de cambios en hojas de cálculo
Pega y compara tablas copiadas de Excel o de una hoja de cálculo colaborativa para localizar rápidamente qué ha modificado cada persona en una edición conjunta.
Monitorización de diferencias en resultados de API o scraping
Convierte a CSV los datos obtenidos periódicamente de una API y compáralos día a día para hacer seguimiento de cuándo cambian valores concretos, como precios o niveles de stock.
Glosario del comparador de diferencias CSV
- Columna clave
- La columna que se utiliza para identificar de forma única cada fila. Al indicar la columna equivalente a un ID o clave primaria, las filas correspondientes se emparejan correctamente aunque su orden cambie entre un archivo y otro.
- Fila de encabezado
- La fila situada en la primera línea del CSV que indica el nombre de cada columna. Al activar "Tratar la primera línea como encabezado", esta fila se excluye de la comparación de diferencias y se utiliza únicamente como nombre de columna.
- Delimitador
- El carácter que separa los valores de cada celda dentro de un CSV. Lo habitual es la coma, pero los archivos TSV separados por tabulador pueden compararse con el mismo mecanismo simplemente cambiando el delimitador.
- Lista combinada de columnas
- El conjunto de nombres de columna que resulta de unir los encabezados del CSV de origen (A) y del CSV de destino (B). Se construye tomando como base el orden de columnas de A y añadiendo al final las columnas que solo existen en B. Una columna presente en un único archivo se compara tratando su valor como vacío en el otro.
- Celda modificada
- Una celda en la que, al comparar columna por columna las filas que comparten la misma clave, el valor resulta distinto entre A y B. Se muestran el valor anterior (A) y el valor posterior (B) colocados lado a lado.
- Fila sin cambios
- Una fila presente tanto en el origen como en el destino, y en la que el valor de todas las columnas coincide exactamente. Estas filas no aparecen en las listas de diferencias, solo se refleja su cantidad en el resumen.
- Fila añadida
- Una fila cuya clave existe únicamente en el CSV de destino (B) y no está presente en el CSV de origen (A). Se interpreta como un registro nuevo incorporado tras la actualización.
- Fila eliminada
- Una fila cuya clave existe únicamente en el CSV de origen (A) y ya no aparece en el CSV de destino (B). Se interpreta como un registro que existía antes y que fue retirado.
Preguntas frecuentes
A propósito — Por qué un diff de texto no basta para archivos CSV
Comparar dos archivos CSV se ha hecho tradicionalmente colocando dos hojas de cálculo una junto a otra en Excel, o ejecutando un diff de texto basado en líneas con una herramienta como Git. Pero como cada fila de un CSV agrupa varios valores separados por comas, un diff basado en líneas solo indica que "la fila cambió", sin precisar qué columna en concreto se modificó. Esta herramienta identifica las diferencias a nivel de celda precisamente para cubrir esa carencia.
En los sistemas empresariales, exportar tablas de bases de datos a CSV para compararlas —a menudo llamado conciliación de datos— es una tarea habitual. Verificar que los datos coinciden exactamente antes y después de una migración, o comprobar que un proceso por lotes mensual produjo el resultado esperado, suele implicar miles o incluso decenas de miles de filas. A esa escala, emparejar filas de forma mecánica mediante una columna clave se vuelve imprescindible.
Los algoritmos de diff usados por sistemas de control de versiones como Git (por ejemplo, el algoritmo de Myers) son excelentes detectando adiciones y eliminaciones a nivel de línea, pero no siempre son ideales para datos CSV donde "la misma fila" puede tener solo uno o dos valores de columna modificados. Emparejar filas por clave y luego comparar celda por celda, como hace esta herramienta, es un enfoque diseñado específicamente para datos tabulares.