Eliminador de duplicados CSV

Elimina filas duplicadas de archivos CSV. Deduplica por coincidencia exacta o por columnas seleccionadas, con opciones para ignorar mayúsculas y recortar espacios.

Actualizado

Share:
Home/Utility Tools/CSV Deduplicator

CSV Deduplicator

Remove duplicate rows from CSV files. Deduplicate by exact match or selected columns with case-insensitive and whitespace trimming options.

CSV Input

Drag & drop a .csv or .tsv file here, or click to browse

Preguntas Frecuentes

¿Qué es el CSV Deduplicator?

El CSV Deduplicator es una herramienta online gratuita que elimina filas duplicadas de archivos CSV. Deduplica por coincidencia exacta o por columnas seleccionadas, con opciones de ignorar mayúsculas/minúsculas y recortar espacios en blanco. Funciona completamente en tu navegador, sin necesidad de instalación ni registro.

¿Qué modos hay?

Coincidencia exacta de fila (todas las columnas) o modo de columnas seleccionadas. Las filas que coinciden en todas las columnas seleccionadas se consideran duplicadas.

¿Ignora mayúsculas y minúsculas?

Sí: activa la opción para tratar «Alice» y «alice» como el mismo valor. También está disponible el recorte de espacios en blanco.

¿Puedo exportar solo los duplicados?

Sí. Descarga el CSV ya depurado o un archivo aparte que contenga únicamente las filas duplicadas eliminadas para revisarlas.

¿El CSV Deduplicator es gratis?

Sí, el CSV Deduplicator es 100 % gratis, sin registro, sin tarifas ocultas y sin límites de uso. Todo el procesamiento se realiza localmente en tu navegador, garantizando una privacidad total.

¿Están seguros mis datos con esta herramienta?

Por completo. El CSV Deduplicator procesa todo del lado del cliente, en tu navegador. No se sube ni se almacena ningún dato en ningún servidor. Tu contenido permanece privado en tu dispositivo en todo momento.

¿El CSV Deduplicator funciona en dispositivos móviles?

Sí, el CSV Deduplicator es totalmente adaptable y funciona en smartphones y tablets. Puedes usarlo en cualquier dispositivo con un navegador web moderno, sin necesidad de descargar ninguna app.

¿Necesito crear una cuenta para usar esta herramienta?

No se necesita cuenta ni registro. Solo tienes que abrir el CSV Deduplicator en tu navegador y empezar a usarlo de inmediato. No hay barreras de registro ni restricciones de uso.

¿Cómo uso el CSV Deduplicator?

Simplemente introduce tus datos en el campo indicado, ajusta los parámetros a tu gusto y la herramienta los procesará al instante. Después puedes copiar el resultado al portapapeles o descargarlo.

¿Qué navegadores son compatibles?

El CSV Deduplicator funciona en todos los navegadores modernos, incluidos Chrome, Firefox, Safari, Edge y Opera. Para una mejor experiencia, usa la última versión de tu navegador preferido.

¿Cuál es la diferencia entre Conservar la Primera y Conservar la Última al eliminar duplicados?

Ambas opciones eliminan las mismas filas duplicadas; solo cambian qué copia de cada conjunto coincidente sobrevive. Conservar la Primera mantiene la aparición más temprana en el archivo y descarta todas las coincidencias posteriores, lo cual es ideal cuando la parte superior de tus datos contiene el registro original o autorizado. Conservar la Última mantiene la aparición final y descarta las anteriores, algo relevante cuando las filas más nuevas contienen la versión más reciente de un registro — por ejemplo, una dirección o un estado de pedido actualizado añadido al final de una exportación. La elección no afecta cuántas filas se eliminan, solo qué valores terminas conservando, así que vale la pena pensarlo antes de exportar. Activa Conservar la Primera o Conservar la Última en la configuración de deduplicación y observa cómo la pestaña de Grupos de Duplicados marca exactamente qué fila se mantiene.

¿Debo deduplicar por coincidencia exacta de fila o por columnas seleccionadas?

Usa la coincidencia exacta de fila cuando solo quieras eliminar copias perfectas — las filas son duplicadas únicamente si todas las columnas son idénticas, así que cualquier cosa que difiera en algún campo se conserva. Es la opción más segura para eliminar repeticiones accidentales de filas completas. Usa columnas seleccionadas cuando quieras agrupar registros que representan la misma entidad aunque algunos campos difieran: elige un campo único como una dirección de correo electrónico o un ID de pedido, y las filas que coincidan solo en esas columnas se tratarán como duplicadas sin importar los demás valores. Por ejemplo, dos filas con el mismo correo pero distinta fecha de registro sobrevivirían con la coincidencia exacta, pero se fusionarían en el modo de columnas. Elige el modo que se ajuste a tu definición de duplicado y luego revisa aquí la pestaña de Grupos de Duplicados para confirmar que se marcaron las filas correctas antes de exportar.

¿Cómo encuentro correos electrónicos o IDs duplicados ignorando las demás columnas?

Cambia el modo de deduplicación a Solo Columnas Seleccionadas y marca únicamente la columna que te interesa — por ejemplo, una columna de Correo Electrónico o de ID de Cliente — dejando el resto sin marcar. La herramienta tratará entonces dos filas como duplicadas siempre que esos campos elegidos coincidan, aunque todas las demás columnas sean diferentes. Así es exactamente como agrupas varios registros de la misma persona o pedido en uno solo. Combínalo con la opción de coincidencia sin distinguir mayúsculas y minúsculas para que Alice@Example.com y alice@example.com cuenten como la misma dirección, y con recortar espacios en blanco para que un espacio inicial suelto no separe un valor por lo demás idéntico. La vista de Grupos de Duplicados muestra cada conjunto coincidente agrupado con la fila conservada marcada, para que puedas verificar la lógica. Selecciona tu columna clave arriba y el recuento de duplicados se actualiza al instante.

¿Por qué cambia mi recuento de duplicados al activar la opción de mayúsculas/minúsculas o de recortar espacios?

Esas dos opciones redefinen qué se considera idéntico, así que activarlas o desactivarlas cambia de forma natural cuántos duplicados se encuentran. Por defecto, la herramienta compara los valores de forma literal, lo que significa que Alice y alice, o bob@example.com y una copia con un espacio inicial, se tratan como diferentes y se conservan por separado. Activar la coincidencia sin distinguir mayúsculas y minúsculas convierte los valores a minúsculas antes de compararlos, de modo que las entradas que solo difieren en las mayúsculas se agrupan en un solo conjunto. Activar recortar espacios en blanco elimina los espacios al inicio y al final, así que los valores que solo difieren por un relleno accidental de una exportación descuidada también se fusionan. Los datos reales, llenos de mayúsculas y espacios inconsistentes, mostrarán más duplicados una vez activadas estas opciones. Si tu recuento parece demasiado bajo o demasiado alto, ajusta estas opciones y consulta la tasa de duplicados en el panel de resumen para confirmar que las reglas de coincidencia se ajustan a tus datos.

¿El deduplicador manejará correctamente archivos separados por punto y coma o por tabulaciones, y campos entre comillas?

Sí. La herramienta detecta automáticamente el delimitador de tus datos, reconociendo comas, puntos y coma, tabulaciones y barras verticales, de modo que los CSV de estilo europeo con punto y coma y las exportaciones .tsv se analizan sin ninguna configuración manual — el delimitador detectado se muestra encima de los resultados. También analiza correctamente los campos cuando están entre comillas dobles o contienen comas, saltos de línea o comillas escapadas dentro de ellos, así que un valor como una dirección completa o una nota entrecomillada no se dividirá ni desplazará tus columnas. Al exportar, el archivo limpio siempre se escribe como valores estándar separados por comas, con el entrecomillado adecuado aplicado donde sea necesario, dándote un resultado limpio y portátil sin importar el formato original. Suelta un archivo .csv o .tsv o pega tus datos arriba, y el delimitador, el número de columnas y el número de filas aparecerán de inmediato.

Acerca del Deduplicador de CSV

El Deduplicador de CSV es una herramienta gratuita para encontrar y eliminar filas duplicadas de un archivo CSV. Sube un archivo .csv o .tsv, arrástralo y suéltalo sobre la página, o pega el texto sin formato, y la herramienta analiza tus datos, marca cada fila repetida y genera un archivo limpio sin los duplicados. Está pensada para cualquiera que trabaje con datos exportados — analistas que combinan hojas de cálculo, especialistas en marketing que limpian una lista de correo, desarrolladores que preparan una importación de datos, o equipos de operaciones que concilian registros procedentes de distintos sistemas.

Todo se ejecuta localmente en tu navegador. Tu archivo se lee en tu propio dispositivo y nunca se sube a un servidor, así que incluso los datos sensibles, como correos de clientes o registros internos, permanecen privados. No hay que registrarse, no existe límite de filas y no hace falta instalar nada.

Cómo funciona aquí la deduplicación

Un duplicado es cualquier fila cuyos valores coinciden con otra fila según las reglas que establezcas. La herramienta ofrece dos modos:

  • Coincidencia exacta de fila — dos filas se consideran duplicadas solo cuando todas las columnas son idénticas. Es la opción más segura cuando quieres eliminar copias perfectas y conservar todo lo que difiera.
  • Solo columnas seleccionadas — elige una o varias columnas (por ejemplo, un correo electrónico o un ID de pedido) y las filas se tratan como duplicadas cuando coinciden únicamente en esos campos, sin tener en cuenta el resto. Así es como agrupas registros que representan la misma entidad aunque las columnas secundarias difieran.

Dos opciones de coincidencia cambian el significado de "idéntico". La coincidencia sin distinguir mayúsculas y minúsculas trata Alice y alice como el mismo valor, y recortar espacios en blanco ignora los espacios al inicio y al final, de modo que bob@example.com y bob@example.com se fusionan. También decides qué copia sobrevive con Conservar la primera o Conservar la última, algo relevante cuando las filas posteriores contienen la versión más reciente de un registro.

Revisar los resultados antes de exportar

En lugar de eliminar filas silenciosamente, el Deduplicador de CSV te muestra lo que encontró a través de tres vistas. La pestaña Limpio es tu conjunto de datos ya deduplicado. La pestaña Grupos de Duplicados enumera cada conjunto de filas coincidentes agrupadas, con código de color, marcando la fila conservada y señalando las demás como eliminadas. La Vista Resaltada muestra el archivo original completo con los grupos de duplicados sombreados y tachados, para que puedas auditar una decisión en contexto antes de confirmarla.

Un panel de resumen muestra los recuentos de un vistazo: filas originales, duplicados encontrados, filas únicas restantes y la tasa de duplicados en porcentaje. Esas cuatro cifras te dicen al instante si un archivo está prácticamente limpio o plagado de repeticiones.

Exportar tus datos limpios

Cuando los resultados te convenzan, puedes copiar el CSV limpio al portapapeles, descargarlo como deduplicated.csv, o descargar un archivo aparte, duplicates-only.csv, que contiene solo las filas que se eliminaron. Ese segundo archivo es útil para revisión o para llevar un registro — por ejemplo, para confirmar con un compañero que se descartaron los duplicados correctos antes de borrar nada en el origen.

La herramienta detecta automáticamente el delimitador de tus datos, reconociendo comas, puntos y coma, tabulaciones y barras verticales, y analiza el CSV correctamente incluso cuando los campos están entre comillas o contienen comas, saltos de línea o comillas escapadas dentro de ellos. El archivo exportado siempre se escribe como valores estándar separados por comas, con el entrecomillado adecuado.

Por qué importa eliminar filas duplicadas

Las filas duplicadas distorsionan silenciosamente todo lo que viene después. Inflan los totales y promedios de una hoja de cálculo, provocan que la misma persona reciba un correo dos veces, generan errores en importaciones que exigen claves únicas, y sesgan cualquier análisis basado en esos datos. Detectar los duplicados antes de cargar o compartir los datos sale mucho más barato que desenredarlos después. Como el Deduplicador de CSV funciona enteramente en el navegador, realiza esta limpieza con rapidez en tu propio equipo sin enviar una sola fila a ningún sitio — pega o suelta un archivo arriba para ver tu tasa de duplicados y un archivo limpio en segundos.