Déduplicateur de CSV
Supprimez les lignes en double des fichiers CSV. Dédupliquez par correspondance exacte ou par colonnes sélectionnées, avec options d'insensibilité à la casse et de suppression des espaces.
Mis à jour le
CSV Deduplicator
Remove duplicate rows from CSV files. Deduplicate by exact match or selected columns with case-insensitive and whitespace trimming options.
CSV Input
Drag & drop a .csv or .tsv file here, or click to browse
Related Tools
Questions Fréquentes
Qu'est-ce que le CSV Deduplicator ?
Le CSV Deduplicator est un outil en ligne gratuit qui supprime les lignes en double des fichiers CSV. Dédupliquez par correspondance exacte ou sur des colonnes sélectionnées, avec des options d'insensibilité à la casse et de suppression des espaces. Il fonctionne entièrement dans votre navigateur, sans installation ni inscription.
Quels modes ?
Correspondance exacte de ligne (toutes les colonnes) ou mode colonnes sélectionnées. Les lignes correspondant sur toutes les colonnes sélectionnées sont considérées comme des doublons.
Insensible à la casse ?
Oui : activez l'option pour traiter « Alice » et « alice » comme une même valeur. La suppression des espaces est également disponible.
Exporter uniquement les doublons ?
Oui. Téléchargez le CSV nettoyé ou un fichier distinct contenant uniquement les lignes en double supprimées, pour vérification.
Le CSV Deduplicator est-il gratuit ?
Oui, le CSV Deduplicator est 100 % gratuit, sans inscription, sans frais cachés et sans limite d'utilisation. Tout le traitement se fait localement dans votre navigateur, garantissant une confidentialité totale.
Mes données sont-elles en sécurité avec cet outil ?
Absolument. Le CSV Deduplicator traite tout côté client, dans votre navigateur. Aucune donnée n'est envoyée ni stockée sur un serveur. Votre contenu reste privé sur votre appareil à tout moment.
Le CSV Deduplicator fonctionne-t-il sur les appareils mobiles ?
Oui, le CSV Deduplicator est entièrement responsive et fonctionne sur smartphones et tablettes. Vous pouvez l'utiliser sur tout appareil doté d'un navigateur web moderne, sans téléchargement d'application.
Dois-je créer un compte pour utiliser cet outil ?
Aucun compte ni inscription n'est nécessaire. Ouvrez simplement le CSV Deduplicator dans votre navigateur et commencez à l'utiliser immédiatement. Pas de barrière d'inscription ni de restriction d'utilisation.
Comment utiliser le CSV Deduplicator ?
Saisissez simplement vos données dans le champ prévu, ajustez les paramètres selon vos préférences, et l'outil les traitera instantanément. Vous pouvez ensuite copier le résultat dans le presse-papiers ou le télécharger.
Quels navigateurs sont pris en charge ?
Le CSV Deduplicator fonctionne dans tous les navigateurs modernes, dont Chrome, Firefox, Safari, Edge et Opera. Pour une expérience optimale, utilisez la dernière version de votre navigateur préféré.
Quelle est la différence entre Conserver le premier et Conserver le dernier lors de la suppression des doublons ?
Les deux options suppriment exactement les mêmes lignes en double ; elles ne changent que la copie conservée dans chaque ensemble correspondant. Conserver le premier garde la toute première occurrence du fichier et supprime toutes les correspondances suivantes, ce qui est idéal lorsque le début de vos données contient l'enregistrement original ou faisant autorité. Conserver le dernier garde la dernière occurrence et supprime les précédentes, ce qui est utile lorsque les lignes les plus récentes contiennent la version la plus à jour d'un enregistrement — par exemple une adresse mise à jour ou un statut de commande ajouté en bas d'un export. Ce choix n'a aucun effet sur le nombre de lignes supprimées, seulement sur les valeurs que vous conservez au final ; il vaut donc la peine d'y réfléchir avant d'exporter. Basculez entre Conserver le premier et Conserver le dernier dans les paramètres de dédoublonnage et observez l'onglet Groupes de doublons pour voir exactement quelle ligne est conservée.
Faut-il dédoublonner par correspondance exacte de ligne ou par colonnes sélectionnées ?
Utilisez la correspondance exacte de ligne lorsque vous voulez uniquement supprimer les copies parfaites — les lignes ne sont des doublons que si toutes les colonnes sont identiques, donc tout ce qui diffère dans un champ, même un seul, est conservé. C'est l'option la plus sûre pour éliminer les répétitions accidentelles de lignes entières. Utilisez les colonnes sélectionnées lorsque vous voulez regrouper des enregistrements représentant la même entité même si certains champs diffèrent : choisissez un champ unique comme une adresse e-mail ou un identifiant de commande, et les lignes correspondant sur ces seules colonnes seront traitées comme des doublons, quelles que soient les autres valeurs. Par exemple, deux lignes partageant le même e-mail mais avec une date d'inscription différente survivraient à une correspondance exacte, mais fusionneraient en mode colonnes. Choisissez le mode qui correspond à votre définition d'un doublon, puis vérifiez l'onglet Groupes de doublons ici pour confirmer que les bonnes lignes ont été signalées avant d'exporter.
Comment trouver les e-mails ou identifiants en double en ignorant les autres colonnes ?
Basculez le mode de dédoublonnage sur Colonnes sélectionnées uniquement, puis cochez seulement la colonne qui vous intéresse — par exemple une colonne E-mail ou Identifiant client — en laissant les autres décochées. L'outil traite alors deux lignes comme des doublons dès que ces champs choisis correspondent, même si toutes les autres colonnes diffèrent. C'est exactement la façon de regrouper plusieurs enregistrements pour une même personne ou une même commande en un seul. Associez cela à l'option insensible à la casse pour qu'Alice@Example.com et alice@example.com comptent comme la même adresse, et au rognage des espaces pour qu'un espace en début de champ ne scinde pas une valeur par ailleurs identique. La vue Groupes de doublons affiche chaque ensemble correspondant avec la ligne conservée mise en évidence, afin que vous puissiez vérifier la logique. Sélectionnez votre colonne clé ci-dessus et le nombre de doublons se met à jour instantanément.
Pourquoi le nombre de doublons change-t-il quand j'active l'insensibilité à la casse ou le rognage des espaces ?
Ces deux options redéfinissent ce qui compte comme identique, donc les activer ou les désactiver change naturellement le nombre de doublons trouvés. Par défaut, l'outil compare les valeurs littéralement, ce qui signifie qu'Alice et alice, ou bob@example.com et une copie précédée d'un espace, sont traités comme différents et restent séparés. Activer la correspondance insensible à la casse met les valeurs en minuscules avant de les comparer, si bien que les entrées qui ne diffèrent que par la casse fusionnent en un seul groupe. Activer le rognage des espaces retire les espaces en début et fin de valeur, de sorte que des valeurs qui ne diffèrent que par un espace parasite issu d'un export mal formaté fusionnent également. Des données réelles, pleines d'incohérences de casse et d'espacement, afficheront davantage de doublons une fois ces options activées. Si le nombre vous semble trop bas ou trop élevé, ajustez ces réglages et consultez le taux de doublons dans le panneau de synthèse pour vérifier que les règles de correspondance conviennent à vos données.
L'outil gère-t-il correctement les fichiers séparés par des points-virgules ou des tabulations, ainsi que les champs entre guillemets ?
Oui. L'outil détecte automatiquement le séparateur utilisé dans vos données, en reconnaissant les virgules, points-virgules, tabulations et barres verticales, si bien que les fichiers CSV de style européen à points-virgules et les exports .tsv sont analysés sans aucun réglage manuel — le séparateur détecté est affiché au-dessus des résultats. Il analyse aussi correctement les champs entourés de guillemets doubles ou contenant des virgules, des sauts de ligne ou des guillemets échappés, si bien qu'une valeur comme une adresse complète ou une note entre guillemets ne sera pas coupée et ne décalera pas vos colonnes. À l'export, le fichier nettoyé est toujours écrit au format standard séparé par des virgules, avec les guillemets correctement appliqués là où nécessaire, ce qui vous donne un résultat propre et portable quel que soit le format d'origine. Déposez un fichier .csv ou .tsv ou collez vos données ci-dessus, et le séparateur, le nombre de colonnes et le nombre de lignes apparaissent immédiatement.
Outils Associés
Générateur de Mots de Passe Sécurisés Gratuit
Générez des mots de passe sécurisés et aléatoires avec des options personnalisables. Gratuit, rapide et fonctionne entièrement dans votre navigateur sans inscription.
Générateur de UUID/GUID Gratuit
Générez des identifiants universels uniques (UUID/GUID). Gratuit, rapide et fonctionne entièrement dans votre navigateur sans inscription.
Générateur de Codes QR Gratuit en Ligne
Générez des codes QR pour des URL, du texte, des identifiants WiFi et plus encore. Gratuit, rapide et fonctionne entièrement dans votre navigateur sans inscription.
Formateur et Validateur JSON Gratuit
Formatez, validez et embellissez des données JSON avec coloration syntaxique et détection d'erreurs. Gratuit, rapide et fonctionne entièrement dans votre navigateur sans inscription.
À propos du dédoublonneur CSV
Le dédoublonneur CSV est un outil gratuit qui repère et supprime les lignes en double dans un fichier CSV. Importez un fichier .csv ou .tsv, déposez-le directement sur la page, ou collez simplement le texte brut : l'outil analyse vos données, signale chaque ligne répétée et produit un fichier nettoyé, débarrassé des doublons. Il s'adresse à toute personne qui manipule des données exportées — analystes qui fusionnent des tableurs, marketeurs qui nettoient une liste de diffusion, développeurs qui préparent un import de données, ou équipes opérationnelles qui rapprochent des enregistrements issus de systèmes différents.
Tout se passe localement dans votre navigateur. Votre fichier est lu sur votre propre appareil et n'est jamais envoyé à un serveur : même des données sensibles, comme des e-mails clients ou des dossiers internes, restent confidentielles. Aucune inscription, aucune limite de lignes, rien à installer.
Comment fonctionne la détection des doublons
Une ligne est considérée comme un doublon dès que ses valeurs correspondent à celles d'une autre ligne, selon les règles que vous définissez. L'outil propose deux modes :
- Correspondance exacte de ligne — deux lignes ne sont des doublons que si toutes les colonnes sont identiques. C'est le choix le plus sûr lorsque vous voulez éliminer les copies parfaites tout en conservant tout ce qui diffère, même légèrement.
- Colonnes sélectionnées uniquement — choisissez une ou plusieurs colonnes (par exemple un e-mail ou un identifiant de commande) et les lignes sont traitées comme des doublons dès qu'elles correspondent sur ces seuls champs, en ignorant le reste. C'est la méthode pour regrouper des enregistrements qui représentent la même entité, même quand les colonnes secondaires diffèrent.
Deux options de correspondance modifient ce que signifie « identique ». La correspondance insensible à la casse traite Alice et alice comme la même valeur, et le rognage des espaces ignore les espaces en début et fin de champ, si bien que bob@example.com et bob@example.com fusionnent. Vous décidez également quelle copie est conservée grâce aux options Conserver le premier ou Conserver le dernier, ce qui compte lorsque les lignes situées plus bas contiennent la version la plus récente d'un enregistrement.
Lire les résultats avant d'exporter
Plutôt que de supprimer des lignes en silence, le dédoublonneur CSV vous montre ce qu'il a trouvé à travers trois vues. L'onglet Nettoyé contient votre jeu de données dédoublonné. L'onglet Groupes de doublons liste chaque ensemble de lignes correspondantes regroupées ensemble, avec un code couleur, la ligne conservée mise en évidence et les autres marquées comme supprimées. La Vue surlignée affiche le fichier original complet avec les groupes de doublons surlignés et barrés, pour vous permettre de vérifier une décision dans son contexte avant de la valider.
Un panneau de synthèse affiche les chiffres en un coup d'œil : lignes d'origine, doublons trouvés, lignes uniques restantes, et le taux de doublons en pourcentage. Ces quatre chiffres vous indiquent instantanément si un fichier est globalement propre ou truffé de répétitions.
Exporter vos données nettoyées
Lorsque le résultat vous convient, vous pouvez copier le CSV nettoyé dans le presse-papiers, le télécharger sous le nom deduplicated.csv, ou télécharger séparément un fichier duplicates-only.csv ne contenant que les lignes supprimées. Ce second fichier est utile pour une relecture ou un archivage — par exemple pour confirmer avec un collègue que les bons doublons ont bien été retirés avant de supprimer quoi que ce soit en amont.
L'outil détecte automatiquement le séparateur utilisé dans vos données, en reconnaissant les virgules, points-virgules, tabulations et barres verticales, et il analyse correctement le CSV même lorsque des champs sont entourés de guillemets ou contiennent des virgules, des sauts de ligne ou des guillemets échappés. Le fichier exporté est toujours écrit au format standard séparé par des virgules, avec les guillemets correctement appliqués.
Pourquoi supprimer les lignes en double est important
Les lignes en double faussent discrètement tout ce qui en découle. Elles gonflent les totaux et les moyennes dans un tableur, provoquent l'envoi du même e-mail deux fois à la même personne, déclenchent des erreurs lors d'imports qui imposent des clés uniques, et biaisent toute analyse construite sur ces données. Repérer les doublons avant que les données ne soient chargées ou partagées coûte bien moins cher que de démêler le problème après coup. Comme le dédoublonneur CSV fonctionne entièrement dans le navigateur, il effectue ce nettoyage rapidement sur votre propre machine sans jamais envoyer la moindre ligne où que ce soit — collez ou déposez un fichier ci-dessus pour voir votre taux de doublons et obtenir un fichier nettoyé en quelques secondes.