🗑️ Supprimer les Doublons
Supprimez les lignes en double de n'importe quelle liste instantanément. Gratuit, sans inscription.
Aucun doublon supprimé pour l'instant.
Cliquez sur « Supprimer les Doublons » pour commencer.
Ce que chaque bouton supprime, réorganise ou révèle réellement
La version courte : deux boutons suppriment les doublons et conservent votre ordre d'origine, un bouton supprime les doublons puis classe par ordre alphabétique ce qui reste, et un bouton ne supprime absolument rien, il vous montre seulement ce qui est répété.
john@email.com
jane@email.com
John@Email.com
bob@email.com
jane@email.comjohn@email.com
jane@email.com
John@Email.com
bob@email.com| Bouton | Gestion de la casse | Conserve l'ordre original | Passe à un processus en arrière-plan au-delà de 5 000 lignes |
|---|---|---|---|
| Supprimer les doublons | Correspondance exacte sensible à la casse | Oui | Oui |
| Ignorer la casse | Correspondance insensible à la casse | Oui | Oui |
| Trier + Dédoublonner | Correspondance exacte sensible à la casse | Non, alphabétisé | Non |
| Afficher les doublons | Correspondance exacte sensible à la casse | Ne supprime rien | Non |
Chacun de ces quatre boutons exécute la même première étape avant de comparer une seule ligne : le texte collé est divisé sur les sauts de ligne, chaque ligne a ses espaces de début et de fin supprimés, et toute ligne qui est maintenant vide est complètement supprimée de la liste. Ce qui survit à ce passage est ce sur quoi travaille le reste de la logique du bouton. Cette première étape est identique pour "Supprimer les doublons" et "Ignorer la casse", la seule véritable différence entre eux est donc la règle de comparaison unique en dessous, pas la suppression des espaces ou la gestion des lignes vides autour.
Seuls "Supprimer les doublons" et "Ignorer la casse" envoient leurs lignes supprimées dans le panneau "Doublons supprimés" sur la droite. "Trier + Dédoublonner" remplit également ce panneau, puisqu'il dédoublonne avant de trier. "Afficher les doublons" n'y touche jamais, car il ne supprime rien, il ne fait que réorganiser ce qui reste dans l'éditeur principal.
Les grandes listes se comportent différemment selon le bouton. Au-delà de 5 000 lignes, "Supprimer les doublons" et "Ignorer la casse" passent le relais à un Web Worker en arrière-plan pour que l'onglet reste réactif. "Trier + Dédoublonner" et "Afficher les doublons" n'ont pas ce transfert et s'exécutent toujours directement sur la page, de sorte qu'un collage inhabituellement volumineux peut faire brièvement suspendre l'onglet lorsque vous cliquez sur l'un de ces deux boutons.
Sensible à la casse par défaut : Quand Apple et apple comptent pour deux
Supprimer les doublons traite la casse comme faisant partie du texte. Cliquez plutôt sur Ignorer la casse et apple, Apple et APPLE se fondent dans l'orthographe qui a été collée en premier.
john@email.com
jane@email.com
John@Email.com
bob@email.comjohn@email.com
jane@email.com
bob@email.comLes deux colonnes partent de la même liste collée : john@email.com, jane@email.com, John@Email.com, bob@email.com, jane@email.com. "Supprimer les doublons" simple ne détecte que la répétition exacte de jane@email.com à la dernière ligne, car il compare les lignes exactement telles qu'elles sont écrites. John@Email.com survit juste à côté de john@email.com, car pour une comparaison sensible à la casse, les lettres majuscules et minuscules sont tout simplement des caractères différents.
Cette valeur par défaut est correcte pour les données où la casse a réellement un sens : SKU de produits, noms d'utilisateur sensibles à la casse et codes où ABC123 et abc123 pourraient faire référence à des enregistrements entièrement différents. C'est la mauvaise valeur par défaut pour une liste de diffusion, car john@email.com et John@Email.com pointent vers la même boîte de réception, et envoyer deux fois à la même adresse est exactement ce que la déduplication était censée empêcher.
Ignorer la casse est un bouton, pas une case à cocher. En cliquant dessus, chaque ligne est convertie en minuscules uniquement à des fins de comparaison, la première orthographe vue pour chaque valeur unique est conservée, et toute la suppression est exécutée en ce seul clic. Cela ne modifie pas un paramètre persistant qui change ce que fait le bouton Supprimer les doublons simple la prochaine fois que vous appuyez dessus. Il n'y a pas non plus d'option partielle, aucun moyen d'ignorer la casse pour une partie d'une ligne, ou seulement en dehors d'un nom de domaine. Le choix est binaire : comparer chaque ligne exactement comme elle a été tapée, ou plier chaque ligne en minuscules avant de comparer.
Trier + Dédoublonner n'a pas de version insensible à la casse de lui-même. Il compare toujours les lignes exactement, de la même manière que le bouton Supprimer les doublons simple. Si vous avez besoin à la fois d'un résultat insensible à la casse et d'un résultat alphabétique, cliquez d'abord sur Ignorer la casse pour regrouper les variantes de casse, puis cliquez sur Trier + Dédoublonner pour classer par ordre alphabétique ce qui reste. Exécuter Trier + Dédoublonner seul sur des données à casse mixte conservera chaque variante de casse qu'il ne reconnaît pas comme identique.
Pourquoi les espaces supprimés corrigent certains doublons et pas d'autres
Chaque comparaison supprime d'abord le début et la fin de chaque ligne. Un espace perdu au début ou à la fin ne provoque jamais de fausse non-correspondance. Un double espace au milieu d'une ligne compte toujours comme un texte différent.
john@email.com
john@email.comjohn@email.comLes deux lignes ci-dessus semblent identiques, et pour vos yeux elles le sont. La deuxième a été collée avec un espace de fin invisible, du genre de ceux qui sont fournis gratuitement lorsque vous copiez une valeur à partir d'une cellule de feuille de calcul ou d'un tableau PDF. Avant que cet outil ne compare quoi que ce soit, il supprime les espaces de début et de fin de chaque ligne, de sorte que cet espace de fin n'a jamais la chance de faire paraître différentes deux lignes par ailleurs identiques. Le résultat est une seule ligne survivante, exactement comme il se doit.
Ce que la suppression des espaces ne fait pas, c'est toucher aux espaces à l'intérieur d'une ligne. New York et New York, le second avec deux espaces entre les mots au lieu d'un, sont rognés de la même manière sur leurs bords mais diffèrent toujours au milieu, donc aucun des quatre boutons ne les traite comme des doublons. Réduire automatiquement les espaces internes risquerait de fusionner deux entrées de plusieurs mots véritablement différentes, donc cet outil ne s'en mêle pas exprès. Les tabulations sont supprimées de la même manière que les espaces : une ligne qui commence par un caractère de tabulation au lieu d'un espace est nettoyée tout aussi proprement, car l'étape de suppression élimine tous les types d'espaces des deux extrémités d'une ligne, et pas seulement le caractère espace spécifiquement.
L'espacement interne incohérent survit à chaque bouton sur cette page. Si vos données contiennent des entrées comme New York et New York assises côte à côte, la déduplication ne le détectera pas, car la suppression des espaces ne touche que les deux extrémités d'une ligne. Normalisez d'abord l'espacement interne à la main ou avec une passe de recherche et remplacement, puis relancez la suppression.
Quelle copie survit, et si la liste reste dans l'ordre
Supprimer les doublons et Ignorer la casse conservent tous deux chaque ligne survivante exactement là où elle se trouvait. Trier + Dédoublonner conserve la même première occurrence, puis classe par ordre alphabétique le résultat, de sorte que l'ordre d'origine disparaît.
Banana
Apple
CherryApple
Banana
CherryCollez Banana, Apple, Banana, Cherry et les deux boutons s'accordent sur la copie de Banana à conserver : la première, rencontrée en scannant la liste de haut en bas. Là où ils divergent, c'est ce qui arrive aux survivants par la suite. Supprimer les doublons laisse Banana, Apple, Cherry dans cet ordre exact, car rien dans l'étape de suppression ne réordonne quoi que ce soit, cela ne fait que retirer des lignes. Trier + Dédoublonner prend les trois mêmes survivants et les classe par ordre alphabétique, atterrissant plutôt sur Apple, Banana, Cherry.
Conserver l'ordre d'origine est important chaque fois que la séquence de vos données contient des informations qui lui sont propres : un journal chronologique, une liste où la première entrée est l'enregistrement canonique et les suivantes sont des collages accidentels, ou tout ensemble de données où un nouveau tri effacerait quelque chose concernant la priorité ou le moment. Utilisez Trier + Dédoublonner spécifiquement lorsque vous voulez une liste de référence propre et classée par ordre alphabétique et que l'ordre dans lequel les données sont arrivées n'a jamais été significatif au départ. Cette règle de la première occurrence est également fixe sur chaque bouton ici : rien sur cette page ne conserve la dernière occurrence d'une ligne répétée au lieu de la première, il n'y a donc pas de paramètre à basculer si ce que vous vouliez vraiment était la copie la plus récente.
Le panneau Doublons supprimés suit également l'ordre de numérisation. Que vous ayez cliqué sur Supprimer les doublons, Ignorer la casse ou Trier + Dédoublonner, les lignes qui s'affichent dans le panneau de droite sont répertoriées dans l'ordre où elles ont été rencontrées lors de la numérisation, sans être regroupées par la ligne survivante qu'elles ont dupliquée et sans être classées par ordre alphabétique.
Pourquoi un doublon mal orthographié passe à travers sans être touché
Chaque comparaison ici est exacte. John Smith et Jon Smith, ou Acme Inc. et Acme Inc, sont deux lignes différentes pour cet outil, pas un doublon et une faute de frappe de l'autre.
John Smith
Jon Smith
Acme Inc.
Acme IncJohn Smith
Jon Smith
Acme Inc.
Acme IncCliquez sur Supprimer les doublons dans cette liste et rien ne change. Les quatre lignes sont conservées, et l'outil vous le dit avec un message "Aucun doublon trouvé !", car chaque comparaison qu'il effectue est une correspondance caractère par caractère sur la ligne sans espaces et éventuellement en minuscules. Il n'a aucun concept de "presque ça". Une faute de frappe d'une lettre, un point final manquant ou un trait d'union remplacé par un espace produisent tous deux lignes qui ne sont tout simplement pas liées pour tout bouton ici.
C'est une limitation délibérée, pas un oubli. Décider de la similitude que deux lignes doivent avoir avant d'être comptées comme la même chose, généralement mesurée par quelque chose comme la distance d'édition, est un type d'algorithme fondamentalement différent de la comparaison exacte, et il fait des choix qui varient selon l'ensemble de données. Se tromper dans l'autre sens, fusionner deux enregistrements qui ne font que se ressembler, peut détruire silencieusement des données réelles, ce qui est un pire résultat que de laisser un quasi-doublon évident dans la liste pour qu'un humain le remarque.
Une méthode pratique pour gérer les données désordonnées : exécutez d'abord Afficher les doublons pour voir combien de répétitions exactes existent déjà, normalisez les différences de formatage évidentes à la main ou avec une passe de recherche et remplacement, une casse cohérente, une ponctuation cohérente, des abréviations cohérentes, puis relancez Supprimer les doublons. Le nettoyage qui transforme les quasi-doublons en correspondances exactes est ce qui permet à cet outil de les détecter.
Ce que Afficher les doublons affiche réellement, et dans quel ordre
Afficher les doublons répertorie chaque valeur qui apparaît plus d'une fois, une fois chacune, sans rien supprimer. Si votre liste mélange des nombres simples avec des mots, les nombres viennent en premier par ordre croissant, pas dans l'ordre où vous les avez collés.
100
5
zebra
100
5
zebra5
100
zebra"Afficher les doublons" compte combien de fois chaque ligne rognée apparaît, ne conserve que les valeurs qui apparaissent plus d'une fois et remplace le contenu de l'éditeur par cette liste, une entrée par valeur dupliquée plutôt qu'une entrée par répétition. Une ligne collée cinq fois apparaît une fois dans le résultat, car le but est de montrer quelles valeurs se répètent, et non le nombre de copies qui existent. Rien dans votre texte d'origine n'est modifié ou supprimé par ce bouton.
Le classement des nombres dans l'exemple ci-dessus n'est pas une fonction de tri. Il découle de la façon dont l'objet JavaScript comptant vos lignes ordonne ses propres clés : les entrées qui ressemblent à des nombres entiers non négatifs simples, comme 5 et 100, sont toujours répertoriées en premier par ordre numérique croissant, avant toute autre valeur dupliquée, qui apparaît ensuite dans l'ordre où elle a été rencontrée pour la première fois. Cela ne se remarque que lorsque vos données dupliquées mélangent des lignes numériques simples avec des lignes de texte. Une liste de noms ou de mots dupliqués sans chiffres simples revient dans l'ordre de la première rencontre, sans aucune particularité à noter. Le même comportement numérique en premier apparaît quel que soit le nombre de répétitions d'une valeur ou la longueur de la liste, car il provient de la façon dont l'objet de comptage ordonne ses clés plutôt que de la taille de vos données.
Afficher les doublons ne touche jamais au panneau Doublons supprimés sur la droite. Ce panneau continue d'afficher ce qu'il a affiché en dernier, ou "En attente..." si vous n'avez pas encore exécuté Supprimer les doublons, Ignorer la casse ou Trier + Dédoublonner, puisque Afficher les doublons ne supprime rien et n'y écrit jamais.
Six façons dont les gens utilisent réellement cet outil
Nettoyer une liste de diffusion avant une campagne
Collez une liste combinée de plusieurs sources d'inscription et cliquez sur Ignorer la casse plutôt que sur le bouton simple. La même adresse tapée avec une casse différente est toujours la même boîte de réception, et envoyer deux fois à la même personne est exactement le résultat que vous essayez d'éviter.
Vérifier avant de s'engager à supprimer quoi que ce soit
Cliquez d'abord sur Afficher les doublons sur toute liste dont vous n'êtes pas totalement sûr. Voir exactement quelles valeurs se répètent, sans perdre vos données d'origine, vous donne la chance de détecter un cas où un doublon apparent a en fait un sens avant d'exécuter la suppression elle-même.
Construire une liste principale propre et classée par ordre alphabétique
Lorsque vous consolidez plusieurs listes sources en un seul document de référence et que l'ordre d'origine n'a pas d'importance, Trier + Dédoublonner fait les deux travaux en un seul clic : uniquement des valeurs uniques, classées par ordre alphabétique, prêtes à être utilisées comme liste de recherche.
Nettoyer une colonne exportée d'une feuille de calcul
Les exportations de feuilles de calcul comportent fréquemment des espaces de fin provenant du remplissage des cellules, ainsi qu'une casse incohérente due à la saisie manuelle de données. Étant donné que chaque comparaison ici supprime les espaces automatiquement, et qu'Ignorer la casse gère la moitié de la casse, coller une colonne exportée directement détecte généralement les deux problèmes en un seul passage.
Garder un journal chronologique ou un enregistrement propre
Lorsque l'ordre de vos données est important, un journal, ou une liste où la première entrée est l'enregistrement d'origine, cliquez sur Supprimer les doublons simple ou Ignorer la casse plutôt que sur Trier + Dédoublonner. Les deux conservent chaque ligne survivante exactement là où elle se trouvait, de sorte que la séquence avec laquelle vous avez commencé est toujours lisible par la suite, et aucun des deux ne réorganisera silencieusement une liste sur laquelle vous comptiez pour rester en place.
Travailler avec de très grandes exportations
Supprimer les doublons et Ignorer la casse passent tous le relais à un processus en arrière-plan une fois qu'une liste dépasse les 5 000 lignes, de sorte que l'onglet continue de répondre pendant qu'un fichier volumineux est traité. Trier + Dédoublonner et Afficher les doublons s'exécutent directement sur la page quelle que soit la taille. Quoi qu'il en soit, rien de ce que vous collez ne quitte votre appareil : il n'y a pas d'étape de téléchargement, pas de file d'attente de traitement et pas de compte à créer.
Questions Fréquentes
Outils de Texte Associés
Besoin d'en faire plus avec vos données ? Essayez ces outils complémentaires :
🔒 100 % Privé et Sécurisé
La confidentialité de vos données est notre priorité. Toute la suppression des doublons s'effectue localement dans votre navigateur : votre texte n'est jamais envoyé sur un serveur. Nous ne pouvons pas voir, stocker ni accéder à vos données. Utilisez cet outil en toute confiance pour des informations sensibles telles que des listes d'e-mails, des données clients ou des documents confidentiels.