JSON et tableaux / Nettoyage

Dédoublonnage de données : supprimer les lignes en double par colonne

Collez des données CSV ou une liste et supprimez les lignes en double en comparant les colonnes de votre choix ou la ligne entière. Vous pouvez ignorer la casse et les espaces superflus, conserver la première ou la dernière occurrence, et voir quelles valeurs se répètent et combien de fois.

Dédoublonnage de données : supprimer les lignes en double par colonne: Chaque ligne reçoit une clé fondée sur les colonnes choisies, puis mise en forme selon les options indiquées. Seule la première (ou la dernière) ligne associée à chaque clé est conservée, dans l’ordre d’origine. Dans l’exemple, la comparaison par adresse e-mail sans tenir compte de la casse conserve Ana et Ben, et supprime la deuxième occurrence d’Ana ainsi que Cy, dont l’adresse e-mail est identique à celle de Ben. Fonctionne 100 % localement dans votre navigateur, sans aucun téléversement de fichier vers le serveur.

Exécutions
Dans votre navigateur
Coût
Gratuit · sans inscription
Disponibilité
Prêt à l'emploi
Déduplication des donnéesTraitement local

Fonctionne entièrement dans votre navigateur

Comparer selon (aucune sélection : lignes entières)
Lignes conservées2sur 4
Doublons supprimés2

Résultat

name,email
Ana,ana@example.com
Ben,ben@example.com
Valeur répétéeHeures
ana@example.com2
ben@example.com2

Les lignes sont considérées comme des doublons lorsque les colonnes sélectionnées correspondent, ou lorsque la ligne entière correspond si aucune colonne n’est sélectionnée. L’ignorance de la casse et des espaces supplémentaires détecte les entrées telles que « ANA » et « ana ». Le résultat conserve l’ordre d’origine et peut être recollé dans un tableur. Les champs CSV entre guillemets contenant des virgules ou des sauts de ligne sont pris en charge.

Correspondance des quasi-doublons

Ignorer la casse et les espaces permet de repérer « ANA » et « ana » ; les différences d’orthographe et les surnoms nécessitent toujours une vérification humaine ou un outil de correspondance floue.

Listes simples

Pour une simple liste sans colonnes, supprimer les lignes en double est plus rapide.

Comment l'utiliser

  1. Collez les données CSV, avec ou sans ligne d’en-tête.
  2. Cochez les colonnes à comparer, puis choisissez les options concernant la casse, les espaces et l’occurrence à conserver.
  3. Copiez le fichier CSV dédoublonné.

Confidentialité et limitations

Vos données restent dans votre navigateur et ne sont jamais téléversées.

Outils associés

Questions fréquentes

En quoi cet outil est-il différent de la suppression des lignes en double ?

Il comprend les colonnes : deux lignes peuvent être considérées comme des doublons selon leur adresse e-mail même si les noms diffèrent, et les virgules entre guillemets dans les cellules sont correctement traitées.

Quelle occurrence dois-je conserver ?

Conservez la première pour garder l’enregistrement le plus ancien, ou la dernière pour conserver la mise à jour la plus récente lorsque les lignes sont classées par date.

Peut-il traiter des fichiers volumineux ?

Des dizaines de milliers de lignes peuvent être traitées dans le navigateur ; pour des millions de lignes, une base de données ou un outil en ligne de commande est préférable.

Outil gratuit · dans votre navigateur exécutions · aucun compte requis