Suppression des doublons CSV
La suppression des doublons CSV retire les lignes qui se répètent en gardant la première de chaque, et laisse toutes les autres à leur position d'origine — elle ne trie jamais.
Comment l'utiliser
- Collez vos données CSV dans la zone de saisie
- Choisissez si la première ligne est un en-tête et si la comparaison est sensible à la casse
- Consultez le nombre de lignes et copiez le CSV sans doublons
Deux lignes sont des doublons quand leurs cellules analysées coïncident sur toute la ligne. La comparaison sensible à la casse est active par défaut ; décochez-la pour considérer « Anna » et « anna » comme identiques. Elle compare des valeurs analysées : un « a » entre guillemets et un a nu coïncident, mais une cellule avec une espace de début ou de fin en trop ne coïncide pas avec une cellule sans — guillemets et espaces parasites peuvent séparer des lignes presque identiques. La première ligne est traitée comme un en-tête par défaut : conservée intacte et exclue de la comparaison, sauf si vous cochez la case pour l'inclure comme donnée. Le délimiteur est détecté sur la première ligne ou choisi manuellement, la sortie utilise des fins de ligne LF, et le nombre de lignes retirées est indiqué. Contrairement au visualiseur CSV, elle réécrit le fichier, et contrairement à CSV vers JSON, le résultat reste du CSV. Limites : 2 Mo, 50 000 lignes, 250 000 cellules.
FAQ
Une ligne dont toutes les cellules analysées sont égales à celles d'une ligne précédente, comparées sur la ligne entière. Ce n'est ni par colonne ni par clé.
Par défaut oui — « Anna » et « anna » sont deux lignes différentes. Décochez « Respecter la casse » pour l'ignorer. Les valeurs sont comparées après analyse : un « a » entre guillemets et un a nu sont égaux, mais une espace au début ne l'est pas.
Non. Par défaut, la première ligne est conservée telle quelle et exclue de la comparaison. Cochez « Inclure la première ligne dans la comparaison » pour la dédoublonner comme les autres.