Aller au contenu

CSV profiler

Analysez un CSV et obtenez le type par colonne, les valeurs manquantes, les décomptes uniques et les principales valeurs.

Entrée
Sortie

CSV profiler

Collez les données CSV et cet outil les analyse colonne par colonne, vous signalant ce qui se trouve réellement dans vos données avant de construire un pipeline, d'écrire un schéma ou de faire confiance à une importation. Pour chaque colonne, il estime un type — entier, décimal, date, booléen ou texte — et affiche la part de valeurs qui ne correspondent pas, ainsi une colonne qui semble numérique mais cache un "N/A" égaré ou une faute de frappe ressort immédiatement.

Chaque rapport de colonne couvre également les cellules manquantes et leur part du total, combien de valeurs uniques sont présentes, et une suggestion sur la sécurité d'utiliser la colonne comme clé : elle ne se qualifie que quand chaque ligne a une valeur et qu'aucune deux lignes n'en partagent une. Les colonnes numériques obtiennent un minimum, maximum et moyenne ; les colonnes de texte obtiennent la longueur de valeur la plus courte et la plus longue. Les valeurs les plus fréquentes sont listées avec leurs décomptes, vous pouvez donc détecter une colonne qui est réellement une catégorie déguisée, ou une dominée par une seule valeur répétée.

Le séparateur est détecté automatiquement à partir des données, ou vous pouvez forcer une virgule, un point-virgule, une tabulation ou une barre verticale. Désactivez "La première ligne est un en-tête" pour les données qui commencent directement, et basculez la sortie entre un aperçu lisible et un tableau séparé par des tabulateurs que vous pouvez coller dans une feuille de calcul. Un CSV irrégulier est toléré : une ligne courte laisse ses colonnes manquantes marquées, et les champs supplémentaires d'une ligne longue sont simplement ignorés plutôt que de casser l'analyse.

Tout s'exécute localement dans votre navigateur — rien de ce que vous collez n'est téléchargé nulle part, ce qui importe pour les exportations CSV qui portent souvent des données réelles de clients ou d'entreprises. Copiez le rapport, téléchargez-le en tant que fichier .txt, ou envoyez-le directement à l'entrée d'un autre outil pour continuer le travail.

FAQ

Comment le type de colonne est-il estimé?
Chaque valeur non vide est vérifiée par rapport aux modèles d'entier, décimal, booléen et date ; le type que la plupart des valeurs correspondent devient le type estimé de la colonne, et l'outil signale quelle proportion de valeurs ne correspond pas.
Qu'est-ce qui fait qu'une colonne est un "candidat clé"?
Une colonne se qualifie uniquement quand elle n'a pas de valeurs manquantes et que chaque valeur est unique dans toutes les lignes — le même test qu'une base de données appliquerait à une clé primaire.
Que se passe-t-il avec les lignes qui ont le mauvais nombre de colonnes?
Une ligne avec moins de champs que l'en-tête laisse ses colonnes manquantes comptées comme vides ; une ligne avec des champs supplémentaires a simplement ces valeurs supplémentaires ignorées, donc un fichier irrégulier n'interrompt pas l'analyse.
Puis-je profiler un CSV sans une ligne d'en-tête?
Oui. Désactivez "La première ligne est un en-tête" et chaque ligne est traitée comme des données ; les colonnes sont alors étiquetées Colonne 1, Colonne 2 et ainsi de suite.
Mon CSV est-il téléchargé quelque part?
Non. Le profiler s'exécute entièrement dans votre navigateur — votre CSV ne quitte jamais votre appareil, ce qui importe quand il contient des données réelles de clients ou d'entreprises.