Vai al contenuto

CSV profiler

Scansiona un CSV e ottieni il tipo per colonna, i valori mancanti, i conteggi unici e i valori principali.

Ingresso

CSV profiler

Incolla i dati CSV e questo strumento li analizza colonna per colonna, segnalando cosa c'è davvero nei tuoi dati prima di costruire una pipeline, scrivere uno schema o fidarsi di un'importazione. Per ogni colonna stima un tipo — intero, decimale, data, booleano o testo — e mostra la quota di valori che non corrisponde, così una colonna che sembra numerica ma nasconde un "N/A" smarrito o un errore di battitura risalta immediatamente.

Ogni rapporto di colonna copre anche le celle mancanti e la loro quota del totale, quanti valori unici sono presenti, e un suggerimento sulla sicurezza di usare la colonna come chiave: si qualifica solo quando ogni riga ha un valore e nessuna due righe ne condividono uno. Le colonne numeriche ottengono un minimo, massimo e media; le colonne di testo ottengono la lunghezza del valore più corto e più lungo. I valori più frequenti sono elencati con i loro conteggi, quindi puoi individuare una colonna che è veramente una categoria mascherata, o una dominata da un singolo valore ripetuto.

Il delimitatore viene rilevato automaticamente dai dati, oppure puoi forzare virgola, punto e virgola, tabulazione o tubo. Disattiva "La prima riga è intestazione" per i dati che iniziano direttamente, e passa l'output tra una panoramica leggibile e una tabella separata da tabulazioni che puoi incollare in un foglio di calcolo. Un CSV irregolare è tollerato: una riga corta lascia le sue colonne mancanti contrassegnate, e i campi extra di una riga lunga vengono semplicemente ignorati anziché interrompere l'intera analisi.

Tutto viene eseguito localmente nel tuo browser — nulla di ciò che incolla viene caricato da nessuna parte, cosa che importa per le esportazioni CSV che spesso contengono dati reali di clienti o aziendali. Copia il rapporto, scaricalo come file .txt, oppure invialo direttamente all'input di un altro strumento per continuare a lavorare.

FAQ

Come viene stimato il tipo di colonna?
Ogni valore non vuoto viene verificato rispetto ai modelli di numero intero, decimale, booleano e data; il tipo che la maggior parte dei valori corrisponde diventa il tipo stimato della colonna, e lo strumento segnala quale proporzione di valori non corrisponde.
Cosa rende una colonna un "candidato chiave"?
Una colonna si qualifica solo quando non ha valori mancanti e ogni valore è unico in tutte le righe — lo stesso test che un database applicherebbe a una chiave primaria.
Cosa succede con le righe che hanno il numero sbagliato di colonne?
Una riga con meno campi dell'intestazione lascia le sue colonne mancanti conteggiate come vuote; una riga con campi extra ha semplicemente quei valori extra ignorati, quindi un file irregolare non interrompe l'analisi.
Posso profilare un CSV senza una riga di intestazione?
Sì. Disattiva "La prima riga è intestazione" e ogni riga viene trattata come dati; le colonne vengono quindi etichettate Colonna 1, Colonna 2 e così via.
Il mio CSV viene caricato da qualche parte?
No. Il profiler viene eseguito interamente nel tuo browser — il tuo CSV non lascia mai il tuo dispositivo, cosa che importa quando contiene dati reali di clienti o aziendali.