Ga naar inhoud

CSV-profiler

Scan een CSV en krijg per kolom type, ontbrekende waarden, unieke aantallen en topwaarden.

Invoer
Uitvoer

CSV-profiler

Plak CSV-gegevens en dit tool scant ze per kolom en laat je zien wat er werkelijk in je gegevens zit voordat je een pipeline bouwt, een schema schrijft of een import vertrouwt. Voor elke kolom schat het een type in – geheel getal, decimaal, datum, booleaans of tekst – en toont het aandeel waarden dat daar niet in past. Dus een kolom die numeriek lijkt maar een verstopt "N/A" of een typefout bevat, valt meteen op.

Elk kolommerapport bevat ook ontbrekende cellen en hun aandeel van het totaal, het aantal unieke waarden en een suggestie of de kolom veilig als sleutel kan worden gebruikt: het kwalificeert zich alleen wanneer elke rij een waarde heeft en geen twee rijen dezelfde delen. Numerieke kolommen krijgen minimum, maximum en gemiddelde; tekstkolommen krijgen de kortste en langste waardelengde. De meest voorkomende waarden worden vermeld met hun tellingen, zodat je een kolom kunt herkennen die echt een verborgen categorie is, of een kolom die wordt gedomineerd door een enkele herhaalde waarde.

Het scheidingsteken wordt automatisch uit de gegevens gedetecteerd, of je kunt komma, puntkomma, tab of pipe afdwingen. Schakel "Eerste rij is kop" uit voor gegevens die onmiddellijk beginnen en wissel de uitvoer tussen een leesbaar overzicht en een door tabs gescheiden tabel die je in een spreadsheet kunt plakken. Onregelmatige CSV wordt getolereerd: een korte rij laat haar ontbrekende kolommen als leeg markeren, en een lange rij met extra velden genegeerd deze gewoon in plaats van de gehele scan te verstoren.

Alles wordt lokaal in je browser uitgevoerd – niets wat je plakt wordt ergens heen geüpload, wat van belang is voor CSV-exporten die vaak echte klant- of bedrijfsgegevens bevatten. Kopieer het rapport, download het als .txt-bestand of stuur het rechtstreeks naar de invoer van een ander tool om door te gaan.

FAQ

Hoe wordt het kolomtype geschat?
Elke niet-lege waarde wordt gecontroleerd tegen patronen voor geheel getal, decimaal, booleaans en datum; het type dat de meeste waarden overeenkomen wordt het geschatte type van de kolom, en het tool rapporteert welk aandeel waarden er niet in past.
Wat maakt een kolom een "primaire sleutel kandidaat"?
Een kolom kwalificeert zich alleen wanneer deze geen ontbrekende waarden heeft en elke waarde uniek is over alle rijen – dezelfde test die een database op een primaire sleutel zou toepassen.
Wat gebeurt er met rijen die het verkeerde aantal kolommen hebben?
Een rij met minder velden dan de kop laat haar ontbrekende kolommen als leeg geteld; een rij met extra velden hebben deze extra waarden gewoon genegeerd, zodat een onregelmatig bestand de scan niet onderbreekt.
Kan ik een CSV zonder koppeprij profileren?
Ja. Schakel "Eerste rij is kop" uit en elke rij wordt als gegevens behandeld; kolommen worden dan gelabeld als Kolom 1, Kolom 2 enzovoort.
Worden mijn CSV-gegevens ergens heen geüpload?
Nee. De profiler wordt volledig in je browser uitgevoerd – je CSV verlaat nooit je apparaat, wat van belang is wanneer het echte klant- of bedrijfsgegevens bevat.