Hoppa till innehåll

CSV-profiler

Skanna en CSV och få per kolumn typ, saknade värden, unika antal och topvärden.

Inmatning
Utmatning

CSV-profiler

Klistra in CSV-data och det här verktyget skannar den per kolumn och visar dig vad som faktiskt finns i dina data innan du bygger en pipeline, skriver ett schema eller litar på en import. För varje kolumn uppskattar det en typ – heltal, decimal, datum, boolesk eller text – och visar andelen värden som inte passar den, så en kolumn som ser numerisk ut men gömmer ett vilsekommet "N/A" eller ett stavfel sticker omedelbar ut.

Varje kolumnrapport täcker också saknade celler och deras andel av totalen, hur många unika värden som finns och ett förslag på om kolumnen är säker att använda som nyckel: den kvalificeras bara när varje rad har ett värde och ingen två rader delar ett. Numeriska kolumner får minimum, maximum och medelvärde; textkolumner får den kortaste och längsta värdepunkten. De vanligaste värdena listas med sina räkningar, så du kan upptäcka en kolumn som verkligen är en kategori i förklädnad, eller en som domineras av ett enda upprepat värde.

Avgränsaren detekteras automatiskt från data eller du kan tvinga fram komma, semikolon, tabulator eller pipe. Slå av "Första raden är rubrik" för data som startar direkt och växla utdata mellan en läsbar översikt och en tabbseparerad tabell som du kan klistra in i ett kalkylark. Dålig CSV tolereras: en kort rad lämnar sina saknade kolumner markerade som tomma, och en lång rad med extra fält ignoreras helt enkelt istället för att bryta hela skanningen.

Allt körs lokalt i din webbläsare – ingenting du klistrar in laddas upp någonstans, vilket är viktigt för CSV-exporter som ofta innehåller verklig kund- eller affärsdata. Kopiera rapporten, ladda ner den som .txt-fil eller skicka den direkt till ett annat verktygs input för att fortsätta arbeta.

FAQ

Hur uppskattas kolumntypen?
Varje icke-tomt värde kontrolleras mot mönster för heltal, decimal, boolesk och datum; typen som de flesta värdena matchar blir kolumnens uppskattade typ, och verktyget rapporterar vilken andel värden som inte passar den.
Vad gör en kolumn till en "primärnyckelkandidat"?
En kolumn kvalificeras bara när den inte har några saknade värden och varje värde är unikt över alla rader – samma test som en databas skulle tillämpa på en primärnyckel.
Vad händer med rader som har fel antal kolumner?
En rad med färre fält än rubriken lämnar sina saknade kolumner räknade som tomma; en rad med extra fält ignorerar helt enkelt dessa extra värden, så en dålig fil bryter inte hela skanningen.
Kan jag profilera en CSV utan en rubrikrad?
Ja. Slå av "Första raden är rubrik" och varje rad behandlas som data; kolumner märks sedan som Kolumn 1, Kolumn 2 och så vidare.
Laddas min CSV-data upp någonstans?
Nej. Profileren körs helt i din webbläsare – din CSV lämnar aldrig din enhet, vilket är viktigt när den innehåller verklig kund- eller affärsdata.