Перейти до вмісту

Профілювальник CSV

Сканируйте CSV і отримайте тип кожного стовпця, пропущені значення, підрахунок унікальних і топ значення.

Введення
Вихід

Профілювальник CSV

Вставте CSV дані і цей інструмент проаналізує їх стовпець за стовпцем, показавши вам, що насправді містить у своїх даних перш ніж ви створите конвеєр обробки, напишете схему або довіритеся імпорту. Для кожного стовпця інструмент визначає тип — ціле число, десяткове число, дата, логічне значення або текст — і показує частку значень, яким він не відповідає, так що стовпець, що виглядає числовим, але скриває випадкове «N/A» або опечатку, відразу ж виділиться.

Звіт по кожному стовпцю також включає пропущені комірки та їх частку від загальної кількості, кількість присутніх унікальних значень і пропозицію щодо безпеки використання стовпця як ключа: він підходить лише коли в кожному рядку є значення і жодні два рядки не збігаються. Числові стовпці отримують мінімум, максимум і середнє значення; текстові стовпці отримують мінімальну і максимальну довжину значення. Найчастіші значення перелічуються з їх підрахунком, так що ви можете виявити стовпець, що насправді є категорією, або домінований одним повторюваним значенням.

Роздільник визначається автоматично з даних, або ви можете примусово задати кому, крапку з комою, табуляцію або вертикальну риску. Відключіть «Перший рядок — заголовок» для даних, що починаються відразу ж, і перемикайтесь між зручним оглядом і таблицею, розділеною табуляцією, яку можна вставити в електронну таблицю. Неправильний CSV допускається: рядок з недостатньою кількістю полів залишає свої пропущені стовпці позначеними, а додаткові поля рядка з надлишком просто ігноруються, а не порушують весь аналіз.

Все працює локально у вашому браузері — ніщо, що ви вставляєте, не завантажується нікуди, що важливо для CSV експортів, які часто містять реальні дані клієнтів або бізнесу. Скопіюйте звіт, завантажте його як .txt файл або відправте його прямо на вхід іншого інструменту для продовження роботи.

FAQ

Як визначається тип стовпця?
Кожне непусте значення перевіряється за шаблонами цілого числа, десяткового числа, логічного значення і дати; тип, якому відповідає більшість значень, стає передбачуваним типом стовпця, і інструмент повідомляє частку значень, яким він не відповідає.
Що робить стовпець «кандидатом ключа»?
Стовпець підходить лише коли в ньому немає пропущених значень і кожне значення унікально у всіх рядках — такий же тест, який застосував би база даних для первинного ключа.
Що відбувається з рядками, у яких неправильна кількість стовпців?
Рядок з меншою кількістю полів залишає свої пропущені стовпці позначеними як пусті; рядок з додатковими полями просто має ці додаткові значення проігновані, так що неправильний CSV не порушує весь аналіз.
Чи можу я профілювати CSV без рядка заголовка?
Так. Відключіть «Перший рядок — заголовок» і кожен рядок обробляється як дані; стовпці потім позначаються як Стовпець 1, Стовпець 2 і так далі.
Мої дані CSV завантажуються де-небудь?
Ні. Профілювальник працює повністю у вашому браузері — ваш CSV ніколи не покидає ваш пристрій, що важливо коли він містить реальні дані клієнтів або бізнесу.