Перейти до вмісту

Видобування власних імен

Видаляє з тексту імовірні імена людей, назви місць та бренди.

Введення

Видобування власних імен

Вставте статтю, записи розмови або нотатки — інструмент видалить слова, які з високою ймовірністю є імена людей, назви місць або згадки про бренди: великі букви в словах, які не просто стоять на початку речення. Це швидкий спосіб зрозуміти, про кого та про що насправді йдеться в тексті, без необхідності читати його рядок за рядком.

За умовчанням велика буква вважається значущою лише коли вона з'являється всередині речення, оскільки слово на початку речення пишеться з великої букви незалежно від того, що це. Ввімкніть параметр «Включити слова з початку речень», щоб розширити пошук, коли ви віддаєте перевагу знайти більше, ніж щось пропустити. Параметр «Об'єднувати сусідні великі букви слів» об'єднує послідовності, такі як «Нью-Йорк» чи «міст Золоті Ворота» в один елемент, замість того щоб розділяти їх на окремі слова, а параметр «Пропускати частотні слова» видаляє часто зустрічаються великі букви слів — займенники, привітання, назви днів тижня та місяців, — які рідко є тим іменем, яке вас цікавить. Відсортуйте результати за частотою, щоб побачити, що згадується найчастіше, або за абеткою, щоб переглянути чистий довідниковий список, і виберіть простий список або CSV залежно від того, куди далі піде результат.

Інструмент розпізнає поширені скорочення, такі як «д-р», «г-н» та «вул.», тому слово одразу після них не буде помилково сприйнято як початок нового речення. Він однаково обробляє розриви рядків Windows та Unix, без проблем справляється з дуже довгим текстом, а лічильник під результатом показує, скільки різних елементів було знайдено і як часто вони зустрічалися в цілому.

Все відбувається локально у вашому браузері — текст, який ви вставляєте, ніколи не завантажується та не надсилається нікуди. Коли ви закінчите, скопіюйте результат, завантажте його як текстовий файл або відправте результат назад у вхідні дані для подальшого уточнення.

FAQ

Що тут розуміється під «власною імею»?
Будь-яке слово з великою буквою або, якщо ввімкнуто об'єднання, послідовність слів з великими буквами, яка не просто позначає початок речення. Це евристичний метод, заснований на великих буквах, а не на словнику реальних імен, тому він іноді може захопити нарицательное слово з великою буквою та пропустити назву бренду в нижньому регістрі.
Чому ім'я на самому початку речення пропускається?
Кожне слово на початку речення пишеться з великої букви, це справжнім ім'ям чи ні, тому підрахунок цих слів заповнив би результати хибними збігами. Ввімкніть параметр «Включити слова з початку речень», якщо ви віддаєте перевагу бачити все.
Як працює об'єднання сусідніх слів?
Коли два або більше слів з великими буквами стоять поруч, розділені одним пробілом, вони об'єднуються в один елемент — «Нью-Йорк» замість окремих слів «Нью» та «Йорк». Пунктуація або строчне слово між ними перериває об'єднання.
Що видаляє параметр «Пропускати частотні слова»?
Вбудований невеликий список часто зустрічаються великих букв слів, які рідко мають значення: займенники, такі як «Я», привітання та назви днів тижня чи місяців. Багатосмислові елементи, такі як «Нью-Йорк», ніколи не залишаються цим фільтром.
Мій текст завантажується кудись?
Ні. Видобування відбувається повністю у вашому браузері — ваш текст ніколи не залишає ваш пристрій.