Перейти к содержанию

Как отредактировать текст, написанный ИИ, чтобы он перестал читаться как ИИ

Blog / Опубликовано 

Детекторы, которые утверждают, что могут сказать вам, был ли текст написан машиной, ненадежны в обоих направлениях: они распознают тщательно продуманную человеческую прозу и пропускают отредактированные выходные данные модели. Читатели – другое дело. Люди, которые читают много текста в Интернете, усвоили подсказки, не имея возможности их назвать, и реакция не столько «это написала модель», сколько «я перестал этому доверять». Исправление — это проход редактирования, а не детектор — и большая часть его достаточно механична, чтобы запускаться на вкладке браузера.

Слой словаря

Начните с фраз. Модели обучены искать безопасную середину во всем, что означает, что они снова и снова стремятся к одним и тем же связям и одним и тем же заверениям. Повторяющийся набор небольшой и очень узнаваемый: важно отметить, что, давайте углубимся, в современном быстро меняющемся мире, свидетельство о, ориентироваться в сложностях, играет решающую роль в, богатый гобелен, по своей сути, а также диалоговое окно, которое добавляет интерфейс чата сверху — конечно, отличный вопрос, надеюсь это поможет.

Почти ничего из этого не несет смысла. Удалить важно отметить, что и предложение после него говорит то же самое, но с большей убедительностью. Удаление фраз с помощью ИИ сопоставляет этот каталог и удаляет его, затем исправляет заглавные буквы и пробелы, оставленные при удалении, что делает выполнение этого вручную утомительным. Сначала запустите его, прежде чем редактировать что-либо еще, потому что примерно десятая часть типичного черновика исчезает, а форма оставшегося текста меняется.

Клише являются соседней проблемой и требуют другого подхода. Переломщик игры, низко висящие плоды, слон в комнате: это не машинно-специфичные, они просто мертвые. детектор клише отмечает их, а не удаляет, потому что клише иногда является правильным словом в предложении, и только вы можете это сказать. Два-три в длинной статье — это стиль. Девятый — это проект, о котором никто не думал.

Ритмический слой

Словарный запас — это легкая половина. Что на самом деле отличает черновик, так это то, что каждый абзац имеет одинаковую длину, каждый раздел состоит из трех пунктов и каждый список состоит из трех пунктов. Модели навязчиво создают триады — три прилагательных, три примера, три предложения — и как только вы заметите это в произведении, вы не сможете перестать это замечать.

Другие структурные подсказки, на которые стоит обратить внимание:

Ничто из этого не может быть обнаружено путем сопоставления строк, поэтому эта часть остается ручной. Что вы можете автоматизировать, так это диагностику: прогоните черновик через оценка читабельности и обратите внимание на распределение длины предложений, а не на количество оценок. Плоское распределение — каждое предложение от восемнадцати до двадцати четырех слов — является сигнатурой. Человеческая проза имеет гораздо более широкое распространение.

Пассивный залог, но по уважительной причине

Выходные данные модели пассивны, поскольку пассивные конструкции избегают указания того, кто что-то сделал. "В процессе развертывания были допущены ошибки" - это предложение ни о чем. пассивный детектор голоса перечисляет пассивные предложения и, что полезно, показывает агента, когда он присутствует, — так что вы можете сразу увидеть, какие пассивы скрывают действующего лица, а какие являются законными.

Не конвертируйте их все. Пассивный залог правильный, когда действующее лицо неизвестно, не имеет значения или намеренно не названо, и в английской научной литературе он используется как условность. Эмпирическое правило: если вы можете добавить «кем?» Если в пассивном предложении ответ важен для читателя, перепишите его. В противном случае оставьте это и идите дальше.

Невидимый слой

Текст, скопированный из интерфейса чата, содержит символы, которые вы не видите. Неразрывные пробелы вместо обычных, соединительные элементы нулевой ширины, оставшиеся от последовательностей эмодзи, мягкие дефисы, узкие неразрывные пробелы вокруг знаков препинания и иногда кириллический символ, сидящий внутри латинского слова после прохождения через какой-то промежуточный инструмент. Они сохраняются при вставке в CMS, а затем нарушают поиск, нарушают сравнение и создают загадку, в которой две, казалось бы, идентичные строки не сравниваются равными.

невидимый детектор символов показывает вам каждый из них с его кодовой точкой и смещением, чтобы вы могли решить, что удалить, а не слепо удалять все — часто намеренно создается неразрывный пробел. Делайте это в последнюю очередь после всех переписываний, потому что при каждом редактировании с помощью другого инструмента можно добавить свои собственные.

Чего не делать

Две чрезмерные коррекции хуже исходной проблемы.

Во-первых, это очистка em тире. Он стал предполагаемым маркером ИИ, и теперь люди охотятся за ним в своих собственных текстах, но тире — это обычный английский знак препинания, и замена каждого знака запятой дает прозу, которая читается как форма. Что делает использование тире похожим на машинную генерацию, так это единообразие: по одному на абзац, всегда в одной и той же риторической позиции. Меняйте пунктуацию, не запрещайте.

Второй — пропустить текст через «гуманизатор», который заменяет слова синонимами. В результате получается нечто худшее, чем оригинал: текст с той же плоской структурой и теперь неправильным выбором слов, который читается как машинно-написанный. и беспечный. Структура – это то, где живет телл. Синонимы – украшение.

Пропуск по порядку

Удалите стандартные фразы. Отметьте и проредите клише. Прочтите распределение по длине предложений и намеренно нарушьте его — объедините где-нибудь два предложения, разделите другое, оставьте один абзац очень коротким. Исправьте пассивки, скрывающие актера. Вырежьте каждое завершающее предложение, которое повторяет предложение. Затем сметите невидимые символы и скопируйте их.

Пятнадцать минут на странице, и результат не «незаметен» — он просто написан лучше, что и было основной целью. Каждый из этих инструментов запускается локально в вашем браузере, поэтому неопубликованный черновик остается на вашем компьютере, пока вы над ним работаете.

Написал Ján Turský

Создатель TextArray — создания бесплатных инструментов, обеспечивающих конфиденциальность, которые полностью работают в вашем браузере.