Preskočiť na obsah

Ako upraviť text napísaný AI, aby sa prestal čítať ako AI

Blog / Zverejnené 

Detektory, ktoré tvrdia, že vám povedia, či bol text napísaný strojom, sú nespoľahlivé v oboch smeroch: signalizujú starostlivú ľudskú prózu a mávajú cez upravený výstup modelu. Čitatelia sú iná vec. Ľudia, ktorí čítajú veľa textu online, sa naučili slová bez toho, aby ich vedeli pomenovať, a reakcia nie je ani tak „toto napísal model“, ale skôr „prestal som tomu dôverovať“. Oprava je prechod na úpravu, nie detektor – a väčšina z nich je dostatočne mechanická na spustenie na karte prehliadača.

Vrstva slovnej zásoby

Začnite s frázami. Modely sú trénované smerom k bezpečnému stredu všetkého, čo znamená, že siahajú po rovnakých spojovacích materiáloch a rovnakých uisteniach znova a znova. Opakujúca sa sada je malá a dobre rozpoznateľná: je dôležité si to uvedomiť, poďme sa ponoriť do, v dnešnom uponáhľanom svete, svedectvo o, orientovať sa v zložitostiach, zohráva rozhodujúcu úlohu v, bohatá tapiséria, v jeho jadreplus konverzačné lešenie a rozhranie chatu pridáva navrch — určite, skvelá otázka, Dúfam, že to pomôže.

Takmer žiadna z nich nemá význam. Odstrániť je dôležité si to uvedomiť a veta za ňou hovorí to isté s väčšou autoritou. The Odstraňovač fráz AI zhoduje sa s týmto katalógom a odstráni ho, potom opraví veľké písmená a medzery, ktoré zanechá vymazanie, čo je časť, kvôli ktorej je ručné robiť únavné. Spustite ho najskôr, kým upravíte čokoľvek iné, pretože približne desatina typického konceptu zmizne a tvar zostávajúceho textu sa zmení.

Klišé sú susedným problémom a vyžadujú si iné zaobchádzanie. Menič hry, nízko visiace ovocie, slon v miestnosti: tieto nie sú špecifické pre stroj, sú jednoducho mŕtve. The detektor klišé skôr ich označí ako vymaže, pretože klišé je niekedy to správne volanie vo vete a len vy to viete povedať. Dva-tri v dlhom článku je štýl. Deviatka je draft, o ktorom nikto nepremýšľal.

Rytmická vrstva

Slovná zásoba je ľahká polovica. Čo v skutočnosti dáva návrh preč je, že každý odsek má rovnakú dĺžku, každá sekcia má tri odrážky a každý zoznam má tri položky. Modely nutkavo vytvárajú triády – tri prídavné mená, tri príklady, tri vety – a keď si to všimnete v kuse, nemôžete si to prestať všímať.

Ďalšie štrukturálne informácie, ktoré sa oplatí loviť očami:

Žiadna z nich nie je detekovateľná porovnávaním reťazcov, preto táto časť zostáva manuálna. Čo môžete zautomatizovať, je diagnostika: spustite návrh cez skóre čitateľnosti a pozrite sa skôr na distribúciu dĺžky viet než na číslo známky. Ploché rozdelenie - každá veta medzi osemnástimi a dvadsiatimi štyrmi slovami - je podpisom. Ľudská próza má oveľa širšie rozšírenie.

Pasívny hlas, ale zo správneho dôvodu

Výstup modelu je pasívny, pretože pasívne konštrukcie sa vyhýbajú tomu, kto niečo urobil. „V procese nasadenia sa urobili chyby“ je veta o ničom. The pasívny hlasový detektor uvádza zoznam pasívnych viet a, čo je užitočné, ukazuje agenta, keď je prítomný – takže môžete na prvý pohľad vidieť, ktoré pasíva skrývajú herca a ktoré sú legitímne.

Nekonvertujte všetky. Pasívum je správne, keď je aktér neznámy, irelevantný alebo zámerne nepomenovaný a anglické vedecké písanie ho používa ako konvenciu. Základné pravidlo: ak môžete pridať „kým?“ na pasívnu vetu a na odpovedi záleží čitateľovi, prepíšte ju. V opačnom prípade to nechajte tak a choďte ďalej.

Neviditeľná vrstva

Text skopírovaný z rozhrania rozhovoru obsahuje znaky, ktoré nevidíte. Nedeliteľné medzery namiesto obyčajných, spojky s nulovou šírkou, ktoré zostali zo sekvencií emotikonov, jemné pomlčky, úzke medzery bez zalomenia okolo interpunkcie a občas znak cyriliky sediaci v latinskom slove po spiatočnej ceste cez nejaký prechodný nástroj. Tieto prežijú vloženie do CMS a potom prerušia vyhľadávanie, prerušia porovnávanie a vytvoria záhadu, kde sa dva zdanlivo rovnaké reťazce neporovnávajú rovnako.

The detektor neviditeľných znakov vám ukáže každý z nich s jeho kódovým bodom a odsadením, takže sa môžete rozhodnúť, čo odstrániť, namiesto toho, aby ste všetko slepo odstránili – neporušiteľný priestor je často zámerný. Urobte to ako posledné po tom všetkom prepísaní, pretože každá úprava cez iný nástroj môže pridať svoj vlastný.

Čo nerobiť

Dve nadmerné opravy sú horšie ako pôvodný problém.

Prvým je čistenie em pomlčky. Stal sa predpokladaným znakom AI a ľudia ho teraz lovia vlastným písmom – ale pomlčka je normálne anglické interpunkčné znamienko a nahradenie každého znakom čiarkou vytvára prózu, ktorá sa číta ako forma. To, čo spôsobuje, že používanie pomlčiek vyzerá strojovo, je jednotnosť: jedna na odsek, vždy v rovnakej rétorickej pozícii. Striedajte interpunkciu, nezakazujte to.

Druhým je beh textu cez „humanizér“, ktorý zamieňa slová za synonymá. To vytvára niečo horšie ako originál: text s rovnakou plochou štruktúrou a teraz nesprávnym výberom slov, ktorý sa číta ako strojovo napísaný a neopatrný. Štruktúra je miesto, kde rozprávanie žije. Synonymá sú dekorácia.

Prihrávka v poriadku

Odstráňte akciové frázy. Označte a znížte klišé. Prečítajte si rozdelenie podľa dĺžky viet a zámerne ho prerušte – dve vety niekde zlúčte, ďalšiu rozdeľte, jeden odsek nechajte veľmi krátky. Opravte pasíva, ktoré skrývajú herca. Vystrihnite každú koncovú vetu, ktorá opakuje vetu. Potom pozametajte neviditeľné znaky a skopírujte ich.

Pätnásť minút na stránke a výsledok nie je „nezistiteľný“ – je jednoducho lepšie napísaný, čo bol skutočný cieľ. Každý z týchto nástrojov beží lokálne vo vašom prehliadači, takže nezverejnený koncept zostáva na vašom počítači, kým na ňom pracujete.

Napísal Ján Turský

Tvorca TextArray – vytváranie bezplatných nástrojov na ochranu súkromia, ktoré bežia výhradne vo vašom prehliadači.