Ugrás a tartalomhoz

Hex szemétlerakás

Változtassa a szöveget klasszikus hexdumpmá, eltolásokkal és ASCII-csatornával, vagy olvasson vissza.

Bemenet
Kimenet

Hex szemétlerakás

A hex dump az, ahogyan a fájl úgy néz ki, amikor nem bízik abban, amit egy szerkesztő mutat, és helyette a nyers bájtokat olvassa el. Ez az eszköz a szöveg UTF-8 bájtjait az ismert hexdump -C elrendezésben helyezi el: egy 8 számjegyű eltolás a bal oldalon, 16 bájt soronként kétjegyű hex párokként írva, és egy ASCII csatorna a jobb oldalon, ahol minden nyomtatható bájt önmagában jelenik meg, és minden más – tabulátorok, új sorok, a-byte-ok kódjai. Egy extra szóköz oszt fel minden sort középen, ahogy az xxd és a hexdump teszik, így a nyolcadik bájtig számolhat anélkül, hogy elveszítené a helyét.

A szemétleírás olvasása az a munka, amelyet a legjobban teljesít. Egy kósza nulla szélességű szóköz, egy nem törő szóköz, amely normálnak álcázza magát, egy Windows CRLF, ahol csupasz újsort várt, egy hangulatjel, amely csendesen négy bájt hosszú – ezek mindegyike láthatatlan a hétköznapi szövegben, és nyilvánvaló abban a pillanatban, amikor meglátja a bájtokat. Az eltolás oszlop pontosan megmondja, milyen messze van a bemenetben egy meglepő bájt, amire szüksége van, ha egy elemző elutasítja az 1. sort, anélkül, hogy látná.

Válts a módot a másik irányba: illesszen be egy kiíratást – ebből az eszközből, xxd-ből, hexdump -C-ből, vagy csak lazítsa meg a hex-et, mint a 48 65 6c 6c 6f – és kapja vissza az eredeti szöveget. Az elemző figyelmen kívül hagyja az eltolás oszlopot és az ASCII csatornát, tolerálja az xxd által használt 2 bájtos csoportosítást, és levágja a 0x vagy \\x előtagokat, így a terminálból történő másolás-beillesztés általában csak működik. A nagybetűs opció A-F-et ír a-f helyett azoknál a formátumoknál, amelyek ezt várják.

Minden helyileg fut a böngészőben a beépített UTF-8 kódoló segítségével. Semmi sem kerül feltöltésre, ami számít, hogy a vizsgált bájtok jogkivonatból, adathordozóból vagy privát fájlból származnak. A kimenet alatti számláló bájtokat és sorokat számol, így a többbájtos karakterek könnyen felismerhetők.

Gyakori kérdések

Mi az a hex szemétlerakó?
A hex dump az adatok bájtonkénti nézete: minden bájt két hex számjegyként van írva, tizenhat egy sor, eltolás a bal oldalon és egy olvasható ASCII oszlop a jobb oldalon. Ez a szabványos módszer a szöveg vagy fájl pontos tartalmának ellenőrzésére, beleértve a szerkesztő által elrejtett karaktereket is.
Mit jelentenek az ASCII oszlopban lévő pontok?
Minden bájt, amely nyomtatható ASCII karakter (0x20-tól 0x7e-ig), önmagában jelenik meg; minden második bájt – vezérlőkód, újsor vagy egy többbájtos UTF-8 karakter egy része – pontként jelenik meg, így az oszlopok egy vonalban maradnak. A bal oldali hex mindig a valós értéket mutatja.
Vissza tudja olvasni az xxd és a hexdump kimenetet szöveggé?
Igen. Váltson dekódolási módba, és illessze be az xxd, hexdump -C, ebből az eszközből vagy sima szóközzel elválasztott hex kimenetet. Az eltolás oszlopot és az ASCII csatornát figyelmen kívül hagyja, a 2 byte-os xxd csoportosítást kezeli, és a 0x vagy \x előtagokat a dekódolás előtt eltávolítja.
Miért több bájt a szövegem, mint karakter?
A szöveg UTF-8 kódolású, ahol az ASCII karakterek egy-egy bájt, az ékezetes betűk kettő, a legtöbb emoji pedig négy. A hex dump ezt láthatóvá teszi: a kimenet alatti bájtok száma általában magasabb, mint bármely nem angol szöveg karakterszáma.
Fel van töltve valahova a szövegem?
Nem. A dump teljes egészében a böngészőben épül fel, és semmi, amit beilleszt, nem kerül elküldésre vagy tárolásra, így biztonságosan ellenőrizheti a bájtokat egy tokenből, egy hasznos adatból vagy egy privát fájlból.