Konwerter tekst ↔ hex / binarny
Zamień tekst na bajty hex, binarne lub dziesiętne i zdekoduj zrzuty bajtów
O tym narzędziu
Zobacz dokładnie, z jakich bajtów zbudowany jest Twój tekst: to narzędzie koduje tekst do UTF-8 i pokazuje go jako wartości szesnastkowe, dwójkowe albo dziesiętne — z wybranym separatorem, wielkością liter i przedrostkami 0x. Dekoder działa w drugą stronę i jest celowo wyrozumiały: przyjmuje ciągłe ciągi (48656c6c6f), pary rozdzielone spacjami, notację z dwukropkami w stylu adresów MAC oraz sekwencje ucieczki \x.
Ponieważ kodowanie odbywa się na poziomie bajtów UTF-8, znaki wielobajtowe widać takimi, jakie naprawdę są w pamięci i na łączu: é to c3 a9, 世 to e4 b8 96, a emoji zajmuje cztery bajty. To najszybszy sposób na diagnozowanie niezgodności kodowań, zagadek z BOM-em i problemów typu „czemu ten napis jest dłuższy, niż wygląda”.
Jeśli zdekodowane bajty nie są poprawnym UTF-8, narzędzie mówi to wprost zamiast wypisywać krzaki — to mocna wskazówka, że patrzysz na dane binarne, a nie na tekst.
Często zadawane pytania
- Dlaczego jeden znak zamienia się w kilka bajtów?
- UTF-8 ma zmienną szerokość: ASCII zostaje jednobajtowe, większość liter europejskich zajmuje dwa bajty, znaki CJK trzy, a emoji cztery. To, co tu widzisz, to dokładna sekwencja bajtów, jaką dowolny system oparty na UTF-8 — pliki, HTTP, bazy danych — zapisuje dla Twojego tekstu.
- Jakie formaty wejścia przyjmuje dekoder?
- Szesnastkowe jako ciągły ciąg, pary rozdzielone spacjami, z przedrostkami 0x lub \x, albo rozdzielone dwukropkiem czy przecinkiem; dwójkowe jako grupy ośmiobitowe ze spacjami lub bez; dziesiętne jako rozdzielone wartości bajtów. Mieszane separatory i zabłąkane białe znaki są usuwane automatycznie.
- Dlaczego dekodowanie mówi, że bajty nie są poprawnym UTF-8?
- Sekwencja bajtów łamie reguły UTF-8 — na przykład samotne ff albo bajt kontynuacji bez bajtu prowadzącego. Dane mogą być binarne, w starszym kodowaniu w rodzaju Latin-1 albo ucięte w środku znaku.
- Czy to to samo, co zrzut szesnastkowy z xxd?
- Wartości bajtów są identyczne; xxd dokłada offsety i kolumnę ASCII. Wklej tutaj same kolumny szesnastkowe ze zrzutu xxd (bez kolumny offsetu), a zdekodują się bez problemu.