Tłumacz kodu binarnego
Wpisz tekst, by otrzymać kod binarny, lub wklej ciąg zer i jedynek, by odczytać tekst. Każdy znak jest kodowany jako bajty UTF-8 i wyświetlany w grupach ośmiobitowych oddzielonych spacjami. Kierunek konwersji jest wykrywany automatycznie lub możesz wybrać go samodzielnie. Konwersja działa w przeglądarce.
Wynik
- Hex
- Decimal
Jak tekst zamienia się na kod binarny
Komputery przechowują tekst jako liczby. Ten tłumacz używa kodowania UTF-8, stosowanego przez większość stron internetowych: każdy znak staje się jednym do czterech bajtów, a każdy bajt jest zapisywany jako osiem cyfr binarnych. Litery łacińskie zajmują po jednym bajcie (A to 01000001, a to 01100001), litera z akcentem, taka jak é, zajmuje dwa bajty (11000011 10101001), a większość emoji — cztery bajty. Dla podstawowych liter łacińskich, cyfr i znaków interpunkcyjnych wartości bajtów są takie same jak w ASCII.
Odczytywanie kodu binarnego
Wklej bajty oddzielone spacjami, po jednej grupie na bajt. Grupa z mniej niż ośmioma cyframi jest uzupełniana zerami od lewej, więc 1000001 jest czytane jako 01000001. Bez spacji cyfry są odczytywane w grupach po osiem, a łączna liczba cyfr musi być wielokrotnością ośmiu. Jeśli bajty nie tworzą poprawnego tekstu UTF-8, czytelne fragmenty są wyświetlane normalnie, a reszta pojawia się jako znak � wraz z informacją pod wynikiem.
Hex i decimal
Pod wynikiem binarnym widoczne są te same bajty w systemie szesnastkowym (Hex) i dziesiętnym (Decimal). Przydaje się to przy programowaniu, debugowaniu lub gdy zadanie wymaga podania wartości bajtów w innym formacie.
Często zadawane pytania
Jak wygląda słowo "cześć" w kodzie binarnym?
01100011 01111010 01100101 11000101 10011011 11000100 10000111 — siedem bajtów, bo polskie litery ś i ć zajmują po dwa bajty w UTF-8.
Dlaczego każda grupa ma osiem cyfr?
Jedna cyfra to jeden bit, a osiem bitów tworzy bajt — podstawową jednostkę, w której komputery przechowują znaki. Litery łacińskie mieszczą się w jednym bajcie, inne znaki zajmują w UTF-8 od dwóch do czterech bajtów.
Dlaczego polskie litery, takie jak ł, zajmują dwa bajty?
UTF-8 koduje znaki spoza podstawowego zestawu ASCII jako sekwencje wielu bajtów. Polskie litery ą ć ę ł ń ó ś ź ż mają kody wymagające dwóch bajtów, na przykład ł to 11000101 10000010.
Czy tłumacz zamienia liczby na kod binarny?
Nie — tłumacz koduje znaki, nie wartości liczbowe. Cyfra 5 jest przechowywana jako kod znaku 00110101, a nie jako liczba pięć w systemie dwójkowym (101). Do przeliczania podstaw liczb użyj konwertera systemów liczbowych.
Dlaczego emoji zamienia się na 32 bity lub więcej?
Większość emoji zajmuje cztery bajty w UTF-8, co daje 32 bity. Niektóre emoji są zbudowane z kilku znaków, więc generują jeszcze więcej bajtów.
Czy mój tekst jest wysyłany na serwer?
Nie. Konwersja odbywa się w całości w przeglądarce, z wykorzystaniem wbudowanego kodera UTF-8. Żaden tekst nie jest przesyłany ani przechowywany.