Екілік ↔ мәтін түрлендіргіш

Браузерде мәтінді екілікке және кері түрлендіріңіз, UTF-8 немесе ASCII қолдайды.

Таңбалар: 5 UTF-8 байттар: 9 Нәтиже ұзындығы: 80
Жылдам анықтама: 8-биттік екіліктегі ASCII таңбалары
Таңба Ондық Екілік (8 бит)
A6501000001
Z9001011010
a9701100001
z12201111010
04800110000
95700111001
(бос орын)3200100000
!3300100001
?6300111111
(жаңа жол)1000001010

Жиі қойылатын сұрақтар

Мәтінді екілікке түрлендіру қалай жұмыс істейді?
Мәтіндегі әрбір таңбаның сандық коды бар (оның код нүктесі). ASCII таңбалары үшін код 7 битке сыяды және басына нөл қосылып 8 битке толықтырылады. A таңбасының коды — 65, ол екілікте 01000001. Түрлендіргіш әр таңбаны оқиды, оның кодын анықтайды және байттан байтқа екілік көрінісін жазып шығады.
ASCII пен UTF-8 арасындағы айырмашылық қандай?
ASCII 128 таңбаны қамтиды (ағылшын әріптері, цифрлар, тыныс белгілері) және әр таңбаға бір 7-битті байт жұмсайды. UTF-8 — әр таңбаға 1-ден 4 байтқа дейін қолданатын ауыспалы ұзындықты кодтау, ол әлемдегі барлық таңбаларды (латын, кириллица, қытай, араб, эмодзи) ұстайды. Маңыздысы: қазақ әріптері (ә, ғ, қ, ң, ө, ұ, ү, һ, і) кириллицаға жатады, сондықтан UTF-8-те 2 байтты алады және ASCII режимінде жұмыс істемейді. UTF-8 режимін таңдаңыз.
Менің екілік деректерім неге декодталмайды?
Жиі кездесетін себептер: (1) бит топтары 8 (немесе 7) биттен тұрмайды — артық бос орындар жоқ па, тексеріңіз; (2) 0 және 1-ден басқа таңбалар бар; (3) екілік толық емес UTF-8 тізбегін білдіреді (мысалы, қазақ әрпінің бірінші байты ғана). Декодер бірінші қатенің орнын көрсетеді — содан түзете аласыз. Бөлгіш жоқ болса, «Биттерді топтастыру» — 8, «Бөлгіш» — Жоқ деп қойыңыз.
Бір таңбаға қанша бит қолдану керек?
Стандартты конвенция — 1 байтқа 8 бит. Таза ASCII 7 битке сыяды, бірақ сақталған деректер мен желілік протоколдар әрқашан 8-ге толықтырады. 7-биттік режимді ескі телетайп протоколдарымен немесе оқу тапсырмаларымен жұмыс істегенде ғана қолданыңыз. ASCII-ге кірмейтін таңбаларға (қазақ әріптері ә, ғ, қ, ң, ө, ұ, ү, һ, і, кириллица, қытай таңбалары, эмодзи) көп байтты UTF-8 қажет, оларға 7-биттік топтастыру қолданылмайды.
Қазақ мәтінін немесе эмодзи түрлендіре аламын ба?
Иә — кодтауды UTF-8 күйінде сақтаңыз. Қазақ кириллицасының арнайы әріптері 2 байтты алады: мысалы, ә = 11010011 10011001, қ = 11010010 10011011, ң = 11010010 10100011. Жалпы кириллица да 2 байт. Қытай-жапон-корей таңбалары — 3 байт. Эмодзи әдетте 4 байтты қажет етеді. ASCII режимі 0–127 ауқымынан тыс кез келген таңбаны қатемен қабылдамайды, сондықтан қазақ әріптері үшін UTF-8 ғана жарайды.
Екілік пен машина коды бір ме?
Жоқ. Екілік — бар болғаны 0 мен 1 цифрларын қолданатын санау жүйесі (2-ші негіз). Машина коды — нақты процессорға арналған CPU нұсқауларының екілік көрінісі, бұл — белгілі бір кодтау. Мұнда көрініп тұрған екілік — байттар түрінде кодталған мәтін, орындалатын нұсқаулар емес. Екеуінде де 0 мен 1 қолданылатындықтан, «екілік» сөзі күнделікті тілде «компьютерлік» дегенді білдіреді — мысалы, ҰБТ информатика курсында бұл айырмашылық жиі сұралады.
Екіліктен мәтінге қалай қайтару керек?
«Екілік → Мәтін» қойындысына өтіп, екілік деректерді қойыңыз. Декодер кірісті бөлгіш бойынша (әдепкі — бос орын) байттарға бөледі, әр топты 2-лік негізден ондық код нүктесіне айналдырады және нәтижені жинақтайды. UTF-8 үшін ол көп байтты тізбектерді бір таңбаға дұрыс біріктіреді, сондықтан қазақ әріптері (мысалы, ҚазҰУ немесе Назарбаев Университеті курстарындағы тапсырмаларда кездесетіндей) дұрыс қалпына келеді.
Барлық түрлендіру браузеріңізде орындалады. Ешнәрсе жүктелмейді.

Мәтінді 0 және 1 цифрлары арқылы кодтайтын құрал. Кодтау UTF-8 немесе ASCII, биттер 8 немесе 7-ге топтасады, бөлгіш — бос орын, сызықша, тік сызық немесе жоқ. Қазақ әріптерін (ә, ғ, қ, ң, ө, ұ, ү, һ, і) толық қолдайды: олардың әрқайсысы UTF-8-те 2 байтты алады, ал эмодзи — 4 байтты. Мысалы, «Сәлем» сөзі он байт болады. Кері түрлендіру де бар: екілік деректерді мәтінге айналдырып, бір байтты және көп байтты UTF-8 тізбектерін дұрыс жинайды. ҚазҰУ мен Назарбаев Университетінің информатика курстары мен ҰБТ дайындығы үшін пайдалы — нақты қатені позициясымен көрсетеді.