2.1. Кодирование данных

В ЭВМ применяется двоичная система счисления, т.е. все числа в компьютере представляются с помощью нулей и единиц, поэтому компьютер может обрабатывать только информацию, представленную в цифровой форме.

Для преобразования числовой, текстовой, графической, звуковой информации в цифровую необходимо применить кодирование.

В процессе обмена информацией часто приходится производить операции кодирования и декодирования информации. При вводе знака алфавита в компьютер путем нажатия соответствующей клавиши на клавиатуре происходит его кодирование, т.е. преобразование в компьютерный код. При выводе знака на экран монитора или принтер происходит обратный процесс – декодирование, когда из компьютерного кода знак преобразуется в графическое изображение.

Кодирование/декодирование – это операция преобразования знаков или групп знаков одной знаковой системы в знаки или группы знаков другой знаковой системы.

Например, человеческие языки – это системы кодирования понятий для выражения мыслей посредством речи. В вычислительной технике такая система называется двоичным кодированием и основана на представлении данных последовательностью всего двух знаков: 0 и 1. Эти знаки называются двоичными цифрами, по-англий-ски – binary digit, или сокращенно bit (бит).

Одним битом могут быть выражены два понятия: 0 или 1 (да или нет, черное или белое, истина или ложь и т.п.). Если количество битов увеличить до двух, то уже можно выразить четыре различных понятия:

00 01 10 11

Тремя битами можно закодировать восемь различных зна-чений:

000 001 010 01l 100 101 110 111

Для кодирования целых чисел от 0 до 255 достаточно иметь восемь разрядов двоичного кода (8 бит):

0000 0000 = 0

0000 0001 = 1

…………………

1111 1110 = 254

1111 1111 = 255

16 бит позволяют закодировать целые числа от 0 до 65 535, а 24 бита – уже более 16,5 миллионов разных значений [23].

Для кодирования действительных чисел используют 80-разрядное кодирование. При этом число предварительно преобразуется в нормализованную форму:

3,1415926 = 0,31415926  10¹

300 000 = 0,3  10⁶

123 456 789 = 0,123456789  10⁹

Первая часть числа называется мантиссой, а вторая – характеристикой. Большую часть из 80 бит отводят для хранения мантиссы (вместе со знаком), и некоторое фиксированное количество разрядов отводят для хранения характеристики (тоже со знаком).

2.2. Кодирование текстовых данных

Если каждому символу алфавита сопоставить определенное целое число (например, порядковый номер), то с помощью двоичного кода можно кодировать и текстовую информацию. Восьмидвоичных разрядов достаточно для кодирования 256 различных символов. Этого хватит, чтобы выразить различными комбинациями восьми битов все символы английского и русского алфавитов, как строчные, так и прописные, а также знаки препинания, символы основных арифметических действий и некоторые общепринятые специальные символы, например, символ «§» (параграф).

Институт стандартизации США (ANSI – American National Standard Institute) ввел в действие систему кодирования ASCII (American Standard Code for Information Interchange – стандартный код информационного обмена США). В системе ASCII закреплены две таблицы кодирования: базовая и расширенная. Базовая таблица закрепляет значения кодов от 0 до 127, а расширенная – относится к символам с номерами от 128 до 255.

Первые 32 кода базовой таблицы, начиная с нулевого, отданы производителям аппаратных средств (в первую очередь производителям компьютеров и печатающих устройств). В этой области размещаются так называемые управляющие коды, которым не соответствуют никакие символы языков, и эти коды не выводятся ни на экран, ни на устройства печати, но ими можно управлять тем, как производится вывод прочих данных.

Начиная с кода 32 по код 127 размещены коды символов английского алфавита, знаков препинания, цифр, арифметических действий и некоторых вспомогательных символов.

Первые коды с 32 по 127 являются стандартными и обязательными для всех стран и всех компьютеров, а во второй половине (128–255) каждая страна может создавать свой стандарт – национальный. Отсутствие единого стандарта в этой области привело к множественности одновременно действующих кодировок. Только в России можно указать три действующих стандарта кодировки и еще два устаревших. Например, кодировка символов русского языка, известная как кодировка Windows-1251, используется на большинстве локальных компьютеров, работающих на платформе Windows.

Другая распространенная кодировка носит название КОИ-8 (код обмена информацией, восьмизначный). На базе этой кодировки ныне действуют кодировки КОИ8-Р (русская) и КОИ8-У (украинская). Имеет широкое распространение в компьютерных сетях на территории России [14].

Международный стандарт, в котором предусмотрена кодировка символов русского алфавита, носит название кодировки ISO (International Standard Organization – Международный институт стандартизации).

На компьютерах, работающих в операционных системах MS-DOS, могут действовать еще две кодировки (кодировка ГОСТ и кодировка ГОСТ-альтернативная).

Система, основанная на 16-разрядном кодировании символов, получила название универсальной – UNICODE. Шестнадцать разрядов позволяют обеспечить уникальные коды для 65 536 различных символов – этого поля достаточно для размещения в одной таблице символов большинства языков планеты.

<<< < Предыдущая 1 2 3 4 56 / 376 7 8 9 10 11 12 13 14 15 16 17 18 19 20 21 22 23 24 25 > Следующая >>>

Соседние файлы в предмете [НЕСОРТИРОВАННОЕ]

#
18.05.201515.5 Mб28Drenazh_i_ochistka_stochnykh_vod_2009.pdf
#
18.05.201551.64 Кб19Dudan.docx
#
01.07.2025723.85 Кб1duinou_-_OP_i_UP.docx
#
01.04.2025198.66 Кб1d_z_06.doc
#
01.07.20254.37 Mб1EES-SXEM-LAB_RAB_17.doc
#
01.03.20252.46 Mб2EiTI_lektsii.doc
#
01.03.20252.94 Mб4EiTI_testy.doc
#
01.07.2025448.13 Кб0ekh_ekh.docx
#
01.04.2025948.22 Кб2ekonomika.doc
#
01.07.2025126.26 Кб2ekonomika_3.docx
#
04.08.2019890.88 Кб10Ekonomika_bud_ona_proklyata2.doc