Перевод текста в коды ASCII
Преобразуй буквы, цифры и знаки в числовые коды ASCII.
В 1963 году комитет по стандартам закрепил конкретное правило: какое именно число должно обозначать латинскую букву A на любой машине. Этим числом стало 65. Созданный тогда стандарт ASCII до сих пор служит базой для хранения текстовых файлов и обработки нажатий на клавиатуре.
Семибитный стандарт для телетайпов в конвертере ASCII
Таблица ASCII присваивает буквам, цифрам, знакам пунктуации и служебным сигналам значения от 0 до 127. Этот диапазон ровно укладывается в 7 бит, что дает 128 позиций. Такого объема хватило для английского алфавита обоих регистров, десяти цифр, базовой пунктуации и служебных инструкций телетайпных аппаратов.
Управляющие сигналы используются повсеместно: код 10 отвечает за перевод строки, код 13 возвращает каретку, а код 9 задает символ табуляции. Каждый раз, когда текст переносится на новую строку, задействуются значения, утвержденные в стандарте 1963 года.
Смещение регистров на 32 в кодах ASCII
Заглавная A обозначается кодом 65, а строчная a имеет код 97. Разница между ними составляет ровно 32. Это не случайность, а степень двойки (2 в пятой степени), то есть смещение ровно на один бит в двоичном представлении. Каждая пара устроена одинаково: B — 66 и b — 98, Z — 90 и z — 122.
Благодаря такой структуре смена регистра в коде сводится к переключению одного бита, без необходимости искать значение по таблицам подстановки.
Ключевые символы таблицы в конвертере текста в ASCII
| Символ | Десятичный код | 8-битный двоичный вид |
|---|---|---|
| space | 32 | 00100000 |
| 0 | 48 | 00110000 |
| 9 | 57 | 00111001 |
| A | 65 | 01000001 |
| Z | 90 | 01011010 |
| a | 97 | 01100001 |
| z | 122 | 01111010 |
Ограничения набора символов при конвертации в ASCII
- Нельзя закодировать буквы с диакритикой, такие как é, ñ или ü, поскольку в исходных 128 кодах под них нет места.
- Не поддерживаются нелатинские алфавиты, включая кириллицу, арабскую вязь, японские или китайские иероглифы.
- Невозможно закодировать эмодзи, для которых требуются тысячи отдельных позиций.
- Символы за пределами первых 128 позиций не совпадают с UTF-8, хотя начальный диапазон у них идентичен.
Вопросы о работе конвертера текста в ASCII
Чем отличаются стандарты ASCII и UTF-8?
Первые 128 позиций в UTF-8 точно повторяют ASCII, поэтому обычный английский текст одинаково читается в обеих кодировках. Все остальные знаки мировой письменности UTF-8 передает последовательностями из нескольких байт за пределами диапазона 127, чего классический ASCII делать не умеет.
Почему в таблице ASCII ровно 128 значений?
Стандарт строился на семибитной архитектуре аппаратуры начала 1960 годов. Сети связи передавали данные побитово, и пропускной способности хватало лишь на 7 бит данных плюс один проверочный бит четности.
Что выдаст конвертер при попытке перевести эмодзи или кириллицу?
Для таких символов нет подходящего кода в таблице. Конвертер либо вернет ошибку, либо подставит символ-заполнитель, либо пропустит неизвестный знак при формировании результата.
Входят ли невидимые символы табуляции и перевода строки в ASCII?
Да, первые 32 позиции и код 127 зарезервированы под непечатные управляющие сигналы, регулирующие перенос строк, табуляцию и оповещения оборудования.
Как получить коды символов в этом инструменте?
Введи нужную строку в поле ввода и нажми кнопку запуска, чтобы отправить данные на сервер и получить готовую последовательность кодов.