Как текст и картинка становятся данными
Исследуй UTF-8 и нарисуй собственную картинку с ограниченной палитрой.
Сравни текст A, Я и 🙂. Затем нарисуй узор: изменится ли размер несжатой картинки, если закрасить больше клеток?
- Кодовых точек
- 7
- Байтов UTF-8
- 13
- Битов
- 104
| Знак | Unicode | Байты UTF-8 · hex |
|---|---|---|
| К | U+041A | D0 9A |
| о | U+043E | D0 BE |
| д | U+0434 | D0 B4 |
| пробел | U+0020 | 20 |
| A | U+0041 | 41 |
| пробел | U+0020 | 20 |
| 🙂 | U+1F642 | F0 9F 99 82 |
Что происходит и почему
UTF-8 использует разное число байтов для разных кодовых точек. Растр с фиксированной глубиной цвета занимает ширина × высота × бит на пиксель независимо от рисунка.
Записать своё открытие
Заметка хранится только в этой открытой странице. Скачай её перед уходом. В уроке также доступен личный черновик.
Границы модели. Считаем кодовые точки Unicode, а не видимые буквы: составной символ может содержать несколько точек. Для растра не учитываются палитра, заголовок файла и сжатие.
Исследование и самопроверка здесь не начисляют XP. Проверяемые задания и сохранение учебного прогресса — в уроках курса.
Выбрать школьный маршрут