Цифрові системи не розуміють “мови” фізичного світу. Вони розпізнають лише одиниці та нулі. Щоб подолати цей розрив, інженери використовують процес, який називають квантуванням. Це етап, який перетворює безперервний, плавний аналоговий сигнал дискретний набір цифрових значень. Він відбувається відразу після дискретизації (семплювання). Мета проста: уявити вимір реального світу найближчим можливим цифровим числом.

Уявіть мікрофон, що записує звук. Хвилі тиску повітря гладкі та нескінченні. Вони змінюються безперервно. Комп’ютер не може зберегти нескінченність. Йому потрібен кінцевий перелік варіантів. Квантування вирішує цю проблему, розділяючи діапазон можливих значень сигналу на рівні кроки. Кожен крок є «рівнем квантування». Коли значення сигналу попадає між двома кроками, система прив’язує його до найближчого. Це створює невелику помилку. Інженери називають її шумом квантування. Це неминучий побічний ефект оцифрування реальності, але можна керувати.

Механіка дискретизації

Суть квантування криється у роздільній здатності. Роздільна здатність визначається кількістю біт, що використовуються для кодування кожного відліку. Більше біт означає більше рівнів. Більше рівнів означає дрібнішу деталізацію.

Уявіть лінійку. Стандартна лінійка має поділки кожні міліметр. Точний мікрометр має поділи кожні соті частки міліметра. Якщо ви вимірюєте об’єкт, який потрапляє між поділами міліметра, ви округляєте його до найближчого. Ця помилка округлення аналогічна шуму квантування. У цифровому аудіо ця помилка проявляється у вигляді ледь помітного шипіння чи спотворень. На зображеннях вона викликає видиму ступінчастість (бандинг) на градієнтах.

Процес спирається на аналого-цифрові перетворювачі (АЦП). Ці чіпи всюди. Вони є у вашому смартфоні, автомобілі, медичних пристроях. Вони беруть напругу, що змінюється, від датчика і розбивають його на двійкові слова. Довжина цього слова визначає точність. 16-бітове слово забезпечує 65536 різних рівнів. 24-бітове слово забезпечує понад 16 мільйонів. Різниця очевидна.

Чому дозвіл важливий у сучасних технологіях

Ми часто думаємо про оцифрування як про простий перемикач. Увімк. або вимк. Високий чи низький рівень. Насправді все набагато складніше. Якість кінцевого результату залежить від того, наскільки тонко ми розрізаємо вихідний сигнал. Цей компроміс є центральним для інженерії. Ви хочете високу точність. Ви також хочете низьких витрат на зберігання та високої швидкості обробки. Не можна завжди мати і те, й інше.

В аудіо індустрії стандарт компакт-дисків зупинився на 16-бітному квантуванні. Воно забезпечує достатній динамічний діапазон більшості слухачів. Професійні студійні записи часто використовують 24 біти. Це дозволяє захоплювати тихі деталі без підвищення шуму. Якщо використовувати занадто мало біт, звук стає каламутним чи спотвореним. Вухо вловлює шум квантування. Воно чує цифрові артефакти.

Візуальні медіа стикаються з аналогічними обмеженнями. Глибина кольору є прямим результатом квантування. 8-бітовий канал кольору дозволяє одержати 256 відтінків червоного. Якщо поєднати три канали (червоний, зелений, синій), вийде приблизно 16,7 мільйона кольорів. Це стандарт для більшості екранів. Якщо знизити глибину до 6 біт на канал, вийде всього 262 144 кольори. Результатом буде постеризація. Плавні небеса на фотографії заходу сонця перетворюються на видимі смуги. Перехід між відтінками стає різким. Це не просто теоретична проблема. Це видимий дефект відео потоків низької якості.

За межами медіа: наука та датчики

Квантування стосується не лише того, щоб музика звучала добре, а картинки виглядали гарно. Воно фундаментально важливе для наукових вимірів. У медичній візуалізації, як-от МРТ або КТ, точність квантування впливає на постановку діагнозу. Дрібніша сітка виявляє менші аномалії. Грубіша сітка може пропустити ранні ознаки захворювання. Сигнал повинен бути захоплений достатньою кількістю бітів, щоб чітко розрізняти типи тканин.

Моніторинг довкілля спирається ті ж принципи. Сейсмографи записують рух ґрунту. Метеостанції вимірюють тиск та температуру. Ці датчики видають аналогові напруги. АЦП перетворює в цифрові дані для аналізу. Якщо квантування занадто грубе, невеликі зміни у навколишньому середовищі можуть бути втрачені. Дані стають марними для прогнозування тонких зрушень у кліматичних патернах.

Космічна телеметрія стикається з екстремальними обмеженнями. Пропускна спроможність обмежена. Зберігання даних потребує багато ресурсів. Інженери повинні ретельно вибирати глибину бітності. Їм потрібна достатня точність для відстеження траєкторій космічних апаратів, але вони не можуть дозволити собі передавати нескінченні дані високої роздільної здатності. Процес квантування балансує ці суперечливі вимоги. Він гарантує, що критично важлива інформація виживає по дорозі з космосу на Землю.

Компроміс між точністю та ефективністю

Кожна система, пов’язана з обробкою сигналів, має відповісти на одне запитання: скільки достатньо даних? Квантування високої роздільної здатності зберігає деталі. Воно мінімізує шум. Але це збільшує розмір файлів. Воно уповільнює процесори. Воно витрачає заряд батареї.

У вбудованих системах, таких як пристрої Інтернету речей (IoT) або чіпи штучного інтелекту, енергія обмежена. Обчислення з великою глибиною біт споживають більше енергії. Інженери часто використовують меншу глибину біт завдань виведення (інференсу). Вони жертвують певною точністю задля економії енергії. Алгоритм все ще працює. Результат є прийнятним. Компроміс прорахований і має намір.

Цей баланс стимулює інновації в алгоритмах стиснення. Такі техніки, як адаптивне квантування, регулюють глибину біт залежно від змісту. Складні сцени одержують більше біт. Прості фони одержують менше. Мета полягає в тому, щоб зберегти якість, що сприймається, зменшуючи обсяг даних.

У міру переходу до аудіо високої точності та відео 8K попит на точність зростає. Але сховище та пропускна спроможність не розширюються нескінченно. Завдання залишається незмінним. Точно захоплювати світ. Ефективно зберігати його. Швидко обробляти. Квантування є інструментом, який робить це можливим. Воно недосконале. Воно вносить шум. Але без нього цифрового світу не було б. Сигнал залишався б замкненим у аналоговій сфері, недоступний для машин, які живлять наше сучасне життя.

Більшість людей сприймають квантування як просту помилку заокруглення. Насправді, це не так. Це стратегічний компроміс між точністю відтворення та розміром файлу. Вибраний вами метод визначає, чи сигнал звучатиме чисто або з хрипотою, а зображення виглядатиме різким або блоковим.

Найбільш стандартним підходом є рівномірне квантування. Ви берете весь діапазон можливих значень та розбиваєте його на інтервали однакового розміру. Це легко реалізувати у коді. Помилка розподіляється поступово. Метод добре працює для сигналів із постійною динамікою. Якщо ваші дані не змінюються дуже різко, це ваш основний вибір.

Але реальні сигнали рідко поводяться поступово.

Мова? У ній є піки та спади. Фізіологічні дані? Те саме. Розподіл не є рівномірним. Коли дисперсія висока, рівномірне квантування витрачає біти на тихі ділянки та «голодує» на гучних. Тут на допомогу приходить нелінійне квантування, часто зване логарифмічним. Воно зменшує крок квантування для сигналів низької інтенсивності, що часто зустрічаються, і збільшує його для рідкісних сигналів високої інтенсивності. Ви отримуєте вищу точність саме там, де людське вухо чи око найчутливіші.

Відсікання проти округлення проти адаптації

Як ви робите з бітами, які відкидаєте?

Відсікання завжди округляє вниз. Це швидко. Воно вносить усунення. Середня помилка не дорівнює нулю.

Округлення вибирає найближчий рівень. Воно точніше у середньому. Воно усуває це усунення.

Потім є “адаптивне квантування”. Система відстежує сигнал. Якщо амплітуда різко збільшується, вона розширює інтервали. Якщо сигнал тихий, вона звужує їх. Це динамічне налаштування оптимізує як якість, так і коефіцієнти стиснення в реальному часі.

Зв’язок зі стисненням

Квантування немає у вакуумі. Це основний механізм, що стоїть за стиском даних. Не можна стискати, не відмовляючись від інформації. Тут виникає помилка квантування.

Розглянемо векторне квантування. Замість квантувати кожен зразок окремо, воно розглядає групи зразків. Воно знаходить кореляцію. Воно зіставляє ці групи зі словником кодових книг. Саме так працюють стандарти MP3, JPEG та MPEG. Вони використовують надмірність. Вони відкидають те, що ви не помітите, щоб заощадити пропускну здатність.

Шум, який не можна ігнорувати

Ось сувора правда: квантування втрачає інформацію. Різниця між вихідним аналоговим значенням та цифровою апроксимацією – це шум квантування.

Якщо у вас достатньо бітів, цей шум дуже малий. Він тоне у власному шумі аналогового джерела. Але коли ви прагнете меншого розміру файлів? Шум стає проблемою. Він проявляється у вигляді візуальних артефактів у відео чи чутних спотворень в аудіо.

То як же приховати його?

На сцену виходить додавання шуму (dithering).

Перед тим, як квантувати, додайте крихітну кількість випадкового шуму. Звучить контрінтуїтивно. Навіщо додавати шум, щоб очистити сигнал?

Він руйнує періодичні помилки. Без додавання шуму сигнали низької амплітуди створюють гармонійні спотворення. Ви чуєте гомін. Ви бачите смуги на градієнтах. Додавання шуму рандомізує помилку. Воно перетворює структуровані спотворення на білий шум. Людський мозок чудово маскує білий шум. Він дуже погано ігнорує ритмічне гудіння.

Біологічна межа

Існує стеля.

Ви можете продовжувати збільшувати глибину біта. Ви можете купувати найкращі АЦП. Але в якийсь момент додаткові біти не покращують користувальницький досвід. Людське вухо чи око просто не може сприйняти різницю. Тим часом витрати на зберігання, обчислювальні потужності та пропускна спроможність передачі продовжують зростати.

Оптимальна точка – це не максимальна точність. Це максимальна точність, що сприймається, при мінімальній вартості.

Інженерам доводиться балансувати між технічними можливостями та біологічними межами. Якщо тиск дуже сильно, ви витратите ресурси марно. Якщо тиснути надто слабо, якість впаде нижче за поріг прийнятності.

Куди все рухається

Ця область не статична. Аналогова електроніка повертається до нішевих додатків високого класу. Дослідники переосмислюють те, як ми перетворюємо та обробляємо сигнали. Якщо ви хочете глибше вивчити апаратну сторону цього ланцюжка сигналів, CNRS у недавніх дослідженнях описала повернення до аналогових джерел. Це нагадування про те, що навіть у цифровому світі фізика вихідного сигналу, як і раніше, диктує правила.

Майбутнє це не просто більше бітів. Це розумні біти.