Systemy cyfrowe nie rozumieją „języka” świata fizycznego. Rozpoznają tylko jedynki i zera. Aby wypełnić tę lukę, inżynierowie stosują proces zwany kwantyzacją. Jest to etap, który przekształca ciągły, gładki sygnał analogowy w dyskretny zestaw wartości cyfrowych. Zachodzi to natychmiast po dyskretyzacji (próbkowaniu). Cel jest prosty: przedstawić pomiar w świecie rzeczywistym za pomocą najbliższej możliwej liczby cyfrowej.

Wyobraź sobie mikrofon nagrywający dźwięk. Fale ciśnienia powietrza są gładkie i nieskończone. Zmieniają się w sposób ciągły. Komputer nie może przechowywać nieskończoności. Chce mieć skończoną listę opcji. Kwantyzacja rozwiązuje ten problem, dzieląc zakres możliwych wartości sygnału na równe kroki. Każdy krok to „poziom kwantyzacji”. Gdy wartość sygnału mieści się pomiędzy dwoma stopniami, system przypisuje ją do najbliższego. Powoduje to mały błąd. Inżynierowie nazywają to szumem kwantyzacji. To nieunikniony efekt uboczny cyfryzacji rzeczywistości, ale można temu zaradzić.

Mechanika próbkowania

Istota kwantyzacji leży w rozdzielczości. Rozdzielczość zależy od liczby bitów użytych do zakodowania każdej próbki. Więcej bitów oznacza więcej poziomów. Więcej poziomów oznacza więcej szczegółów.

Wyobraź sobie władcę. Standardowa linijka ma podziałki co milimetr. Precyzyjny mikrometr ma podziałkę co setną milimetra. Jeśli mierzysz obiekt mieszczący się w granicach milimetrowych, zaokrąglasz go do najbliższej. Ten błąd zaokrąglenia jest podobny do szumu kwantyzacji. W dźwięku cyfrowym błąd ten objawia się subtelnym sykiem lub zniekształceniem. Na obrazach powoduje widoczne aliasing (pasy) w gradientach.

Proces opiera się na przetwornikach analogowo-cyfrowych (ADC). Te chipsy są wszędzie. Są w Twoim smartfonie, samochodzie, urządzeniach medycznych. Pobierają zmienne napięcie z czujnika i rozkładają je na słowa binarne. Długość tego słowa określa dokładność. 16-bitowe słowo zapewnia 65 536 różnych poziomów. 24-bitowe słowo zapewnia ponad 16 milionów. Różnica jest oczywista.

Dlaczego rozdzielczość jest ważna w nowoczesnej technologii

Często myślimy o cyfryzacji jako o prostym przełączniku. Włączone lub wyłączone Poziom wysoki lub niski. W rzeczywistości wszystko jest znacznie bardziej skomplikowane. Jakość wyniku końcowego zależy całkowicie od tego, jak drobno wycinamy oryginalny sygnał. Ten kompromis ma kluczowe znaczenie dla inżynierii. Chcesz dużej precyzji. Zależy Ci także na niskich kosztach przechowywania i dużych prędkościach przetwarzania. Nie zawsze można mieć jedno i drugie.

W branży audio standard CD opiera się na 16-bitowej kwantyzacji. Zapewnia wystarczający zakres dynamiki dla większości słuchaczy. Profesjonalne nagrania studyjne często wykorzystują 24 bity. Pozwala to uchwycić ciche szczegóły bez zwiększania poziomu hałasu. Jeśli użyjesz zbyt małej liczby bitów, dźwięk stanie się mętny lub zniekształcony. Ucho wychwytuje szum kwantyzacji. Słyszy cyfrowe artefakty.

Media wizualne borykają się z podobnymi ograniczeniami. Głębia kolorów jest bezpośrednim wynikiem kwantyzacji. 8-bitowy kanał kolorów pozwala uzyskać 256 odcieni czerwieni. Jeśli połączysz trzy kanały (czerwony, zielony, niebieski), otrzymasz około 16,7 miliona kolorów. Jest to standard w przypadku większości ekranów. Jeśli zmniejszysz głębię do 6 bitów na kanał, otrzymasz w sumie 262 144 kolorów. Rezultatem będzie posteryzacja. Płynące niebo na zdjęciu zachodu słońca zamienia się w widoczne smugi. Przejście między odcieniami staje się ostre. To nie jest tylko problem teoretyczny. Jest to widoczna wada w przypadku strumieni wideo o niskiej jakości.

Poza mediami: nauka i czujniki

Kwantyzacja nie polega tylko na tym, aby muzyka brzmiała dobrze, a obrazy wyglądały pięknie. Ma to fundamentalne znaczenie dla pomiarów naukowych. W obrazowaniu medycznym, takim jak MRI lub CT, dokładność kwantyzacji wpływa na diagnozę. Drobniejsza siatka ujawnia mniejsze anomalie. Grubsza siatka może nie uwzględniać wczesnych objawów choroby. Sygnał musi być przechwycony w wystarczającej liczbie bitów, aby wyraźnie rozróżnić typy tkanek.

Monitoring środowiska opiera się na tych samych zasadach. Sejsmografy rejestrują ruch gruntu. Stacje pogodowe mierzą ciśnienie i temperaturę. Czujniki te wytwarzają napięcia analogowe. ADC przekształca je w dane cyfrowe do analizy. Jeśli kwantyzacja jest zbyt zgrubna, niewielkie zmiany w środowisku mogą zostać utracone. Dane stają się bezużyteczne do przewidywania subtelnych zmian we wzorcach klimatycznych.

Telemetria kosmiczna napotyka ekstremalne ograniczenia. Przepustowość jest ograniczona. Przechowywanie danych wymaga dużych zasobów. Inżynierowie muszą ostrożnie wybierać głębię bitową. Potrzebują wystarczającej precyzji, aby śledzić trajektorie statków kosmicznych, ale nie stać ich na przesyłanie niekończących się danych o wysokiej rozdzielczości. Proces kwantyzacji równoważy te sprzeczne wymagania. Zapewnia, że ​​krytyczne informacje przetrwają podróż z kosmosu na Ziemię.

Kompromis między dokładnością a wydajnością

Każdy system przetwarzania sygnału musi odpowiedzieć na jedno pytanie: ile danych wystarczy? Kwantyzacja o wysokiej rozdzielczości pozwala zachować szczegóły. Minimalizuje hałas. Ale zwiększa rozmiar pliku. Spowalnia procesory. Zużywa energię baterii.

W systemach wbudowanych, takich jak urządzenia Internetu rzeczy (IoT) lub chipy sztucznej inteligencji, energia jest ograniczona. Obliczenia z dużą głębią bitową zużywają więcej energii. Inżynierowie często używają mniejszych głębi bitowych do zadań wnioskowania. Poświęcają pewną dokładność, aby oszczędzać energię. Algorytm nadal działa. Wynik jest do zaakceptowania. Kompromis jest wykalkulowany i zamierzony.

To balansowanie napędza innowacje w algorytmach kompresji. Techniki takie jak kwantyzacja adaptacyjna dostosowują głębię bitową w zależności od treści. Skomplikowane sceny otrzymują więcej bitów. Proste tła zyskują mniej. Celem jest utrzymanie postrzeganej jakości przy jednoczesnym zmniejszeniu ilości danych.

W miarę zbliżania się do dźwięku wysokiej jakości i wideo 8K rośnie zapotrzebowanie na precyzję. Jednak pamięć i przepustowość nie rosną w nieskończoność. Zadanie pozostaje takie samo. Z pewnością przejmę władzę nad światem. Przechowuj go efektywnie. Szybki w obróbce. Kwantyzacja jest narzędziem, które to umożliwia. To niedoskonałe. Wprowadza hałas. Ale bez tego cyfrowy świat by nie istniał. Sygnał pozostałby zamknięty w sferze analogowej, niedostępnej dla maszyn napędzających nasze współczesne życie.

Większość ludzi myśli o kwantyzacji jako o prostym błędzie zaokrąglenia. W rzeczywistości nie jest to prawdą. Jest to strategiczny kompromis pomiędzy wiernością a rozmiarem pliku. Wybrana metoda określa, czy sygnał będzie wyraźny, czy ochrypły i czy obraz będzie ostry, czy blokowy.

Najbardziej standardowym podejściem jest jednolita kwantyzacja. Bierzesz cały zakres możliwych wartości i dzielisz go na przedziały o jednakowej wielkości. Można to łatwo zaimplementować w kodzie. Błąd rozkłada się równomiernie. Metoda sprawdza się dobrze w przypadku sygnałów o stałej dynamice. Jeśli Twoje dane nie zmieniają się zbyt radykalnie, jest to Twój podstawowy wybór.

Ale prawdziwe sygnały rzadko zachowują się jednolicie.

Przemówienie? Ma szczyty i doliny. Dane fizjologiczne? Ten sam. Rozkład nie jest równomierny. Gdy dyspersja jest wysoka, jednolita kwantyzacja marnuje bity w cichych obszarach i głodzi w głośnych obszarach. Tutaj na ratunek przychodzi kwantyzacja nieliniowa, często nazywana logarytmiczną. Zmniejsza krok kwantyzacji dla częstych sygnałów o niskiej intensywności i zwiększa go dla rzadkich sygnałów o dużej intensywności. Większą dokładność uzyskujesz dokładnie tam, gdzie ludzkie ucho lub oko jest najbardziej wrażliwe.

Przycinanie a zaokrąglanie kontra adaptacja

Co robisz z odrzuconymi kawałkami?

Wytnij zawsze zaokrągla w dół. To jest szybkie. Wprowadza stronniczość. Średni błąd nie jest zerowy.

Runda wybiera najbliższy poziom. Średnio jest dokładniejszy. Eliminuje tę stronniczość.

Następnie jest kwantyzacja adaptacyjna. System monitoruje sygnał. Jeśli amplituda gwałtownie wzrasta, wydłuża się odstępy. Jeśli sygnał jest cichy, zawęża je. To dynamiczne ustawienie optymalizuje zarówno jakość, jak i współczynniki kompresji w czasie rzeczywistym.

Komunikacja z kompresją

Kwantyzacja nie istnieje w próżni. Jest to główny mechanizm kompresji danych. Nie można kompresować bez rezygnacji z informacji. W tym miejscu pojawia się błąd kwantyzacji.

Rozważmy kwantyzację wektorową. Zamiast kwantyzować każdą próbkę indywidualnie, uwzględnia grupy próbek. Znajduje korelacje. Dopasowuje te grupy za pomocą słownika książek kodowych. Tak działają standardy MP3, JPEG i MPEG. Stosują redundancję. Odrzucają to, czego nie zauważasz, aby zaoszczędzić przepustowość.

Hałas, którego nie można zignorować

Oto trudna prawda: kwantyzacja powoduje utratę informacji. Różnica między oryginalną wartością analogową a przybliżeniem cyfrowym to szum kwantyzacji.

Jeśli masz wystarczającą liczbę bitów, hałas ten jest znikomy. Tonie w szumie źródła analogowego. Ale kiedy dążysz do mniejszych rozmiarów plików? Hałas staje się problemem. Objawia się jako artefakty wizualne w obrazie wideo lub słyszalne zniekształcenia w dźwięku.

Jak więc to ukryć?

dodawanie szumu (dithering) wchodzi w grę.

Przed kwantyzacją dodaj niewielką ilość losowego szumu. Brzmi sprzecznie z intuicją. Po co dodawać szum, aby oczyścić sygnał?

Łamie sporadyczne błędy. Bez dodatkowego szumu sygnały o niskiej amplitudzie powodują zniekształcenia harmoniczne. Słyszysz szum. Na gradientach widać paski. Dodanie szumu powoduje losowość błędu. Zamienia zniekształcenia strukturalne w biały szum. Ludzki mózg doskonale maskuje biały szum. Jest okropny w ignorowaniu rytmicznego buczenia.

Limit biologiczny

Jest sufit.

Możesz stale zwiększać głębię bitową. Możesz kupić najlepsze ADC. Jednak w pewnym momencie dodatkowe bity nie poprawiają komfortu użytkownika. Ludzkie ucho i oko po prostu nie jest w stanie dostrzec różnicy. Tymczasem koszty przechowywania, przetwarzania i transmisji stale rosną.

Najsłabszym punktem nie jest maksymalna dokładność. Jest to maksymalna postrzegana dokładność przy minimalnych kosztach.

Inżynierowie muszą zrównoważyć możliwości techniczne z ograniczeniami biologicznymi. Jeśli będziesz naciskać zbyt mocno, zmarnujesz zasoby. Jeśli naciśniesz zbyt lekko, jakość spadnie poniżej akceptowalnego progu.

Dokąd wszystko zmierza

Obszar ten nie jest statyczny. Elektronika analogowa powraca w niszowych zastosowaniach high-end. Naukowcy ponownie zastanawiają się, w jaki sposób konwertujemy i przetwarzamy sygnały. Jeśli chcesz głębiej zagłębić się w sprzętową stronę tego łańcucha sygnałowego, w ostatnich badaniach CNRS opisał powrót do źródeł analogowych. Przypomina to, że nawet w świecie cyfrowym zasady fizyki oryginalnego sygnału nadal dyktuje zasady.

Przyszłość to nie tylko więcej kawałków. To są inteligentne kawałki.