Kamery monitoringu rejestrują ogromne ilości danych. Bez zastosowania kompresji, zarządzanie materiałem wideo przeznaczonym przesyłania i zapisu szybko stałoby się niemożliwe. Kompresja zmniejsza te wymagania, jednocześnie zachowując niezbędne szczegóły oraz możliwość prowadzenia analiz.
Dzięki zastosowaniu kompresji, całodobowe działanie dziesiątek czy nawet setek kamer staje się w pełni wykonalne. Jednak skala niesie ze sobą własne wyzwania. Nawet skompresowane wideo, przy dużej liczbie urządzeń, może generować znaczne koszty przechowywania, które rosną z każdą nową kamerą i każdym dniem przechowywania materiału. Im bardziej wydajna kompresja, tym niższe koszty eksploatacji w trakcie całego okresu użytkowania systemu.
Wczesne systemy dozoru kompresowały każdą klatkę niezależnie, co prowadziło do wysokich przepływności i kosztów przechowywania. Przełom nastąpił wraz z pojawieniem się kodeków wideo, które nie tylko kompresowały pojedyncze klatki, ale także analizowały zmiany między nimi. Kodowanie wyłącznie różnic znacząco obniżyło przepływność i umożliwiło wprowadzenie kamer o wyższej rozdzielczości na szeroką skalę.
Znacząca zmiana nie wynikała z wprowadzenia nowego kodeka, lecz z inteligentnego podejścia do samego procesu kodowania. Zamiast równomiernie kompresować każdą część każdej klatki, inteligentne kodowanie w czasie rzeczywistym analizuje zawartość sceny. Kluczowe obszary zyskują większą przepustowość, podczas gdy statyczne tła otrzymują jej mniej.
Obraz z kamery nie trafia na ekran w jednej chwili. Kamera rejestruje surowe dane obrazu, koduje je, przesyła przez sieć, a następnie dostarcza do pamięci masowej lub klienta wyświetlającego. Kompresja odbywa się na etapie kodowania. To dzieje się wewnątrz samej kamery. To jedyny punkt w łańcuchu, gdzie oryginalny, nieskompresowany obraz wciąż istnieje, co czyni go najważniejszym etapem, który należy dopracować.
Komponent odpowiedzialny za tę pracę nazywa się kodekiem, co jest skrótem od nazw koder i dekoder. To duet algorytmów, które współpracują ze sobą: jeden kompresuje wideo bezpośrednio w kamerze, podczas gdy drugi odpowiada za jego dekompresję na końcu odbiorczym. Kodeki z różnych standardów nie są ze sobą kompatybilne, dlatego wideo skompresowane w standardzie H.264 nie może zostać zdekodowane przez dekoder H.265. Dlatego właśnie nowoczesne aparaty fotograficzne często obsługują wiele kodeków.
Bardziej zaawansowane kodeki wymagają większej mocy obliczeniowej, co powoduje niewielkie opóźnienie między rejestracją a wyświetlaniem obrazu. W większości przypadków związanych z dozorem, efekt ten jest ledwie zauważalny. Aplikacje wymagające interakcji w czasie rzeczywistym, takie jak sterowanie PTZ, są zazwyczaj bardziej wrażliwe na opóźnienia.
Nie wszystkie dane zawarte w klatce wideo mają jednakową wartość. Statyczna ściana lub niezmieniony odcinek drogi nie wymagają ciągłego ponownego kodowania. Kompresja rozpoznaje i eliminuje nadmiarowość, jednocześnie zachowując to, co istotne: ruch, twarze, tablice rejestracyjne, zdarzenia.
Kompresja działa na dwóch poziomach:
Usuwane są szczegóły, których ludzkie oko nie jest w stanie dostrzec. Ramka prezentuje się identycznie. Plik ma zaledwie ułamek swojej pierwotnej wielkości.
Kodowane są wyłącznie piksele, które uległy zmianie. Wszystko inne pozostaje bez zmian i nie wymaga ponownej transmisji. W typowej scenie monitoringu większość obrazu pozostaje niezmienna z klatki na klatkę, co znacząco zmniejsza ilość danych wymagających przechowywania i przesyłania.
Kompresja wideo z monitoringu z natury jest stratna. W przeciwieństwie do kompresji bezstratnej, która zachowuje każdy bit oryginalnych danych, kompresja stratna usuwa informacje, które prawdopodobnie nie wpłyną na użyteczność wideo. W przeciwnym razie pliki byłyby zbyt duże, aby możliwe było ciągłe nagrywanie i przesyłanie danych.
Kompresja bezstratna znajduje główne zastosowanie w przechowywaniu dokumentów i zazwyczaj nie jest wykorzystywana w aplikacjach wideo, z wyjątkiem produkcji filmowej oraz archiwizacji cyfrowej, gdzie zachowanie każdego szczegółu ma większe znaczenie niż wymagania dotyczące przestrzeni dyskowej i przepustowości. Bezstratna redukcja przepływności jest po prostu zbyt mało efektywna; wynikowa wartość przekroczyłaby możliwości infrastruktury sieciowej lub pamięci masowej.
Wybór kodeka, którego dokonasz, wpłynie na wszystko, co nastąpi później: wymagania dotyczące przepustowości, koszty przechowywania, kompatybilność z platformami VMS oraz urządzeniami klienckimi, a także jakość danych dostępnych do analityki AI. Warto zwrócić uwagę na trzy standardy.
Advanced Video Coding (AVC)
H.264 od ponad dwóch dekad stanowi fundament technologii wideo w sieciach. Jest niezawodny, szeroko kompatybilny i współpracuje praktycznie z każdą platformą VMS oraz urządzeniem klienckim dostępnym na rynku.
Ograniczeniem jest przepustowość. Utrzymanie klarowności obrazu przy wysokich rozdzielczościach wymaga zastosowania wysokich przepływności, co w przypadku rozległych instalacji kamerowych może prowadzić do znacznych obciążeń. Kodowanie H.264 nie obsługuje również wideo o rozdzielczości większej niż 8K, co nabiera coraz większego znaczenia wraz ze wzrostem rozdzielczości kamer.
Ponad 20 lat w użytkowaniu
High Efficiency Video Coding (HEVC)
Kodowanie H.265 udoskonaliło standard H.264, oferując porównywalną jakość przy jednoczesnym zmniejszeniu przepływności o 15 do 40 procent. Największym wyzwaniem od zawsze pozostawały kwestie licencyjne. Rygorystyczne kwestie patentowe sprawiły, że włączenie natywnych dekoderów przez dostawców przeglądarek stało się praktycznie niemożliwe, zmuszając wielu użytkowników do ich ręcznej instalacji.
Te problemy z kompatybilnością wciąż nie zostały rozwiązane. W przypadku wdrożeń, gdzie zgodność z klientem nie stanowi problemu, H.265 wciąż zapewnia znaczące korzyści w zakresie wydajności. Jednakże dla nowych wdrożeń dostępna jest teraz bardziej zaawansowana opcja.
Ograniczone wsparcie przeglądarek
Alliance for Open Media (AOM)
Kodek AV1 został opracowany przez Alliance for Open Media, koalicję obejmującą Google, Amazon, Microsoft i Netflix, i wprowadzony na rynek w 2018 roku jako bezpłatny, otwartoźródłowy kodek. Stworzony z myślą o nowoczesnym streamingu wideo, zapewnia znacznie wyższą efektywność kompresji niż wcześniejsze standardy. Obsługuje również funkcje, takie jak przełączalne nakładki, które osadzają metadane bezpośrednio w strumieniu wideo.
W porównaniu z H.264, AV1 zazwyczaj pozwala na zmniejszenie przepływności o około 40 procent, zachowując przy tym porównywalną jakość obrazu. Czerpie również korzyści z szerokiego wsparcia w nowoczesnych przeglądarkach, systemach operacyjnych i platformach mobilnych, co ułatwia jego wdrożenie i minimalizuje obawy związane z licencjonowaniem.
W przypadku monitoringu oznacza to niższe koszty przechowywania danych oraz mniejsze obciążenie sieci. Zachowanie szczegółów obrazu oznacza również, że analizy AI mogą korzystać z bardziej precyzyjnych danych wizualnych. Kamery obsługujące AV1 mogą jednocześnie korzystać z H.264 i H.265, co ułatwia zarządzanie procesem przejścia.
Zalecane do wdrożeń od podstaw
Kodowanie z uwzględnieniem treści wykorzystuje sztuczną inteligencję do rozpoznawania tych fragmentów sceny, które zawierają istotne informacje. Większą przepływność można następnie przydzielić tym obszarom, podczas gdy statyczne elementy tła są kompresowane bardziej agresywnie. Rezultatem jest mniejsze zużycie przepustowości, bez jednoczesnej utraty istotnych szczegółów.
Jakość obrazu ma kluczowe znaczenie dla analiz. Wykrywanie obiektów oraz rozpoznawanie tablic rejestracyjnych zazwyczaj odbywa się na poziomie kamery przed kompresją, ponieważ oryginalny obraz zawiera więcej informacji niż zakodowany strumień.
Generatywna sztuczna inteligencja przyjmuje zupełnie odmienne podejście. Zamiast kodować oryginalny obraz, odtwarza fragmenty wideo podczas jego wyświetlania. To może być uznane za wystarczające w przypadku strumieniowego przesyłania treści rozrywkowych. Nagrania z monitoringu często muszą wspierać dochodzenia oraz służyć jako dowody, co stawia różnorodne wymagania dotyczące precyzji.
Gdy kompresja jest odpowiednio skonfigurowana, znacząco zmniejsza zapotrzebowanie na przepustowość i przestrzeń magazynową, nie obniżając przy tym jakości obrazu, która sprawia, że nagrania z monitoringu są użyteczne. Wpływ wykracza poza oszczędności w przechowywaniu, obejmując wszystko – od czasu przechowywania, przez przepustowość sieci, aż po koszty chmury.
Sama wartość przepływności nie stanowi miarodajnego wskaźnika efektywności kompresji. Kamera może osiągnąć niższą przepływność, odrzucając większą ilość informacji wizualnych. To z kolei może wpłynąć na pogorszenie jakości obrazu, ograniczając tym samym przydatność wideo. Kluczowe jest, ile szczegółów udaje się zachować przy określonej przepływności. Jak właściwie wygląda nagranie wideo i czy zachowuje szczegółowość niezbędną do analiz i zastosowań kryminalistycznych? To porównanie może okazać się trudne. Dwie kamery ustawione obok siebie nie uchwycą identycznych obrazów. Ponieważ żadne dwie sceny nie są identyczne, wydajność kompresji najlepiej oceniać w środowisku, w którym kamera będzie faktycznie używana.
Kompresja wpływa nie tylko na przechowywanie i przepustowość. Wybrane ustawienia mają wpływ zarówno na wydajność systemu, jak i na jakość nagrywanego wideo.
Umiejscowienie AI w obiegu ma kluczowe znaczenie. Analizy oparte na sztucznej inteligencji, takie jak wykrywanie obiektów czy rozpoznawanie tablic rejestracyjnych, powinny być przeprowadzane na kamerze jeszcze przed kompresją. Skompresowane wideo zawiera mniej informacji wizualnych niż oryginał, co wpływa na wiarygodność interpretacji dokonywanych przez systemy analityczne.
Każde urządzenie w łańcuchu musi obsługiwać ten sam kodek, w tym kamery, oprogramowanie do zarządzania wideo, serwery pamięci masowej oraz klientów do podglądu. Kamery obsługujące standardy H.264, H.265 oraz AV1 oferują większą elastyczność, ułatwiając integrację z istniejącymi systemami i jednocześnie wspierając przyszłe modernizacje.
Ustawienia kompresji muszą znaleźć złoty środek między jakością obrazu a wymaganiami dotyczącymi przechowywania i przepustowości. Zbyt mała kompresja prowadzi do większego zużycia zasobów, natomiast nadmierna może zaciemniać szczegóły istotne dla dochodzeń oraz codziennych działań operacyjnych.
Odpowiednie ustawienie zależy od charakteru sceny oraz celu nagrania. Testuj wydajność kompresji w rzeczywistych warunkach, a nie w idealnych. Narzędzia projektowe, które umożliwiają oszacowanie przepływności dla każdej kamery i przypadku, mogą pomóc w planowaniu.
Przepływność określa, jak szybko zapełnia się pamięć masowa. Przed wdrożeniem lub rozbudową systemu należy obliczyć przewidywaną przepływność dla każdej kamery, a następnie pomnożyć ją przez liczbę kamer oraz wymagany okres przechowywania danych.
System, który na początku wydaje się przystępny cenowo, może szybko stać się kosztowny, jeśli przestrzeń magazynowa wyczerpie się wcześniej, niż przewidywano, lub jeśli później dodane zostaną kamery bez ponownej analizy pojemności.
Wsparcie dla AV1 nieustannie się rozwija, obejmując coraz więcej platform chmurowych oraz szerszy ekosystem oprogramowania. W miarę jak wsparcie dla dekoderów staje się powszechne, wiele barier, które utrudniały przyjęcie H.265, zaczyna zanikać, co czyni AV1 bardziej praktycznym wyborem dla nowych wdrożeń w zakresie dozoru.
Przeniesienie wideo do chmury sprawia, że efektywność kompresji nabiera kluczowego znaczenia, ponieważ koszty przechowywania i transmisji rosną proporcjonalnie do przepływności. W większych wdrożeniach, gdzie nagrania wideo są przechowywane przez dłuższy czas, nawet niewielkie obniżenie przepływności może z czasem przynieść znaczące korzyści.
W miarę jak rozwija się nadzór oparty na chmurze, sama jakość obrazu przestanie wystarczać jako jedyny wyznacznik wydajności kompresji.
Coraz większy nacisk kładzie się na maksymalne wykorzystanie możliwości istniejących kodeków. Kodowanie dynamicznie dostosowuje się do treści sceny, pory dnia oraz poziomu aktywności. Funkcje takie jak przełączalne nakładki osadzają metadane bezpośrednio w strumieniu wideo, umożliwiając jednoczesne dostarczanie obrazu i uporządkowanych danych bez dodatkowego obciążenia pasma.
Przechowywanie danych to jeden z największych stałych kosztów w systemach dozoru, a zapotrzebowanie na nie nieustannie rośnie wraz ze wzrostem rozdzielczości i wydłużaniem okresów przechowywania. Bardziej wydajna kompresja pomaga zrównoważyć ten wzrost. Niższe przepływności zmniejszają zapotrzebowanie na przestrzeń dyskową, a także mogą ograniczyć ilość sprzętu wymaganego w trakcie eksploatacji systemu.
Kompresja wideo to dynamicznie rozwijająca się dziedzina, w której nieustannie pojawiają się nowe standardy. Migracja pomiędzy standardami wymaga czasu, a istniejące systemy muszą nadal funkcjonować. Sukces nowych kodeków polega na ich zdolności do poszanowania istniejących rozwiązań oraz zachowania z nimi kompatybilności.
Nie wszystkie nowe standardy zyskają na popularności. Adopcja kodeka zależy w równym stopniu od licencjonowania i dynamiki branży, co od jego wydajności technicznej. Dla większości organizacji długoterminowa elastyczność ma większą wartość niż próby przewidywania, który kodek stanie się dominujący w przyszłości.
Branża z entuzjazmem bada możliwości wykorzystania generatywnej sztucznej inteligencji jako metody kompresji. Nagrania mogą być niezbędne do wsparcia dochodzeń lub jako dowody, dlatego wideo musi wiernie odzwierciedlać to, co zarejestrowała kamera.
Biała księga wyjaśniająca, w jaki sposób kompresja uwzględniająca zawartość zmniejsza wymagania dotyczące przechowywania danych, jednocześnie zachowując szczegóły niezbędne do prowadzenia dochodzeń.
Szacowanie wymagań dotyczących przechowywania i przepustowości przed wdrożeniem pozwala wyeliminować dużą część domysłów. AXIS Site Designer pomaga w konfiguracji urządzeń, obliczaniu wymagań systemowych oraz tworzeniu kompletnej listy materiałów.
Stefan Lundberg, Senior Expert Engineer w Axis, wyjaśnia, czym jest AV1 dla sieciowego wideo oraz jak wypada w porównaniu z H.264 i H.265.
To, gdzie i w jaki sposób przechowujesz nagrania wideo, ma kluczowe znaczenie dla możliwości Twojego systemu dozoru. Odpowiednia architektura pamięci masowej zapewnia łatwy dostęp do nagrań wideo, przewidywalne koszty oraz gotowość systemu do skalowania.
Nowoczesna analiza wideo potrafi automatycznie rozpoznać, co dzieje się na nagraniu. Odkryj, w jaki sposób sztuczna inteligencja i uczenie maszynowe pomagają organizacjom czerpać większą wartość z ich systemów wideo.
Nagrania z kamer monitoringu są tak użyteczne, jak szczegóły, które potrafią uchwycić. Użyteczność obrazu decyduje o tym, czy twarz zostanie rozpoznana, tablica rejestracyjna odczytana, czy zdarzenie zrozumiane. Odpowiednie połączenie rozdzielczości, oświetlenia i przetwarzania zamienia nagranie w dowód, który można wykorzystać.