Śledzenie w domowym NVR: dlaczego trwałe identyfikatory obiektów ograniczają liczbę zduplikowanych alertów

Eva Wong jest Technicznym pisarzem i stałym majsterkowiczem w ZimaSpace. Całe życie geek z pasją do homelabów i oprogramowania open-source, specjalizuje się w tłumaczeniu skomplikowanych koncepcji technicznych na przystępne, praktyczne przewodniki. Eva wierzy, że samodzielne hostowanie powinno być zabawą, a nie czymś onieśmielającym. Poprzez swoje samouczki umożliwia społeczności rozwiewanie tajemnic konfiguracji sprzętu, od budowy pierwszego NAS po opanowanie kontenerów Docker.

Trwałe identyfikatory obiektów ograniczają liczbę zduplikowanych alertów NVR, łącząc detekcje na poziomie klatek w jedno ciągłe zdarzenie zamiast wielokrotnie wykrywać tego samego gościa.

Detektor może wykryć osobę w trzydziestu klatkach na sekundę, ale każda detekcja początkowo jest tylko ramką i wynikiem. Bez śledzenia reguła alertów może uruchamiać się za każdym razem, gdy poziom pewności spada i wraca, albo gdy osoba przekracza granicę strefy. Tracker zapewnia ciągłość czasową, dzięki czemu NVR może rozpoznawać przybycie, czas przebywania, odejście i ponowne wejście.

Ramki detekcji nie mają pamięci między klatkami

Detekcja obiektów określa, co pojawia się na jednym obrazie. Śledzenie dodaje stan: ostatnią pozycję, ruch, cechy wyglądu, wiek oraz identyfikator. Każda nowa klatka staje się problemem asocjacji danych, który polega na dopasowaniu detekcji do przewidywanych ścieżek oraz rozpoczęciu lub zakończeniu ścieżek, gdy wiarygodne dopasowanie nie jest możliwe.

Metoda trackera Deep SORT łączy informacje o ruchu i wyglądzie, aby utrzymywać tożsamość obiektów w sekwencji wideo. Jej konstrukcja pokazuje, dlaczego trwały identyfikator jest obliczany na podstawie danych czasowych, a nie dostarczany bezpośrednio przez detektor.

Gdy taki stan jest już dostępny, silnik alertów może reagować na przejście ze stanu nieobecności do obecności zamiast na każdą pozytywną klatkę. Może również wymagać określonego czasu przebywania, zliczać jedno przekroczenie strefy i zamykać zdarzenie dopiero wtedy, gdy ścieżka będzie niewykrywana wystarczająco długo.

Asocjacja utrzymuje słabsze klatki w ramach jednego zdarzenia

Pewność naturalnie zmienia się, gdy osoba się obraca, staje się mniejsza lub przechodzi przez cień. Tracker przewiduje, gdzie obiekt powinien się pojawić, i może powiązać słabszą detekcję z istniejącą ścieżką, zapobiegając temu, by krótki spadek pewności zakończył jedno zdarzenie i rozpoczął kolejne.

asocjacja detekcji o niskim wyniku poprawia dopasowanie, wykorzystując detekcje o niskim wyniku zamiast całkowicie je odrzucać. Mechanizm ten ma znaczenie dla NVR, ponieważ częściowo zasłonięte obiekty często pozostają wykrywalne poniżej progu używanego dla nowego alertu. To rozróżnienie pozostaje istotne w realistycznych warunkach użytkowania domowego.

Wyciszanie alertów może następnie opierać się na stanie ścieżki: wysłać powiadomienie raz po potwierdzeniu, aktualizować to samo zdarzenie podczas ruchu i zastosować czas wyciszenia po zniknięciu. Identyfikator jest lokalny dla czasu życia ścieżki; nie stanowi dowodu, że ta sama osoba rzeczywiście wróciła następnego dnia.

Zasłonięcia i zmiany sceny powodują przełączanie identyfikatorów

Długie zasłonięcie, mijanie się osób, nagły ruch kamery, korekcja obiektywu lub zmiana sceny mogą przerwać asocjację. Tracker może przypisać ten sam obiekt do nowego identyfikatora albo przenieść stary identyfikator na inny obiekt, powodując z jednej strony zduplikowane wyciszanie, a z drugiej pominięte alerty.

Obszerny przegląd śledzenia rozdziela wyzwania związane z detekcją, asocjacją, ruchem i wyglądem oraz omawia typowe miary oceny. To rozdzielenie ma znaczenie, ponieważ detektor może uzyskiwać dobre wyniki, podczas gdy ścieżka nadal rozpada się na kilka identyfikatorów. Stan pośredni powinien pozostać widoczny podczas późniejszej diagnostyki i przeglądu.

Granicą działania jest ciągłość lokalna dla kamery przy obserwowalnym ruchu, a nie trwała tożsamość utrzymywana przez wiele dni lub między kamerami. Resetuj ścieżki po dużych zmianach sceny, ogranicz czas przetrwania niedopasowanej ścieżki i nigdy nie używaj samego identyfikatora ścieżki do kontroli dostępu ani rozpoznawania osób.

Zmierz fragmentację ścieżek, zanim zaczniesz wyciszać alerty

Wybierz dziesięć nagrań z normalnym ruchem, zasłonięciami, mijaniem się obiektów, przejściami między dniem a nocą, deszczem i krawędziami obrazu szerokokątnego. Oznacz każdą rzeczywistą wizytę jako jedno zdarzenie, a następnie policz fragmenty ścieżek, przełączenia identyfikatorów, brakujące ścieżki oraz alerty wygenerowane przy proponowanych ustawieniach potwierdzania i czasu wyciszenia.

Porównaj wynik z mechanizmami niestabilności obrazu szerokokątnego opisanymi w artykule śledzenie na obiektywach szerokokątnych, ponieważ dystorsja geometryczna może zmieniać zarówno ramki, jak i przewidywanie ruchu. Przeanalizuj oś czasu w miejscu rozpoczęcia każdego duplikatu, zamiast dostrajać globalny czas wyciszenia na podstawie łącznej liczby alertów.

Włącz wyciszanie oparte na identyfikatorach tylko wtedy, gdy jedna rzeczywista wizyta zwykle pozostaje jedną ścieżką, a odrębne wizyty nie są łączone. Jeśli długie zasłonięcia powodują oba rodzaje błędów, połącz stan ścieżki ze strefami i limitami czasu zamiast wydłużać jeden uniwersalny limit czasu.

Centrum Technologii i Sztucznej Inteligencji

Więcej do przeczytania

Get More Builds Like This

Stay in the Loop

Get updates from Zima - new products, exclusive deals, and real builds from the community.

Stay in the Loop preferences

We respect your inbox. Unsubscribe anytime.