Trwałe identyfikatory obiektów ograniczają liczbę zduplikowanych alertów NVR, łącząc detekcje na poziomie klatek w jedno ciągłe zdarzenie zamiast wielokrotnie wykrywać tego samego gościa.
Detektor może wykryć osobę w trzydziestu klatkach na sekundę, ale każda detekcja początkowo jest tylko ramką i wynikiem. Bez śledzenia reguła alertów może uruchamiać się za każdym razem, gdy poziom pewności spada i wraca, albo gdy osoba przekracza granicę strefy. Tracker zapewnia ciągłość czasową, dzięki czemu NVR może rozpoznawać przybycie, czas przebywania, odejście i ponowne wejście.
Ramki detekcji nie mają pamięci między klatkami
Detekcja obiektów określa, co pojawia się na jednym obrazie. Śledzenie dodaje stan: ostatnią pozycję, ruch, cechy wyglądu, wiek oraz identyfikator. Każda nowa klatka staje się problemem asocjacji danych, który polega na dopasowaniu detekcji do przewidywanych ścieżek oraz rozpoczęciu lub zakończeniu ścieżek, gdy wiarygodne dopasowanie nie jest możliwe.
Metoda trackera Deep SORT łączy informacje o ruchu i wyglądzie, aby utrzymywać tożsamość obiektów w sekwencji wideo. Jej konstrukcja pokazuje, dlaczego trwały identyfikator jest obliczany na podstawie danych czasowych, a nie dostarczany bezpośrednio przez detektor.
Gdy taki stan jest już dostępny, silnik alertów może reagować na przejście ze stanu nieobecności do obecności zamiast na każdą pozytywną klatkę. Może również wymagać określonego czasu przebywania, zliczać jedno przekroczenie strefy i zamykać zdarzenie dopiero wtedy, gdy ścieżka będzie niewykrywana wystarczająco długo.
Asocjacja utrzymuje słabsze klatki w ramach jednego zdarzenia
Pewność naturalnie zmienia się, gdy osoba się obraca, staje się mniejsza lub przechodzi przez cień. Tracker przewiduje, gdzie obiekt powinien się pojawić, i może powiązać słabszą detekcję z istniejącą ścieżką, zapobiegając temu, by krótki spadek pewności zakończył jedno zdarzenie i rozpoczął kolejne.
asocjacja detekcji o niskim wyniku poprawia dopasowanie, wykorzystując detekcje o niskim wyniku zamiast całkowicie je odrzucać. Mechanizm ten ma znaczenie dla NVR, ponieważ częściowo zasłonięte obiekty często pozostają wykrywalne poniżej progu używanego dla nowego alertu. To rozróżnienie pozostaje istotne w realistycznych warunkach użytkowania domowego.
Wyciszanie alertów może następnie opierać się na stanie ścieżki: wysłać powiadomienie raz po potwierdzeniu, aktualizować to samo zdarzenie podczas ruchu i zastosować czas wyciszenia po zniknięciu. Identyfikator jest lokalny dla czasu życia ścieżki; nie stanowi dowodu, że ta sama osoba rzeczywiście wróciła następnego dnia.
Zasłonięcia i zmiany sceny powodują przełączanie identyfikatorów
Długie zasłonięcie, mijanie się osób, nagły ruch kamery, korekcja obiektywu lub zmiana sceny mogą przerwać asocjację. Tracker może przypisać ten sam obiekt do nowego identyfikatora albo przenieść stary identyfikator na inny obiekt, powodując z jednej strony zduplikowane wyciszanie, a z drugiej pominięte alerty.
Obszerny przegląd śledzenia rozdziela wyzwania związane z detekcją, asocjacją, ruchem i wyglądem oraz omawia typowe miary oceny. To rozdzielenie ma znaczenie, ponieważ detektor może uzyskiwać dobre wyniki, podczas gdy ścieżka nadal rozpada się na kilka identyfikatorów. Stan pośredni powinien pozostać widoczny podczas późniejszej diagnostyki i przeglądu.
Granicą działania jest ciągłość lokalna dla kamery przy obserwowalnym ruchu, a nie trwała tożsamość utrzymywana przez wiele dni lub między kamerami. Resetuj ścieżki po dużych zmianach sceny, ogranicz czas przetrwania niedopasowanej ścieżki i nigdy nie używaj samego identyfikatora ścieżki do kontroli dostępu ani rozpoznawania osób.
Zmierz fragmentację ścieżek, zanim zaczniesz wyciszać alerty
Wybierz dziesięć nagrań z normalnym ruchem, zasłonięciami, mijaniem się obiektów, przejściami między dniem a nocą, deszczem i krawędziami obrazu szerokokątnego. Oznacz każdą rzeczywistą wizytę jako jedno zdarzenie, a następnie policz fragmenty ścieżek, przełączenia identyfikatorów, brakujące ścieżki oraz alerty wygenerowane przy proponowanych ustawieniach potwierdzania i czasu wyciszenia.
Porównaj wynik z mechanizmami niestabilności obrazu szerokokątnego opisanymi w artykule śledzenie na obiektywach szerokokątnych, ponieważ dystorsja geometryczna może zmieniać zarówno ramki, jak i przewidywanie ruchu. Przeanalizuj oś czasu w miejscu rozpoczęcia każdego duplikatu, zamiast dostrajać globalny czas wyciszenia na podstawie łącznej liczby alertów.
Włącz wyciszanie oparte na identyfikatorach tylko wtedy, gdy jedna rzeczywista wizyta zwykle pozostaje jedną ścieżką, a odrębne wizyty nie są łączone. Jeśli długie zasłonięcia powodują oba rodzaje błędów, połącz stan ścieżki ze strefami i limitami czasu zamiast wydłużać jeden uniwersalny limit czasu.
Centrum Technologii i Sztucznej Inteligencji
Więcej do przeczytania

Kalibracja oceny prywatnego wyszukiwania: jak surowe podobieństwo staje się użytecznym wskaźnikiem pewności
Dowiedz się, dlaczego podobieństwo cosinusowe nie jest miarą pewności, jak oznaczone zapytania służą do kalibracji wyników oraz jak monitorować progi, gdy zmienia się prywatny...

Lokalność NUMA w lokalnej sztucznej inteligencji: dlaczego rozmieszczenie pamięci zmienia tempo zasilania akceleratora
Dowiedz się, jak topologia CPU, pamięci RAM i PCIe wpływa na zasilanie akceleratora danymi, dlaczego automatyczne rozmieszczanie może się różnić oraz jak bezpiecznie testować...

Mapowanie plików modeli w pamięci: jak współdzielone strony zmniejszają duplikowanie pamięci RAM
Dowiedz się, jak mapowane strony modelu są stronicowane i współdzielone, dlaczego RSS może wprowadzać w błąd oraz które pamięci podręczne i bufory nadal zajmują...

