Śledzenie między kamerami polega na łączeniu stabilnych ścieżek lokalnych z informacjami o wyglądzie i czasoprzestrzeni, ograniczonymi przez znane trasy między kamerami domowymi.
Osoba może wyjść z pola widzenia kamery na podjeździe i pojawić się kilka sekund później przy ganku, a każda kamera początkowo utworzy nowy lokalny identyfikator. Domowy rejestrator NVR potrzebuje czegoś więcej niż detekcji obiektów, aby połączyć te fragmenty. Musi tworzyć wiarygodne ścieżki w każdym ujęciu, ostrożnie porównywać wygląd, synchronizować znaczniki czasu, modelować prawdopodobne trasy przemieszczania oraz zachowywać niepewność, gdy zasłonięcie lub podobne ubrania uniemożliwiają bezpieczne przekazanie śledzenia.
Stabilne ścieżki lokalne tworzą jednostki, które można łączyć
Detekcja niezależnie dostarcza obwiednie na każdej klatce, a śledzenie przypisuje je do siebie w czasie, tworząc lokalną trajektorię. Predykcja ruchu, pewność detekcji i obsługa zasłonięć decydują o tym, czy jedna osoba zachowa identyfikator aż do opuszczenia pola widzenia kamery.
śledzenie wspomagane informacjami o wyglądzie łączy ruch i głębokie informacje o wyglądzie, aby ograniczyć zmiany tożsamości podczas zasłonięć. Jego struktura wyjaśnia, dlaczego logika śledzenia między kamerami powinna korzystać ze ścieżek cząstkowych zamiast porównywać pojedyncze detekcje. Różnica ta pozostaje widoczna podczas późniejszych testów w domu.
Słaby tracker lokalny tworzy rozfragmentowane kandydatury, zwiększając niejednoznaczność między kamerami. Dla każdej ścieżki cząstkowej zapisuj czas wejścia i wyjścia, strefę, reprezentatywne wycinki obrazu, klasę, kierunek oraz oceny jakości, zachowując przy tym pierwotny lokalny identyfikator kamery na potrzeby audytu.
Wektory cech wyglądu wymagają ograniczeń czasoprzestrzennych
Enkodery ponownej identyfikacji odwzorowują wycinki obrazu w przestrzeni wyglądu, w której podobne obiekty znajdują się bliżej siebie. Kolor ubrań, kształt sylwetki, szczegóły pojazdu i perspektywa mogą pomóc, ale oświetlenie, deszcz, kompresja oraz członkowie rodziny noszący podobne ubrania mogą zniwelować różnice.
System spójności czasoprzestrzennej, który zwyciężył w konkursie, łączy grupowanie według wyglądu ze spójnością czasoprzestrzenną i ponownym przypisywaniem identyfikatorów. Jego mocny wynik pokazuje, że podobieństwo wizualne staje się bardziej wiarygodne, gdy geometria i czas ograniczają możliwe dopasowania. Wynik pośredni musi pozostać możliwy do sprawdzenia, zanim automatyzacja podejmie dalsze działania.
Topologia domu może uwzględniać fakt, że przejście z podjazdu do ganku zwykle trwa od 3 do 30 sekund, podczas gdy przejście z piwnicy na podjazd nie może nastąpić natychmiast. W przypadku nakładających się pól widzenia wykorzystuje się geometrię, a w przypadku pól rozłącznych — strefy wejścia, strefy wyjścia, rozkłady czasu przemieszczania i kierunek. Tę granicę należy mierzyć osobno w realistycznych warunkach pracy.
Zegar, kalibracja i pewność sterują przekazywaniem śledzenia
Zegary kamer muszą korzystać ze stabilnej wspólnej podstawy czasu, ponieważ nawet kilkusekundowe przesunięcie może sprawić, że prawidłowe przejście będzie wyglądać na niemożliwe. Poligony stref i kalibracja obiektywu przekształcają surowe pozycje obwiedni w znaczeniowo istotne wejścia, trasy i wyjścia.
kojarzenie detekcji o niskiej pewności zachowuje detekcje o niskiej pewności podczas kojarzenia, zamiast natychmiast je odrzucać, poprawiając ciągłość przy częściowych zasłonięciach. Ta zasada ma znaczenie w domu, gdzie drzwi lub roślina mogą chwilowo obniżyć pewność detektora. Praktyczne konsekwencje są widoczne, gdy wiele źródeł konkuruje o ograniczony kontekst.
Granica błędu pojawia się przy wymuszaniu globalnej tożsamości. Gdy dwóch kandydatów ma podobny wygląd i nakładające się okna czasowe przemieszczania, NVR powinien zachować osobne hipotezy lub rozpocząć nowy identyfikator. Pewne, lecz błędne połączenie bardziej zniekształca liczbę zdarzeń, alerty i późniejsze podsumowania niż widoczna przerwa.
Testuj przekazywanie śledzenia za pomocą znanej macierzy tras
Przejdź pieszo i przejedź znane trasy między każdą połączoną parą kamer, z różnymi prędkościami, o różnych porach, w różnych ubraniach i przy różnym oświetleniu. Uwzględnij dwie podobne osoby, jednoczesne przejścia, zmiany kierunku, długie przerwy oraz celowo niemożliwe przeskoki między kamerami. Ta zależność powinna pozostać wyraźnie przedstawiona w końcowym interfejsie.
Wykorzystaj rozróżnienie trwałych identyfikatorów z trwałych identyfikatorów śledzenia, aby rejestrować lokalne fragmentacje, precyzję i czułość przekazywania między kamerami, zmiany tożsamości, błędne połączenia, nieznane przekazania oraz przesunięcie zegara. Przeglądaj źródłowe nagrania stojące za każdą połączoną globalną ścieżką.
Wdrażaj automatyczne łączenie tylko dla par kamer i okien czasowych, które osiągają wymagany próg precyzji. Pozostawiaj niejednoznaczne przejścia niepołączone lub dostępne do weryfikacji; zwiększanie promienia dopasowania w celu ukrycia przerw nie jest ulepszeniem, jeśli po cichu łączy różne obiekty.
Centrum Technologii i Sztucznej Inteligencji
Więcej do przeczytania

Jakie czynniki decydują o okresie przechowywania zdarzeń automatyki domowej?
Zobacz, jak wymagania operacyjne, sezonowe, audytowe, dotyczące prywatności i pamięci masowej określają różne okresy przechowywania zdarzeń automatyki domowej.

Jakie komponenty umożliwiają długoterminową analizę danych z inteligentnych czujników domowych?
Dowiedz się, jak schematy, zegary, obsługa opóźnionych danych, przechowywanie szeregów czasowych, agregacje, kalibracja i pochodzenie danych sprawiają, że wieloletnia historia pomiarów z czujników domowych...

Jakie funkcje umożliwiają uczenie się codziennych nawyków w domu z zachowaniem prywatności?
Zobacz, jak lokalne przetwarzanie, minimalizacja danych, zgoda, edytowalne procedury, limity przechowywania i uczenie uwzględniające prywatność chronią dane dotyczące zachowań domowników.

