Fuzja rankingów poprawia prywatne wyszukiwanie AI w domu, łącząc uzupełniające się listy wyników na podstawie pozycji w rankingu, zamiast polegać wyłącznie na jednym sygnale wyszukiwania.
Baza wiedzy gospodarstwa domowego może zawierać dokładne nazwy plików, numery modeli, sparafrazowane notatki, zeskanowane instrukcje, wiersze tabel, paragony i zapisy rozmów. Wyszukiwanie słów kluczowych jest skuteczne, gdy zapytanie zawiera dosłowne terminy występujące w dokumencie, podczas gdy wyszukiwanie semantyczne może odnaleźć fragmenty wyrażające tę samą ideę w inny sposób. Filtry metadanych i wyspecjalizowane indeksy dostarczają kolejnych list. Fuzja rankingów tworzy jeden wspólny porządek na podstawie tych niezależnych wyszukiwań, pozwalając prywatnemu serwerowi zachować różne mocne strony poszczególnych metod, zanim kandydaci trafią do wolniejszego rerankera lub modelu generującego odpowiedź.
Różne retrievery ujawniają różne rodzaje dowodów
Wyszukiwanie leksykalne preferuje dokładne terminy, rzadkie identyfikatory, daty i frazy. Wyszukiwanie gęste preferuje podobieństwo semantyczne, nawet gdy brzmienie zapytania się zmienia. Prywatny system wyszukiwania często potrzebuje obu metod, ponieważ domowe dokumenty zawierają zarówno język naturalny, jak i dokładne szczegóły techniczne.
Oryginalne badanie dotyczące Reciprocal Rank Fusion wykazało, że wiele systemów rankingowych można łączyć bez trenowania nowego modelu trafności dla każdej kolekcji.
Jedna lista może znaleźć numer modelu routera, a inna — akapit dotyczący rozwiązywania problemów, który opisuje ten sam objaw bez podawania nazwy modelu. Fuzja utrzymuje aktywność obu ścieżek wyszukiwania, zamiast zmuszać serwer do wyboru jednego uniwersalnego retrievera.
Pozycja w rankingu pozwala uniknąć porównywania niezgodnych surowych wyników
Wyniki BM25, podobieństwa cosinusowe, wzmocnienia metadanych i wyspecjalizowane wyniki wyszukiwania nie mają wspólnej, naturalnej skali liczbowej. Wynik 8 z jednego systemu nie jest z definicji dwa razy bardziej trafny niż wynik 4 z innego.
Analiza hybrydowego wyszukiwania pokazuje, że fuzja rankingów pozwala uniknąć bezpośredniej kalibracji wyników, wykorzystując pozycję każdego dokumentu na jego własnej liście wyników.
Ułatwia to wdrażanie warstwy fuzji w prywatnych indeksach, których rozkłady wyników zmieniają się po aktualizacji dokumentów, embeddingów lub analizatorów wyszukiwania.
Kompromis polega na tym, że fuzja rankingów odrzuca część informacji zawartych w różnicach między surowymi wynikami. Dokument zajmujący pierwsze miejsce z niewielką przewagą oraz dokument zdecydowanie najlepszy w danej liście wnoszą z niej podobny wkład.
Zgodność między listami podnosi pozycję solidnych kandydatów
Fragment, który pojawia się wysoko zarówno w wynikach słów kluczowych, jak i wyszukiwania semantycznego, otrzymuje wkład z obu list. Fragment obecny tylko na jednej liście również może uzyskać wysoką pozycję, ale brakuje mu wzmocnienia wynikającego ze zgodności różnych retrieverów.
Reciprocal Rank Fusion przypisuje odwrotny wkład rankingowy z każdej listy, na której pojawia się dany dokument.
W prywatnym wyszukiwaniu może to promować dowody zawierające zarówno dokładny element gospodarstwa domowego, jak i szerszą odpowiedź semantyczną. Może też zmniejszyć zależność od jednego modelu embeddingów lub jednego analizatora leksykalnego.
Głębokość listy kandydatów i stała rankingu kontrolują wpływ każdej listy
Fuzja nadal wymaga podjęcia decyzji o liczbie wyników dostarczanych przez każdy retriever oraz o tym, jak szybko wyniki z niższych pozycji tracą wpływ. Płytka lista może pomijać uzupełniające dowody, natomiast bardzo głęboka lista wprowadza więcej słabych kandydatów.
Badania i ocena RRF w OpenSearch opisują wpływ stałej rankingu na to, jak silnie preferowane są wczesne pozycje względem późniejszych.
Mniejsza stała zapewnia większą dominację najwyższym pozycjom. Większa stała rozkłada wpływ dalej w dół każdej listy, co może poprawić pełność wyszukiwania, ale zmniejszyć różnicę między rozstrzygającymi a marginalnymi dopasowaniami.
Prywatne kolekcje powinny dostrajać głębokość listy kandydatów na podstawie rzeczywistych pytań, zamiast kopiować publiczną konfigurację wyszukiwania, której rozmiar korpusu i styl dokumentów są inne.
Fuzja poprawia pełność wyszukiwania, ale może też łączyć słabości
Fuzja rankingów nie potrafi określić, czy jeden z retrieverów jest systematycznie słaby dla określonego typu dokumentów. Zaszumiony indeks OCR, słaby model embeddingów lub zbyt szerokie zapytanie o metadane mogą wielokrotnie dodawać nieistotnych kandydatów.
Badania kontrolowane nad fuzją wykazały, że parametry fuzji mają znaczenie oraz że wyuczone kombinacje wyników mogą przewyższać RRF, gdy dostępne są reprezentatywne dane treningowe.
W kilku listach mogą też pojawiać się niemal identyczne fragmenty, wypierając niezależne dowody. Po fuzji mogą być potrzebne deduplikacja, grupowanie według dokumentu nadrzędnego, ograniczenia metadanych i reguły różnorodności.
Fuzja rankingów jest najbardziej użyteczna jako solidna metoda domyślna, gdy brakuje oznaczonych danych dotyczących prywatnego wyszukiwania. Nie oznacza to jednak, że każdy retriever ma prawo do takiego samego poziomu zaufania.
Oceń fuzję, zanim model odpowiedzi ukryje błędy wyszukiwania
Utwórz zestaw testowy zawierający dokładne identyfikatory, sparafrazowane fakty, wartości z tabel, sprzeczne wersje plików oraz pytania wymagające dowodów z różnych formatów dokumentów. Dla każdego zapytania oznacz pełny fragment źródłowy.
prywatny proces wyszukiwania dokumentów ZimaSpace rozdziela jakość ekstrakcji, dzielenia na fragmenty, wyszukiwania i cytowania, dzięki czemu dobra odpowiedź nie może ukryć słabej listy dowodów.
Porównaj wyniki wyłącznie leksykalne, wyłącznie semantyczne, po fuzji oraz po fuzji i rerankingu, korzystając z miar takich jak pełność wyszukiwania, MRR lub nDCG, kompletność dowodów, współczynnik duplikatów, opóźnienie i zużycie pamięci.
Fuzja rankingów poprawia system, gdy konsekwentnie wprowadza właściwe prywatne dowody do zbioru kandydatów, nie dodając więcej opóźnień ani szumu, niż późniejszy reranker jest w stanie obsłużyć.
Centrum Technologii i Sztucznej Inteligencji
Więcej do przeczytania

Jakie funkcje umożliwiają utworzenie domowej granicy zaufania AI wokół wrażliwych plików?
Domowa granica zaufania dla AI łączy szyfrowanie danych w spoczynku, uprawnienia zgodne z zasadą najmniejszych przywilejów, sandboxing w czasie działania oraz zakresowe pobieranie danych...

Co powoduje, że prywatne wyniki wyszukiwania faworyzują często edytowane pliki?
Często edytowane pliki zyskują przewagę w rankingu, gdy każda aktualizacja dodaje sygnały świeżości, fragmentów, wersji lub interakcji bez normalizacji względem źródła.

Co powoduje, że modele obecności w inteligentnym domu mylą gości z mieszkańcami?
Goście mogą wyglądać jak domownicy, gdy system obserwuje wzorce aktywności gospodarstwa domowego, ale nie ma stabilnego sygnału tożsamości osoby, która je generuje.

