Jak fuzja rankingów poprawia prywatne wyszukiwanie na domowym serwerze AI?

Eva Wong jest Technicznym pisarzem i stałym majsterkowiczem w ZimaSpace. Całe życie geek z pasją do homelabów i oprogramowania open-source, specjalizuje się w tłumaczeniu skomplikowanych koncepcji technicznych na przystępne, praktyczne przewodniki. Eva wierzy, że samodzielne hostowanie powinno być zabawą, a nie czymś onieśmielającym. Poprzez swoje samouczki umożliwia społeczności rozwiewanie tajemnic konfiguracji sprzętu, od budowy pierwszego NAS po opanowanie kontenerów Docker.

Fuzja rankingów poprawia prywatne wyszukiwanie AI w domu, łącząc uzupełniające się listy wyników na podstawie pozycji w rankingu, zamiast polegać wyłącznie na jednym sygnale wyszukiwania.

Baza wiedzy gospodarstwa domowego może zawierać dokładne nazwy plików, numery modeli, sparafrazowane notatki, zeskanowane instrukcje, wiersze tabel, paragony i zapisy rozmów. Wyszukiwanie słów kluczowych jest skuteczne, gdy zapytanie zawiera dosłowne terminy występujące w dokumencie, podczas gdy wyszukiwanie semantyczne może odnaleźć fragmenty wyrażające tę samą ideę w inny sposób. Filtry metadanych i wyspecjalizowane indeksy dostarczają kolejnych list. Fuzja rankingów tworzy jeden wspólny porządek na podstawie tych niezależnych wyszukiwań, pozwalając prywatnemu serwerowi zachować różne mocne strony poszczególnych metod, zanim kandydaci trafią do wolniejszego rerankera lub modelu generującego odpowiedź.

Różne retrievery ujawniają różne rodzaje dowodów

Wyszukiwanie leksykalne preferuje dokładne terminy, rzadkie identyfikatory, daty i frazy. Wyszukiwanie gęste preferuje podobieństwo semantyczne, nawet gdy brzmienie zapytania się zmienia. Prywatny system wyszukiwania często potrzebuje obu metod, ponieważ domowe dokumenty zawierają zarówno język naturalny, jak i dokładne szczegóły techniczne.

Oryginalne badanie dotyczące Reciprocal Rank Fusion wykazało, że wiele systemów rankingowych można łączyć bez trenowania nowego modelu trafności dla każdej kolekcji.

Jedna lista może znaleźć numer modelu routera, a inna — akapit dotyczący rozwiązywania problemów, który opisuje ten sam objaw bez podawania nazwy modelu. Fuzja utrzymuje aktywność obu ścieżek wyszukiwania, zamiast zmuszać serwer do wyboru jednego uniwersalnego retrievera.

Pozycja w rankingu pozwala uniknąć porównywania niezgodnych surowych wyników

Wyniki BM25, podobieństwa cosinusowe, wzmocnienia metadanych i wyspecjalizowane wyniki wyszukiwania nie mają wspólnej, naturalnej skali liczbowej. Wynik 8 z jednego systemu nie jest z definicji dwa razy bardziej trafny niż wynik 4 z innego.

Analiza hybrydowego wyszukiwania pokazuje, że fuzja rankingów pozwala uniknąć bezpośredniej kalibracji wyników, wykorzystując pozycję każdego dokumentu na jego własnej liście wyników.

Ułatwia to wdrażanie warstwy fuzji w prywatnych indeksach, których rozkłady wyników zmieniają się po aktualizacji dokumentów, embeddingów lub analizatorów wyszukiwania.

Kompromis polega na tym, że fuzja rankingów odrzuca część informacji zawartych w różnicach między surowymi wynikami. Dokument zajmujący pierwsze miejsce z niewielką przewagą oraz dokument zdecydowanie najlepszy w danej liście wnoszą z niej podobny wkład.

Zgodność między listami podnosi pozycję solidnych kandydatów

Fragment, który pojawia się wysoko zarówno w wynikach słów kluczowych, jak i wyszukiwania semantycznego, otrzymuje wkład z obu list. Fragment obecny tylko na jednej liście również może uzyskać wysoką pozycję, ale brakuje mu wzmocnienia wynikającego ze zgodności różnych retrieverów.

Reciprocal Rank Fusion przypisuje odwrotny wkład rankingowy z każdej listy, na której pojawia się dany dokument.

W prywatnym wyszukiwaniu może to promować dowody zawierające zarówno dokładny element gospodarstwa domowego, jak i szerszą odpowiedź semantyczną. Może też zmniejszyć zależność od jednego modelu embeddingów lub jednego analizatora leksykalnego.

Głębokość listy kandydatów i stała rankingu kontrolują wpływ każdej listy

Fuzja nadal wymaga podjęcia decyzji o liczbie wyników dostarczanych przez każdy retriever oraz o tym, jak szybko wyniki z niższych pozycji tracą wpływ. Płytka lista może pomijać uzupełniające dowody, natomiast bardzo głęboka lista wprowadza więcej słabych kandydatów.

Badania i ocena RRF w OpenSearch opisują wpływ stałej rankingu na to, jak silnie preferowane są wczesne pozycje względem późniejszych.

Mniejsza stała zapewnia większą dominację najwyższym pozycjom. Większa stała rozkłada wpływ dalej w dół każdej listy, co może poprawić pełność wyszukiwania, ale zmniejszyć różnicę między rozstrzygającymi a marginalnymi dopasowaniami.

Prywatne kolekcje powinny dostrajać głębokość listy kandydatów na podstawie rzeczywistych pytań, zamiast kopiować publiczną konfigurację wyszukiwania, której rozmiar korpusu i styl dokumentów są inne.

Fuzja poprawia pełność wyszukiwania, ale może też łączyć słabości

Fuzja rankingów nie potrafi określić, czy jeden z retrieverów jest systematycznie słaby dla określonego typu dokumentów. Zaszumiony indeks OCR, słaby model embeddingów lub zbyt szerokie zapytanie o metadane mogą wielokrotnie dodawać nieistotnych kandydatów.

Badania kontrolowane nad fuzją wykazały, że parametry fuzji mają znaczenie oraz że wyuczone kombinacje wyników mogą przewyższać RRF, gdy dostępne są reprezentatywne dane treningowe.

W kilku listach mogą też pojawiać się niemal identyczne fragmenty, wypierając niezależne dowody. Po fuzji mogą być potrzebne deduplikacja, grupowanie według dokumentu nadrzędnego, ograniczenia metadanych i reguły różnorodności.

Fuzja rankingów jest najbardziej użyteczna jako solidna metoda domyślna, gdy brakuje oznaczonych danych dotyczących prywatnego wyszukiwania. Nie oznacza to jednak, że każdy retriever ma prawo do takiego samego poziomu zaufania.

Oceń fuzję, zanim model odpowiedzi ukryje błędy wyszukiwania

Utwórz zestaw testowy zawierający dokładne identyfikatory, sparafrazowane fakty, wartości z tabel, sprzeczne wersje plików oraz pytania wymagające dowodów z różnych formatów dokumentów. Dla każdego zapytania oznacz pełny fragment źródłowy.

prywatny proces wyszukiwania dokumentów ZimaSpace rozdziela jakość ekstrakcji, dzielenia na fragmenty, wyszukiwania i cytowania, dzięki czemu dobra odpowiedź nie może ukryć słabej listy dowodów.

Porównaj wyniki wyłącznie leksykalne, wyłącznie semantyczne, po fuzji oraz po fuzji i rerankingu, korzystając z miar takich jak pełność wyszukiwania, MRR lub nDCG, kompletność dowodów, współczynnik duplikatów, opóźnienie i zużycie pamięci.

Fuzja rankingów poprawia system, gdy konsekwentnie wprowadza właściwe prywatne dowody do zbioru kandydatów, nie dodając więcej opóźnień ani szumu, niż późniejszy reranker jest w stanie obsłużyć.

Centrum Technologii i Sztucznej Inteligencji

Więcej do przeczytania

Get More Builds Like This

Stay in the Loop

Get updates from Zima - new products, exclusive deals, and real builds from the community.

Stay in the Loop preferences

We respect your inbox. Unsubscribe anytime.