메모리 순위 지정에서 반복된 오래된 사실을 더 강력한 증거로 취급하고, 충돌하는 기록 간의 명시적인 대체 관계가 없으면 최근 수정 사항이 무시될 수 있습니다.
가정용 에이전트가 여러 요약, 대화, 메모리에 기존 비밀번호를 저장한 뒤 “게스트 Wi-Fi 비밀번호가 변경됐어”라는 말을 한 번 들을 수 있습니다. 이후 쿼리는 반드시 가장 최근의 사실이 아니라 점수가 가장 높은 메모리를 검색합니다. 버전, 출처, 충돌 처리 로직이 없으면 반복이 최신성을 압도하여 수정 사항이 현재의 약한 예외처럼 보일 수 있습니다.
반복된 메모리는 검색 우위를 축적합니다
메모리 시스템은 관찰 내용, 요약, 추출된 사실을 별도의 항목으로 저장하는 경우가 많습니다. 하나의 사실을 반복하면 의미적으로 유사한 벡터가 여러 개 생성되므로 쿼리에서 동일한 내용이 여러 번 반환될 수 있습니다. 겉으로 보이는 일치는 중복에 불과하지만, 후속 모델은 이를 상호 검증으로 해석할 수 있습니다.
메모리 최신성에 관한 실용적인 개요에서는 대화 상태, 검색, 최신성, 출처, 삭제를 서로 다른 설계 문제로 구분합니다. 메모리를 하나의 구분되지 않은 유사도 인덱스로 취급하면 모순된 사실을 해결하는 데 필요한 관계가 가려집니다. 이러한 구분은 최종 가정용 의사결정을 바꿉니다.
그 결과 빈도 편향이 발생합니다. 오래된 메모리 다섯 개가 컨텍스트를 차지하는 동안 하나의 수정 사항은 컷오프 아래로 밀려납니다. top-k를 늘리면 충돌이 드러날 수 있지만, 어떤 기록을 기준으로 삼아야 하는지는 알려 주지 못합니다.
수정 사항에는 단순한 새 타임스탬프가 아니라 대체 관계가 필요합니다
견고한 저장소는 특정 주제, 술어, 범위, 유효 시간을 기준으로 사실 B가 사실 A를 대체한다는 점을 표현합니다. 기존 기록은 이력을 위해 남겨 둘 수 있지만, 현재 검색에서는 이를 필터링하거나 가중치를 낮춥니다. 출처 정보에는 누가 이를 수정했는지와 어떤 권위 있는 사건에서 비롯되었는지가 기록됩니다.
암묵적 메모리 충돌에 관한 연구에서는 명시적인 부정을 사용하지 않고 새로운 관찰이 기존 메모리를 무효화하는 암묵적 충돌을 확인합니다. “우리는 덴버로 이사했어”라는 말은 “더 이상 오스틴에 살지 않아”라고 직접 말하지 않더라도 현재 거주지를 바꿉니다.
최신성만으로는 충분하지 않습니다. 일부 오래된 사실은 여전히 유효하고, 일부 새로운 진술은 일시적이거나 잘못되었기 때문입니다. 대체 관계는 시간에 의미적 관계, 권위, 범위를 결합하여 시스템이 이력을 보존하면서도 이를 현재의 진실로 제시하지 않도록 합니다.
자동 충돌 해결이 위험해지는 경우
모델은 직장 주소와 집 주소, 일시적인 일정과 지속적인 선호처럼 서로 다른 두 사실을 모순된 것으로 잘못 식별할 수 있습니다. 오래된 항목을 자동으로 삭제하면 유용한 맥락이 사라지고 나중에 수정 사항을 감사하기도 어려워질 수 있습니다.
메모리 통합에 관한 개요에서는 단기 계층과 장기 계층을 구분하고, 두 계층 사이의 통제된 이동을 강조합니다. 승격, 통합, 망각 정책은 무엇이 유지되는지를 결정하며, 중립적인 저장 작업이 아닙니다. 이 경계는 이후의 증거 검토에서도 계속 드러나야 합니다.
식별자, 범위 또는 권위가 모호하면 이 메커니즘은 실패합니다. 이러한 경계에서는 두 기록을 모두 보존하고 충돌을 표시한 뒤 명확한 설명을 요청해야 합니다. 사용자가 편집할 수 있는 메모리 저장소는 다른 모델의 추론에 의존하지 않고 수정, 병합, 분할, 삭제를 허용해야 합니다.
메모리 대체 관계 테스트 실행
하나의 사실을 만들고, 서로 다른 표현을 사용한 세 번의 상호작용에서 이를 반복한 다음, 유효 날짜가 포함된 명확한 수정 사항을 제공합니다. 직접 쿼리하고, 바꿔 표현한 쿼리를 사용하며, 해당 사실에 의존하는 작업을 통해 쿼리합니다. 검색된 메모리 ID, 점수, 타임스탬프, 최종 작업을 기록합니다.
사용자 편집 가능 메모리에서 권장하는 것처럼 메모리를 사용자가 편집할 수 있도록 만들고, 정식 사실을 변경했을 때 감사 추적을 삭제하지 않고 후속 검색이 업데이트되는지 확인합니다. 그런 다음 범위가 유지되는지 테스트하기 위해 일시적인 예외를 추가합니다.
현재 쿼리가 수정 사항을 사용하고, 과거에 관한 질문에서는 이전 상태를 여전히 복구할 수 있으며, 모호한 예외가 조용히 덮어쓰기되지 않고 명확한 설명 요청을 유발해야 통과입니다. 메모리 요약 또는 압축 후에도 다시 테스트해야 합니다. 이러한 단계에서 오래된 사실이 다시 생성될 수 있기 때문입니다.
기술 및 AI 허브
더 읽어보기

다국어 임베딩: 하나의 벡터 공간이 여러 언어의 가정용 문서를 연결하는 방법
정렬된 임베딩이 언어 간 문서를 어떻게 연결하는지, 검색 품질이 달라지는 이유와 언어 간 근거 커버리지를 로컬에서 테스트하는 방법을 알아보세요.

비공개 검색 재순위 지정: 두 번째 모델이 최종 근거 순서를 바꾸는 방식
1단계 유사도와 2단계 관련성이 왜 일치하지 않는지, 재순위 지정이 비공개 RAG에 언제 도움이 되는지, 그리고 재정렬된 근거를 평가하는 방법을 알아보세요.

로컬 LLM 샘플링: 디코딩 설정이 반복과 안정성을 바꾸는 이유
temperature, top-p, min-p, 시드, 페널티가 어떻게 상호작용하는지, 그리고 무작위성과 품질을 혼동하지 않고 디코딩 설정을 테스트하는 방법을 알아보세요.

