실행 증거가 없거나 모호하거나 잊혔거나 재계획에 사용되는 상태에서 제외되면 에이전트 플래너는 완료된 단계를 반복합니다.
홈 AI 에이전트가 폴더를 만들고 확인한 다음, 몇 차례의 대화가 지나 같은 폴더를 다시 만들 수 있습니다. 도구가 부분적인 성공을 반환하거나, 체크포인트에 완료 상태가 누락되거나, 원래 계획은 유지된 채 컨텍스트 압축으로 관찰 내용이 사라질 수 있습니다. 시간 초과나 재시작 후 플래너는 목표가 충족되지 않았다고 판단하고, 불완전한 상태에서 같은 단계를 합리적으로 다시 예약합니다.
완료는 실제 환경에 존재하지만 내구성 상태에는 없음
결과가 기록되기 전에 프로세스가 중단되더라도 작업은 성공할 수 있습니다. 메모리 내 체크리스트는 재시작 시 사라지고, 플래너와 실행기의 별도 저장소가 원자적으로 업데이트되지 않으면 계획이 대기 중으로 남을 수 있습니다. 이러한 차이는 이후 가정 환경 테스트에서도 계속 드러납니다.
내구성 있는 에이전트 상태에 대한 개요는 재개, 감사 및 장기 실행 작업에 외부의 내구성 있는 상태가 필요한 이유를 설명합니다. 완료된 도구의 부작용과 누락되었거나 더 오래된 체크포인트가 함께 나타나는 것이 대표적인 신호입니다. 자동화가 진행되기 전에 중간 결과를 계속 검사할 수 있어야 합니다.
문장 형태의 메모리를 저장하는 것은 안정적인 단계 ID, 작업 요약, 결과 및 커밋된 상태를 기록하는 것보다 취약합니다. 플래너에는 완료되었다고 말하는 이전 문장만이 아니라 기계적으로 확인 가능한 완료 상태가 필요합니다. 이러한 경계는 현실적인 운영 조건에서 별도로 측정해야 합니다.
모호한 도구 결과와 컨텍스트 손실이 진행 상황을 숨김
도구는 부분적인 성공, 비동기 작업 ID, 빈 출력 또는 커밋 후 시간 초과를 반환할 수 있습니다. 하네스가 해당 관찰 내용을 잘라내거나 요약하거나 잘못 표시하거나 첨부하지 못하면, 다음 모델 호출에는 결정적인 증거 없이 계획만 전달됩니다.
에이전트 작업 반복에 대한 가이드는 에이전트 루프가 더 이상 진행되지 않을 때 반복 작업이 핵심적인 실패라는 점을 설명합니다. 유용한 진단 기준은 최신 계획 컨텍스트에 정규화된 성공 증거와 변경된 실제 상태가 포함되어 있는지 여부입니다.
모델이 명확한 완료 상태를 받았는데도 계속 반복한다면 플래너의 추론이나 작업 분해에 문제가 있는 것입니다. 증거가 모델에 도달하지 않는다면 프롬프트를 변경해도 데이터 경로를 복구할 수 없습니다. 여러 소스가 제한된 컨텍스트를 두고 경쟁할 때 이러한 결과가 실제로 나타납니다.
재시도와 재계획은 멱등적이지 않은 작업을 중복 실행할 수 있음
일반적인 재시도 정책은 전송 오류 후 전체 단계를 반복할 수 있고, 재계획은 새 단계 ID로 의미상 동일한 작업을 생성할 수 있습니다. 취약한 중지 조건은 목표가 이미 충족된 후에도 루프가 계속되게 합니다.
추론 및 행동 피드백 패턴은 추론, 행동 및 환경 관찰을 번갈아 수행하여 이후의 의사 결정에서 도구 증거를 활용할 수 있게 합니다. 이러한 피드백이나 종료 테스트가 불완전하면 반복이 발생합니다. 이 의존성은 최종 인터페이스에 명시적으로 남겨야 합니다.
실패의 경계는 의도적인 확인 단계 또는 멱등적 조정입니다. 상태를 다시 읽는 것은 중복 작업이 아니지만, 새로운 증거 없이 결제, 삭제, 메시지 전송 또는 되돌릴 수 없는 변경을 반복하는 것은 중복 작업입니다. 따라서 결과는 원래 증거와 대조하여 확인해야 합니다.
단계 ID, 증거 및 중지 조건 감사
계획 버전, 안정적인 단계 ID, 작업 요약, 사전 조건, 도구 호출 ID, 멱등성 키, 시작 및 커밋 시간, 원시 결과, 정규화된 상태, 체크포인트 버전, 컨텍스트 포함 여부, 재시도 이유, 재계획 매핑, 실제 상태 확인 및 종료 결정을 추적합니다. 이러한 차이는 이후 가정 환경 테스트에서도 계속 드러납니다.
에이전트 루프 진단과 이 패턴을 비교합니다. 성공 후 응답 손실, 부분적인 성공, 체크포인트 이전의 재시작, 컨텍스트 압축, 하나의 오래된 대기 단계가 남은 목표 완료 상황을 시뮬레이션합니다. 자동화가 진행되기 전에 중간 결과를 계속 검사할 수 있어야 합니다.
복구된 에이전트가 변경 전에 실제 상태를 조정하고, 멱등성 키를 재사용하며, 재계획된 작업을 이전 단계에 매핑하고, 목표 조건이 충족되면 중지할 때 통과로 간주합니다. 재시도 횟수를 제한하고 반복할 수 없는 작업을 다시 수행하기 전에 승인을 요구합니다. 이러한 경계는 현실적인 운영 조건에서 별도로 측정해야 합니다.
기술 및 AI 허브
더 읽어보기

AI 에이전트 하위 프로세스 내부에서만 권한 오류가 발생하는 원인은 무엇인가요?
서브프로세스에서만 발생하는 거부를 진단하려면 부모와 자식의 ID, 파일 시스템 뷰, 환경, 기능, 보안 정책, 실행 파일 경로를 비교하세요.

하드웨어 트랜스코딩과 비디오 AI를 함께 실행할 때 CPU 포화가 발생하는 원인은 무엇인가요?
코덱 오프로딩, 픽셀 변환, 프레임 복사, AI 전처리, 오디오, 자막, 스토리지 및 프로세스 스케줄링 전반에서 CPU 포화 상태를 추적하세요.

동일한 로컬 LLM이 일관되지 않은 JSON 스키마를 반환하는 원인은 무엇인가요?
모델 경로, 프롬프트, 스키마, 디코더 제약 조건, 샘플링, 컨텍스트, 중지 조건 및 복구 계층을 고정하여 일관되지 않은 로컬 JSON의 원인을 진단하세요.

