Un agente pianificatore ripete i passaggi completati quando le prove dell'esecuzione sono assenti, ambigue, dimenticate o escluse dallo stato utilizzato per la ripianificazione.
Un agente IA domestico può creare una cartella, verificarla e poi ricrearla diversi turni più tardi. Lo strumento può restituire un successo parziale, il checkpoint può omettere il completamento oppure la compressione del contesto può rimuovere l'osservazione preservando il piano originale. Dopo un timeout o un riavvio, il pianificatore vede un obiettivo non soddisfatto e programma razionalmente lo stesso passaggio partendo da uno stato incompleto.
Il completamento esiste nel mondo, ma non nello stato persistente
Un'azione può avere esito positivo mentre il processo si arresta prima di registrarne il risultato. Le checklist in memoria scompaiono al riavvio e gli archivi separati del pianificatore e dell'esecutore possono aggiornarsi in modo non atomico, lasciando il piano contrassegnato come in sospeso. Questa distinzione resta visibile durante i successivi test domestici.
Una panoramica sullo stato persistente degli agenti spiega perché sia necessario uno stato persistente esterno per la ripresa, l'audit e le attività di lunga durata. Il segnale caratteristico è un effetto collaterale dello strumento completato associato a un checkpoint assente o più vecchio. Il risultato intermedio deve restare ispezionabile prima che l'automazione proceda.
Persistire la memoria in forma discorsiva è meno efficace che registrare un ID di passaggio stabile, un digest dell'azione, il risultato e lo stato confermato. Il pianificatore ha bisogno di un completamento verificabile automaticamente, non solo di una frase precedente che afferma che l'operazione è terminata. Questo confine dovrebbe essere misurato separatamente in condizioni operative realistiche.
Risultati ambigui degli strumenti e perdita del contesto nascondono i progressi
Gli strumenti possono restituire un successo parziale, ID di job asincroni, un output vuoto o un timeout dopo aver confermato l'operazione. L'harness può troncare, riassumere, etichettare erroneamente o non allegare quell'osservazione, così la chiamata successiva al modello riceve il piano senza prove decisive.
Una guida sulle azioni ripetute degli agenti identifica la ripetizione dell'azione come un errore fondamentale quando il ciclo dell'agente smette di avanzare. La diagnosi utile consiste nel verificare se il contesto di pianificazione più recente contiene prove normalizzate del successo e uno stato del mondo modificato.
Se il modello riceve uno stato di completamento chiaro e continua comunque a ripetere l'azione, la responsabilità è del ragionamento del pianificatore o della scomposizione dell'attività. Se le prove non lo raggiungono mai, modificare i prompt non può riparare il percorso dei dati. La conseguenza pratica emerge quando diverse fonti competono per uno spazio di contesto limitato.
I tentativi e la ripianificazione possono duplicare attività non idempotenti
Una politica generica di nuovi tentativi può ripetere l'intero passaggio dopo un errore di trasporto, mentre la ripianificazione genera un'azione semanticamente identica con un nuovo ID di passaggio. Condizioni di arresto deboli consentono al ciclo di continuare anche dopo che l'obiettivo è già stato raggiunto.
Lo schema di feedback tra ragionamento e azione alterna ragionamento, azione e osservazione dell'ambiente, così le decisioni successive possono utilizzare le prove dello strumento. La ripetizione compare quando quel feedback o il test di terminazione è incompleto. Questa dipendenza dovrebbe restare esplicita nell'interfaccia finale.
Il confine dell'errore è rappresentato da un passaggio intenzionale di verifica o da una riconciliazione idempotente. Rileggere lo stato non è lavoro duplicato; ripetere un addebito, un'eliminazione, un messaggio o una modifica irreversibile senza nuove prove lo è. Il risultato deve quindi essere verificato rispetto alle prove originali.
Verifica l'identità del passaggio, le prove e le condizioni di arresto
Traccia la versione del piano, l'ID di passaggio stabile, il digest dell'azione, la precondizione, l'ID della chiamata allo strumento, la chiave di idempotenza, gli orari di avvio e conferma, il risultato grezzo, lo stato normalizzato, la versione del checkpoint, l'inclusione nel contesto, il motivo del nuovo tentativo, la corrispondenza della ripianificazione, la verifica dello stato del mondo e la decisione di terminazione. Questa distinzione resta visibile durante i successivi test domestici.
Confronta questo schema con la diagnosi dei cicli degli agenti. Simula un successo seguito dalla perdita della risposta, un successo parziale, un riavvio prima del checkpoint, la compattazione del contesto e un obiettivo completato con un passaggio obsoleto ancora in sospeso. Il risultato intermedio deve restare ispezionabile prima che l'automazione proceda.
Considera superato il test quando gli agenti ripristinati riconciliano lo stato del mondo prima della modifica, riutilizzano le chiavi di idempotenza, associano le azioni ripianificate ai passaggi precedenti e si arrestano quando i predicati dell'obiettivo sono soddisfatti. Limita i nuovi tentativi e richiedi approvazione prima di ripetere azioni non ripetibili. Questo confine dovrebbe essere misurato separatamente in condizioni operative realistiche.
Hub Tecnologico e AI
Altro da leggere

Cosa causa gli errori di autorizzazione solo all'interno dei sottoprocessi degli agenti IA?
Confronta l'identità del processo padre e di quello figlio, la vista del filesystem, l'ambiente, le capacità, i criteri di sicurezza e il percorso dell'eseguibile...

Cosa causa la saturazione della CPU quando la transcodifica hardware e l’IA video vengono eseguite insieme?
Monitora la saturazione della CPU tra offload dei codec, conversione dei pixel, copie dei frame, pre-elaborazione dell’IA, audio, sottotitoli, archiviazione e pianificazione dei processi.

Cosa fa sì che lo stesso LLM locale restituisca schemi JSON incoerenti?
Diagnostica il JSON locale incoerente bloccando il percorso del modello, il prompt, lo schema, i vincoli del decoder, il campionamento, il contesto, le condizioni...

