GUIDA alle applicazioni

Agenti di riflessione e autocorrezione

La riflessione è una tecnica in cui un agente AI riflette per iscritto sui propri fallimenti e inserisce quelle lezioni nel suo prossimo tentativo.

2 minuti di letturaUltimo aggiornamento

Panoramica

It matters because it lets agents improve on a task without retraining the underlying model.

Immersione profonda

La riflessione, introdotta in un articolo del 2023 da Shinn e colleghi, fornisce a un agente un ciclo: tenta di eseguire un compito, riceve un segnale su come ha svolto (il risultato di un test, una ricompensa o una critica), quindi scrive una breve "riflessione" in linguaggio naturale che spiega cosa è andato storto e cosa provare dopo. Quella riflessione viene archiviata in memoria e anteposta al prompt del tentativo successivo. Fondamentalmente, i pesi del modello non cambiano mai; l'apprendimento avviene interamente nella finestra di contesto come testo. Questo "apprendimento per rinforzo verbale" consente agli agenti di ripetere problemi di codifica, navigazione web e attività di ragionamento. Nel benchmark di codifica HumanEval, l'autocorrezione in stile Reflexion ha spinto i tassi di passaggio sostanzialmente più alti rispetto ai tentativi a colpo singolo, semplicemente consentendo all'agente di eseguire il debug dei propri errori in pochi tentativi.

Approfondimento tecnico

La riflessione separa tre ruoli: un attore che genera azioni, un valutatore che assegna un punteggio al risultato (test unitari, un controllo della corrispondenza esatta o un giudice LLM) e un modello di auto-riflessione che trasforma quel punteggio in una lezione testuale. La lezione finisce in un buffer di memoria episodica riutilizzato nella prova successiva. Poiché il feedback è un linguaggio piuttosto che gradienti, non è necessaria alcuna formazione della GPU, ma dipende fortemente da un segnale di valutazione affidabile per evitare di rafforzare riflessioni fiduciose ma sbagliate.

Impatto strategico

Scelte di build

La progettazione a livello di applicazione determina se l’intelligenza artificiale migliora i risultati reali.

Team e flusso di lavoro

Una buona integrazione del flusso di lavoro crea guadagni di produttività di cui gli utenti possono fidarsi.

Rischio e sicurezza

I casi d'uso ben definiti riducono l'affaticamento dovuto al cambiamento e il rischio di implementazione.

Il futuro della riflessione e degli agenti autocorrettivi

L'autocorrezione sta diventando un livello predefinito nei framework degli agenti piuttosto che un trucco di ricerca. Aspettatevi un’integrazione più stretta con i verificatori automatizzati, come sandbox di codice, controllori formali e recupero che confermi i fatti, in modo che le riflessioni siano basate su segnali oggettivi anziché sul modello stesso. Le sfide aperte sono evitare cicli in cui un agente "aggiusta" all'infinito l'output di lavoro, decidendo quando interrompere l'iterazione e impedendo che le riflessioni si trasformino in razionalizzazioni apparentemente plausibili ma non verificate.

Implementazione nel mondo reale

Un agente di codifica che esegue unit test, legge l'asserzione fallita, scrive una nota sul bug e ne modifica il codice prima di rieseguire la suite.

Un assistente di ricerca che coglie una citazione allucinatoria quando un controllo di recupero fallisce, quindi rivede la risposta per utilizzare solo fonti verificate.

Un agente di navigazione web (ad esempio, sui benchmark AlfWorld o WebShop) che registra "Ho fatto clic sul filtro sbagliato" ed evita quel passo falso al nuovo tentativo.

Un risolutore di problemi matematici che controlla la sua risposta finale rispetto a un vincolo, nota un errore di segno e rielabora il passaggio rilevante.

Rischi e guardrail

Automatizzare un processo interrotto può amplificare i problemi esistenti.

I team potrebbero automatizzare eccessivamente e rimuovere il necessario giudizio umano.

La qualità può variare se i risultati non vengono valutati continuamente.

Tabella di marcia per l'implementazione

1

Mappa il flusso di lavoro corrente e identifica la fase di maggiore attrito.

2

Definisci checkpoint umani prima dell'automazione completa.

3

Formare gli utenti su prompt, percorsi di escalation e standard di qualità.

4

Tieni traccia dei risultati a livello di attività per confermare il valore duraturo.

Continua a esplorare

Free newsletter

Get the daily AI briefing

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Take the Reflexion and Self-Correcting Agents quiz

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

Inizia il quiz

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

Prossima guida

Autoriflessione nei cicli degli agenti

Domande frequenti

What is Reflexion and Self-Correcting Agents?

La riflessione è una tecnica in cui un agente AI riflette per iscritto sui propri fallimenti e inserisce quelle lezioni nel suo prossimo tentativo. È importante perché consente agli agenti di migliorare un'attività senza riqualificare il modello sottostante.

Qual è la caratteristica distintiva di come un agente di riflessione "impara"?

La riflessione è talvolta chiamata "apprendimento per rinforzo verbale" perché le lezioni vengono archiviate in memoria come testo in linguaggio naturale, non codificate nei parametri del modello.

Nel quadro della Riflessione, cosa fa il Valutatore?

Il valutatore (un test unitario, un controllo della corrispondenza esatta o un giudice LLM) produce il segnale che la fase di auto-riflessione si trasforma in una lezione testuale.

Perché la qualità del segnale di valutazione è così importante in Reflexion?

Se il valutatore è inaffidabile, l’agente può scrivere riflessioni fiduciose basate su feedback negativi, indirizzando i tentativi futuri nella direzione sbagliata.

In base a quale benchmark l'autocorrezione in stile Reflexion ha migliorato notevolmente la velocità di passaggio della codifica?

HumanEval è un benchmark per la generazione di codice e consentire all'agente di eseguire il debug su più tentativi ha aumentato le percentuali di passaggio ben al di sopra delle prestazioni a colpo singolo.

Qual è un vero rischio aperto con agenti autocorrettivi?

Senza una buona regola di arresto, un agente può continuare a rivedere le risposte corrette, sprecando risorse di calcolo e talvolta degradando il buon output.