GUÍA de aplicaciones

Agentes de reflexión y autocorrección

La reflexión es una técnica en la que un agente de IA reflexiona por escrito sobre sus propios fracasos y retroalimenta esas lecciones en su próximo intento.

2 minutos de lecturaÚltima actualización

Descripción general

It matters because it lets agents improve on a task without retraining the underlying model.

Buceo profundo

La reflexión, introducida en un artículo de 2023 por Shinn y sus colegas, le da al agente un bucle: intenta una tarea, recibe una señal sobre cómo lo hizo (el resultado de una prueba, una recompensa o una crítica) y luego escribe una breve "reflexión" en lenguaje natural explicando qué salió mal y qué intentar a continuación. Ese reflejo se almacena en la memoria y se antepone al mensaje del siguiente intento. Fundamentalmente, los pesos del modelo nunca cambian; el aprendizaje ocurre completamente en la ventana de contexto como texto. Este "aprendizaje por refuerzo verbal" permite a los agentes repetir problemas de codificación, navegación web y tareas de razonamiento. En el punto de referencia de codificación HumanEval, la autocorrección estilo Reflexion impulsó las tasas de aprobación sustancialmente más altas que los intentos de un solo disparo, simplemente permitiendo que el agente depurara sus propios errores en unos pocos intentos.

Información técnica

La reflexión separa tres roles: un actor que genera acciones, un evaluador que califica el resultado (pruebas unitarias, una verificación de coincidencia exacta o un juez de LLM) y un modelo de autorreflexión que convierte esa puntuación en una lección textual. La lección aterriza en un buffer de memoria episódica que se reutiliza en la siguiente prueba. Debido a que la retroalimentación es lenguaje en lugar de gradientes, no se necesita entrenamiento de GPU, pero depende en gran medida de una señal de evaluación confiable para evitar reforzar reflexiones seguras pero incorrectas.

Impacto Estratégico

Construir opciones

El diseño a nivel de aplicación determina si la IA mejora los resultados reales.

Equipo y flujo de trabajo

Una buena integración del flujo de trabajo genera ganancias de productividad en las que los usuarios pueden confiar.

Riesgo y seguridad

Los casos de uso bien definidos reducen la fatiga del cambio y el riesgo de implementación.

El futuro de la reflexión y los agentes autocorrectores

La autocorrección se está convirtiendo en una capa predeterminada en los marcos de los agentes en lugar de un truco de investigación. Espere una integración más estrecha con verificadores automatizados, como zonas de pruebas de código, verificadores formales y recuperación que confirme hechos, de modo que las reflexiones se basen en señales objetivas en lugar de que el modelo se cuestione a sí mismo. Los desafíos pendientes son evitar bucles en los que un agente "arregla" interminablemente el resultado del trabajo, decidir cuándo dejar de iterar y evitar que las reflexiones deriven en racionalizaciones que suenan plausibles pero no verificadas.

Implementación en el mundo real

Un agente de codificación que ejecuta pruebas unitarias, lee la afirmación fallida, escribe una nota sobre el error y edita su código antes de volver a ejecutar la suite.

Un asistente de investigación que detecta una cita alucinada cuando falla una verificación de recuperación y luego revisa la respuesta para utilizar solo fuentes verificadas.

Un agente de navegación web (por ejemplo, en los puntos de referencia de AlfWorld o WebShop) que registra "Hice clic en el filtro incorrecto" y evita ese paso en falso al volver a intentarlo.

Un solucionador de problemas matemáticos que compara su respuesta final con una restricción, detecta un error de signo y vuelve a trabajar en el paso correspondiente.

Riesgos y barandillas

Automatizar un proceso roto puede amplificar los problemas existentes.

Los equipos pueden automatizar demasiado y eliminar el juicio humano necesario.

La calidad puede variar si los resultados no se evalúan continuamente.

Hoja de ruta de implementación

1

Mapee el flujo de trabajo actual e identifique el paso de mayor fricción.

2

Defina puntos de control humanos antes de la automatización total.

3

Capacite a los usuarios sobre indicaciones, rutas de escalada y estándares de calidad.

4

Realice un seguimiento de los resultados a nivel de tarea para confirmar el valor sostenido.

Sigue explorando

Free newsletter

Get the daily AI briefing

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Take the Reflexion and Self-Correcting Agents quiz

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

Iniciar prueba

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

Siguiente guía

Autorreflexión en bucles de agentes

Preguntas frecuentes

What is Reflexion and Self-Correcting Agents?

La reflexión es una técnica en la que un agente de IA reflexiona por escrito sobre sus propios fracasos y retroalimenta esas lecciones en su próximo intento. Es importante porque permite a los agentes mejorar una tarea sin volver a entrenar el modelo subyacente.

¿Cuál es la característica definitoria de cómo "aprende" un agente de Reflexión?

A la reflexión a veces se le llama "aprendizaje por refuerzo verbal" porque las lecciones se almacenan como texto en lenguaje natural en la memoria, no codificadas en los parámetros del modelo.

En el marco de Reflexión, ¿qué hace el Evaluador?

El evaluador (una prueba unitaria, una verificación de coincidencia exacta o un juez de LLM) produce la señal de que el paso de autorreflexión se convierte en una lección textual.

¿Por qué la calidad de la señal de evaluación es tan importante en Reflexion?

Si el evaluador no es confiable, el agente puede escribir reflexiones confiadas basadas en malos comentarios, dirigiendo futuros intentos en la dirección equivocada.

¿En qué punto de referencia la autocorrección estilo Reflexion mejoró notablemente las tasas de aprobación de codificación?

HumanEval es un punto de referencia de generación de código y permitir que el agente depure en múltiples intentos elevó las tasas de aprobación muy por encima del rendimiento de un solo disparo.

¿Cuál es un verdadero riesgo abierto con los agentes autocorrectores?

Sin una buena regla de detención, un agente puede seguir revisando las respuestas correctas, desperdiciando cálculo y, en ocasiones, degradando un buen resultado.