애플리케이션 가이드

반사 및 자기 교정 에이전트

Reflexion은 AI 에이전트가 자신의 실패에 대해 글로 반성하고 이러한 교훈을 다음 시도에 다시 적용하는 기술입니다.

2분 읽기마지막 업데이트

개요

It matters because it lets agents improve on a task without retraining the underlying model.

심층 분석

Shinn과 동료들이 2023년 논문에서 소개한 Reflexion은 에이전트에게 루프를 제공합니다. 즉, 작업을 시도하고 어떻게 수행되었는지에 대한 신호(테스트 결과, 보상 또는 비평)를 받은 다음 무엇이 잘못되었고 다음에 무엇을 시도할지 설명하는 짧은 자연 언어 '반사'를 작성합니다. 해당 반영은 메모리에 저장되고 다음 시도 프롬프트 앞에 추가됩니다. 결정적으로 모델의 가중치는 절대 변하지 않습니다. 학습은 전적으로 컨텍스트 창에서 텍스트로 발생합니다. 이 '언어 강화 학습'을 통해 에이전트는 코딩 문제, 웹 탐색 및 추론 작업을 반복할 수 있습니다. HumanEval 코딩 벤치마크에서 Reflexion 스타일의 자체 수정은 에이전트가 몇 번의 시도에 걸쳐 자체 실수를 디버깅하도록 함으로써 단일 시도보다 훨씬 더 높은 통과율을 높였습니다.

기술적 통찰력

Reflexion은 작업을 생성하는 행위자, 결과에 점수를 매기는 평가자(단위 테스트, 정확한 일치 확인 또는 LLM 심사위원), 해당 점수를 텍스트 강의로 바꾸는 자기 성찰 모델의 세 가지 역할을 구분합니다. 수업은 다음 시도에서 재사용되는 에피소드 메모리 버퍼에 저장됩니다. 피드백은 그라디언트가 아닌 언어이기 때문에 GPU 훈련이 필요하지 않지만 자신감 있지만 잘못된 반사를 강화하지 않도록 신뢰할 수 있는 평가 신호에 크게 의존합니다.

전략적 영향

빌드 선택

애플리케이션 수준 설계는 AI가 실제 결과를 개선하는지 여부를 결정합니다.

팀과 워크플로우

훌륭한 워크플로우 통합은 사용자가 신뢰할 수 있는 생산성 향상을 가져옵니다.

위험과 안전

범위가 적절한 사용 사례는 변경 피로도와 구현 위험을 줄여줍니다.

반사 및 자가 교정 에이전트의 미래

자체 수정은 연구 트릭이 아닌 에이전트 프레임워크의 기본 레이어가 되고 있습니다. 코드 샌드박스, 공식 체커, 사실을 확인하는 검색 등 자동화된 검증기와 더욱 긴밀하게 통합되므로 반영은 모델 자체를 추측하는 대신 객관적인 신호에 기초합니다. 공개 과제는 에이전트가 작업 출력을 끝없이 '수정'하는 루프를 피하고, 반복을 중지할 시기를 결정하고, 반영이 그럴듯하지만 검증되지 않은 합리화로 표류하는 것을 방지하는 것입니다.

실제 구현

단위 테스트를 실행하고, 실패한 어설션을 읽고, 버그에 메모를 쓰고, 제품군을 다시 실행하기 전에 해당 코드를 편집하는 코딩 에이전트입니다.

검색 검사에 실패했을 때 환각 인용을 포착한 후 검증된 출처만 사용하도록 답변을 수정하는 연구 조교.

'잘못된 필터를 클릭했습니다'를 기록하고 재시도 시 실수를 방지하는 웹 탐색 에이전트(예: AlfWorld 또는 WebShop 벤치마크)입니다.

제약 조건에 대한 최종 답을 확인하고 부호 오류를 발견하고 관련 단계를 재작업하는 수학 문제 해결사입니다.

위험 및 가드레일

손상된 프로세스를 자동화하면 기존 문제가 증폭될 수 있습니다.

팀은 필요한 인간 판단을 과도하게 자동화하고 제거할 수 있습니다.

출력을 지속적으로 평가하지 않으면 품질이 달라질 수 있습니다.

구현 로드맵

1

현재 워크플로를 매핑하고 마찰이 가장 큰 단계를 식별합니다.

2

완전 자동화 전에 휴먼 체크포인트를 정의하세요.

3

프롬프트, 에스컬레이션 경로, 품질 표준에 대해 사용자를 교육합니다.

4

작업 수준 결과를 추적하여 지속적인 가치를 확인하세요.

계속 탐색하세요

Free newsletter

Get the daily AI briefing

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Take the Reflexion and Self-Correcting Agents quiz

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

퀴즈 시작

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

다음 가이드

에이전트 루프의 자기 성찰

자주 묻는 질문

What is Reflexion and Self-Correcting Agents?

Reflexion은 AI 에이전트가 자신의 실패에 대해 글로 반성하고 이러한 교훈을 다음 시도에 다시 적용하는 기술입니다. 에이전트가 기본 모델을 재교육하지 않고도 작업을 개선할 수 있기 때문에 중요합니다.

Reflexion 에이전트가 '학습'하는 방식의 특징은 무엇입니까?

학습은 모델의 매개변수로 인코딩되지 않고 메모리에 자연어 텍스트로 저장되기 때문에 반사를 '언어 강화 학습'이라고도 합니다.

Reflexion 프레임워크에서 평가자는 무엇을 합니까?

평가자(단위 테스트, 정확한 일치 확인 또는 LLM 심사위원)는 자기 성찰 단계가 텍스트 수업으로 전환된다는 신호를 생성합니다.

Reflexion에서 평가 신호의 품질이 그토록 중요한 이유는 무엇입니까?

평가자가 신뢰할 수 없는 경우 에이전트는 잘못된 피드백을 기반으로 자신감 있는 반성을 작성하여 향후 시도를 잘못된 방향으로 조종할 수 있습니다.

어떤 벤치마크에서 Reflexion 스타일의 자체 수정이 코딩 통과율을 눈에 띄게 향상시켰습니까?

HumanEval은 코드 생성 벤치마크이며, 에이전트가 여러 시도에 걸쳐 디버깅할 수 있도록 하여 단일 실행 성능보다 훨씬 높은 통과율을 높였습니다.

자가 수정 에이전트의 실제 공개 위험은 무엇입니까?

올바른 중지 규칙이 없으면 에이전트가 계속해서 정답을 수정하고 컴퓨팅을 낭비하며 때로는 좋은 결과를 저하시킬 수 있습니다.