DAY 47통합과 확장·계획·행동·관찰
에이전트의 반복 고리
한 번의 답변을 넘어 여러 단계를 수행합니다.
01 / UNDERSTAND
핵심 개념
에이전트는 목표를 받고 도구를 실행한 결과를 관찰하며 다음 행동을 정하는 반복 구조로 만들 수 있습니다. 한 단계의 관찰이 다음 단계의 입력이 됩니다.
단계가 늘수록 잘못된 중간 판단이 누적될 수 있습니다. 종료 조건, 도구 권한, 결과 검증을 설계해야 합니다.
에이전트는 행동과 관찰을 반복합니다.
02 / WORKED EXAMPLE∑
작은 숫자로 따라가기
01
‘회의 시간을 찾기’ 목표를 받습니다.
02
달력을 조회하고 가능한 시간을 관찰합니다.
03
선택 기준을 적용해 후보를 제안하고 종료합니다.
03 / EXPLORE
직접 실험해 보기
행동 단계 하나를 건너뛰면 최종 결과가 어떻게 달라지는지 생각해 보세요.
LIVE EXPERIMENT · 05
단계를 눌러 흐름 따라가기
목표
해야 할 일을 구체적으로 정합니다.
YOUR NOTES · 3 MIN
메모는 이 브라우저에만 저장됩니다.오늘의 변화를 내 말로 설명하기
무엇을 조작했나요? 어떤 숫자나 그림이 달라졌나요? 그 이유는 무엇인가요?
04 / CHECK YOURSELF
오늘의 이해 확인
에이전트의 관찰이 필요한 이유는?
FURTHER READING
개념 원문
오늘의 작은 숫자 예제는 이 강의를 위해 작성했습니다. 아래 자료에서 실제 연구와 구현 설명을 확인할 수 있습니다.
ReAct: Synergizing Reasoning and Acting in Language ModelsYao et al. (2022)이 자료는 개념 학습용입니다. 실제 모델의 구조와 학습 설정은 구현마다 다를 수 있습니다.