에이전트 루프 — ReAct, 그리고 모델이 반복하게 두는 비용
추론-행동-관찰 루프는 모델이 여러 단계에 걸쳐 계획하고 도구를 호출하고 결과에 반응하게 하며, 이는 실제 과제를 열지만 잘못되거나 비용이 폭주할 수 있는 경로를 배가시킵니다.
아직 만들지 않았습니다
이 페이지는 카드에 적힌 내용을 펼쳐 보여줄 뿐입니다 — 돌아가는 코드도, 열어볼 데모도 아직 없습니다. 무엇을 왜 만들려는지가 아래에 있습니다.
어떻게 보나
아직 범위 미정.
기술 노트
각 항목이 실제로 무엇을 보여주고 어떻게 동작하는지 — 위 카드보다 자세한 기술 설명입니다.
에이전트 루프 — ReAct, 그리고 모델이 반복하게 두는 비용준비 중
목적: 이 PoC는 단계·비용 예산을 둔 다단계 과제에서 작은 ReAct 에이전트를 돌려, 계획이 아니라 종료와 가드레일을 어려운 부분으로 다룹니다.
동작 방식: 아직 만들지 않음.