도구 설계의 예술
Think Tool:AI가 먼저 생각하고 행동하게 하기
Agent가 긴 Tool Chain을 실행할 때 이전 정보를 잊거나, 여러 규칙을 동시에 고려해야 할 때 실수를 저지르는 경우가 많습니다. 실증적으로, Agent에게 멈추고 생각하는 도구를 주면 정확도가 크게 향상됩니다.
문제 시나리오:Agent는 왜 실수를 할까요
Tool Chain에서 정보 유실
Agent가 5개의 도구를 호출한 후, 초기 도구가 반환한 핵심 정보가 이후의 방대한 컨텍스트에 묻혀 모델이 더 이상 주목하지 않게 됩니다.
정책 집약적 의사결정
고객 서비스 시나리오에는 환불 정책 20개와 예외 사항 6가지가 있습니다. Agent는 여러 규칙을 동시에 고려해야 하지만, 최근 몇 가지만 보는 경우가 많습니다.
순차 의존적 의사결정
각 단계는 이전 단계의 결과를 기반으로 합니다. Agent가 3단계에서 결정을 내릴 때 1단계의 컨텍스트를 기억해야 하는데, 그것은 이미 2,000개 Token 전의 일입니다.
Think Tool이란 무엇인가요
한 문장으로:Think Tool은 부작용이 없는 특수 도구입니다. 데이터베이스를 조회하거나, API를 호출하거나, 어떤 상태도 변경하지 않습니다. 유일한 역할은 Agent가 사고 과정을 기록하게 하여 행동 전에 충분히 생각하도록 강제하는 것입니다.
Extended Thinking
모델이 응답을 생성하기 전에 심층적으로 사고합니다. 한 번에 모두 생각해야 하는 복잡한 추론 문제에 적합합니다.
THINK
심층 사고, 방안 계획
ACTION
도구 A 호출
ACTION
도구 B 호출
ACTION
응답 생성
사고는 시작 단계에 발생하고, 이후 계속 실행됩니다
Think Tool
Agent가 실행 중 언제든지 사고를 일시 중지할 수 있습니다. 중간에 정보를 정리하거나 전략을 재평가해야 하는 긴 체인 시나리오에 적합합니다.
ACTION
도구 A 호출, 사용자 주문 조회
THINK
정책 3과 7을 결합하면, 이 경우...
ACTION
도구 B 호출, 환불 기록 조회
THINK
사용자가 2회 환불했으므로 규칙 12 적용...
ACTION
최종 결정 내리기
사고가 행동 사이사이에 삽입되어 단계적으로 진행됩니다
구현:놀랍도록 단순합니다
Think Tool의 구현은 놀랍도록 단순합니다. 텍스트 문자열을 받아서 아무것도 하지 않는 도구일 뿐입니다.
Think Tool 정의 (JSON)
{
"name": "think",
"description": "Use the tool to think about something.
It will not obtain new information or change
the database, but just append the thought
to the log.",
"input_schema": {
"type": "object",
"properties": {
"thought": {
"type": "string",
"description": "A thought to think about."
}
},
"required": ["thought"]
}
}
왜 System Prompt에 「먼저 충분히 생각해라」고 쓰지 않나요?도구 호출 모드에서 Agent의 사고와 도구 호출은 서로 다른 출력 형식이기 때문입니다. 사고를 도구 호출로 감싸면 Agent가 Tool Chain 흐름 안에서 자연스럽게 사고 단계를 삽입하고, 도구 호출의 리듬을 유지할 수 있습니다.
성능:수치로 말하는 효과
τ-bench(실제 고객 서비스 시나리오를 시뮬레이션하는 Agent 평가 벤치마크)에서 Think Tool 성능 테스트 결과:
τ-bench Airline(항공 고객 서비스)
0.570
0.878
+54% 향상
τ-bench Retail(소매 고객 서비스)
0.812
0.904
+11% 향상
항공 시나리오의 향상 폭에 주목하세요.항공 환불·변경 정책은 소매보다 훨씬 복잡합니다(좌석 등급, 시간대, 회원 등급 등). 정책 밀도가 높을수록 Think Tool의 가치가 더 커집니다.
직접 해보기:고객 서비스 Agent 시뮬레이션
아래 탭을 클릭해 모드를 전환하고, Agent의 처리 과정을 단계별로 펼쳐 보세요. Think Tool의 유무가 결과에 얼마나 큰 차이를 만드는지 확인해 보세요.
시나리오:사용자가 36시간 전에 구매한 항공권 환불 요청(정책:24시간 이내 전액 환불, 초과 시 수수료 공제)
Think Tool을 언제 사용할까요 2025.12 업데이트
적합한 시나리오
- 복잡한 Tool Chain:도구 5개 이상 호출하며 중간에 정리·재평가가 필요한 경우
- 정책 집약적 환경:여러 비즈니스 규칙을 동시에 고려해야 하는 경우(고객 서비스 정책, 승인 프로세스 등)
- 순차 의존적 의사결정:각 단계의 결정이 이전 단계 결과에 의존하며, 연결적 사고가 필요한 경우
- 다중 정보 집계:여러 도구 반환 결과에서 완전한 그림을 조합해야 하는 경우
부적합한 시나리오
- 단순 도구 호출:날씨 조회, 파일 읽기 같은 원스텝 작업에서는 Think Tool이 불필요한 오버헤드입니다
- 비순차적 작업:각 단계가 독립적이어서 앞뒤 연관이 필요 없는 시나리오
- Extended Thinking이 있는 시나리오:모델이 심층 사고를 지원한다면 단순 작업엔 Extended Thinking이 더 직접적입니다
- 순수 생성 작업:도구 호출이 없는 글쓰기, 번역 등의 작업
2025년 12월 업데이트:업계에서 Think Tool과 Extended Thinking의 역할 분담이 더욱 명확해졌습니다. 단순 작업에는 Extended Thinking을 직접 사용하고, Think Tool의 진정한 가치는 긴 체인의 중간 일시 정지에 있습니다. 이를 통해 Agent가 행동 사이에 사고를 재정리할 수 있습니다.
때로는 가장 유용한 도구가 바로 멈추고 생각하는 것입니다.Think Tool은 정보를 가져오거나 상태를 변경하지 않지만, Agent에게 행동 체인 안에서 일시 정지하고, 정리하고, 성찰할 기회를 줍니다. 작업이 복잡할수록 이 일시 정지의 가치는 더 커집니다.