확장 사고는 Claude가 최종 응답을 생성하기 전에 복잡한 문제를 추론할 시간을 제공하는 Claude의 고급 기능입니다. Claude의 내부 독백이라고 생각하면 됩니다 - Claude가 여러분의 문제에 단계별로 어떻게 접근하는지 확인할 수 있습니다.

확장 사고의 작동 방식
확장 사고를 활성화하면 Claude의 응답은 하나가 아닌 두 부분으로 구성됩니다:
- 추론 콘텐츠 부분 - Claude의 내부 사고 과정
- 텍스트 부분 - 실제로 원하셨던 최종 응답

추론 콘텐츠는 Claude가 문제를 어떻게 분해하는지, 무엇을 고려하는지, 그리고 최종 답변에 어떻게 도달하는지를 정확히 보여줍니다. 이러한 투명성은 복잡한 작업을 이해하고 디버깅하는 데 매우 유용할 수 있습니다.
고려해야 할 트레이드오프
확장 사고에는 명확한 이점과 비용이 따릅니다:
- 복잡한 작업에서 더 나은 정확도
- 더 높은 비용 - 모든 사고 토큰에 대해 비용을 지불합니다
- 증가된 지연 시간 - 사고에는 시간이 걸립니다
핵심 결정 지점은 간단합니다: 평가를 활용하세요. 이미 프롬프트를 최적화했지만 여전히 필요한 정확도를 얻지 못하고 있다면, 그때가 확장 사고를 고려할 가치가 있는 시점입니다.
서명 시스템
즉시 눈에 띄는 중요한 세부 사항 중 하나는 추론 콘텐츠에 첨부된 암호화 서명입니다:

이 서명은 사고 텍스트를 수정할 수 없도록 보장합니다. 후속 대화에서 Claude의 이전 추론을 포함하고자 할 경우, 서명은 콘텐츠가 변조되지 않았음을 확인합니다. 이는 수정된 추론 텍스트로 인한 잠재적 안전 문제를 방지합니다.
편집된 콘텐츠
때때로 Claude의 사고가 안전 시스템에 의해 플래그가 지정됩니다. 이런 경우, 읽을 수 있는 사고 텍스트 대신 redactedContent 필드를 받게 됩니다:

편집된 콘텐츠는 암호화되어 있지만 여전히 기능적입니다 - 컨텍스트를 잃지 않고 향후 대화에서 Claude에게 다시 전달할 수 있습니다. 단지 개발자인 여러분이 읽을 수 없을 뿐입니다.
구현
확장 사고를 활성화하려면 두 개의 매개변수로 API 호출을 수정해야 합니다:
thinking_budget은 Claude가 추론에 사용할 수 있는 토큰 수를 제어합니다. 최소값은 1024 토큰이지만, 복잡한 문제의 경우 더 많이 필요할 수 있습니다. Claude와 관련된 다른 모든 것과 마찬가지로, 평가를 활용하여 사용 사례에 맞는 적절한 예산을 찾으세요.
업데이트된 채팅 함수는 다음과 같습니다:
구현 테스트하기
확장 사고를 처리하는 애플리케이션을 구축할 때는 일반적인 추론 콘텐츠와 편집된 콘텐츠 시나리오를 모두 테스트하고 싶을 것입니다. 실제로 Claude가 편집된 콘텐츠를 반환하도록 강제하는 특별한 테스트 문자열이 있습니다 - 코드가 두 경우를 모두 제대로 처리하는지 확인하는 데 유용합니다.
확장 사고에 대해 가장 중요한 결론은 이를 사용할지 여부에 대한 결정이 항상 데이터 기반이어야 한다는 것입니다. 먼저 평가를 실행하고, 프롬프트를 최적화한 다음, 복잡한 작업에서 정확도를 더 높여야 할 필요가 있을 때만 확장 사고를 고려하세요.