Sign in to save your progressYou can keep reading without an account, but completed lessons won't be saved.
Sign in

확장 사고는 Claude가 최종 응답을 생성하기 전에 복잡한 문제를 추론할 시간을 제공하는 Claude의 고급 기능입니다. Claude의 내부 독백이라고 생각하면 됩니다 - Claude가 여러분의 문제에 단계별로 어떻게 접근하는지 확인할 수 있습니다.

확장 사고의 작동 방식

확장 사고를 활성화하면 Claude의 응답은 하나가 아닌 두 부분으로 구성됩니다:

  • 추론 콘텐츠 부분 - Claude의 내부 사고 과정
  • 텍스트 부분 - 실제로 원하셨던 최종 응답

추론 콘텐츠는 Claude가 문제를 어떻게 분해하는지, 무엇을 고려하는지, 그리고 최종 답변에 어떻게 도달하는지를 정확히 보여줍니다. 이러한 투명성은 복잡한 작업을 이해하고 디버깅하는 데 매우 유용할 수 있습니다.

고려해야 할 트레이드오프

확장 사고에는 명확한 이점과 비용이 따릅니다:

  • 복잡한 작업에서 더 나은 정확도
  • 더 높은 비용 - 모든 사고 토큰에 대해 비용을 지불합니다
  • 증가된 지연 시간 - 사고에는 시간이 걸립니다

핵심 결정 지점은 간단합니다: 평가를 활용하세요. 이미 프롬프트를 최적화했지만 여전히 필요한 정확도를 얻지 못하고 있다면, 그때가 확장 사고를 고려할 가치가 있는 시점입니다.

서명 시스템

즉시 눈에 띄는 중요한 세부 사항 중 하나는 추론 콘텐츠에 첨부된 암호화 서명입니다:

이 서명은 사고 텍스트를 수정할 수 없도록 보장합니다. 후속 대화에서 Claude의 이전 추론을 포함하고자 할 경우, 서명은 콘텐츠가 변조되지 않았음을 확인합니다. 이는 수정된 추론 텍스트로 인한 잠재적 안전 문제를 방지합니다.

편집된 콘텐츠

때때로 Claude의 사고가 안전 시스템에 의해 플래그가 지정됩니다. 이런 경우, 읽을 수 있는 사고 텍스트 대신 redactedContent 필드를 받게 됩니다:

편집된 콘텐츠는 암호화되어 있지만 여전히 기능적입니다 - 컨텍스트를 잃지 않고 향후 대화에서 Claude에게 다시 전달할 수 있습니다. 단지 개발자인 여러분이 읽을 수 없을 뿐입니다.

구현

확장 사고를 활성화하려면 두 개의 매개변수로 API 호출을 수정해야 합니다:

python
additional_model_fields["thinking"] = {
    "type": "enabled",
    "budget_tokens": thinking_budget
}

thinking_budget은 Claude가 추론에 사용할 수 있는 토큰 수를 제어합니다. 최소값은 1024 토큰이지만, 복잡한 문제의 경우 더 많이 필요할 수 있습니다. Claude와 관련된 다른 모든 것과 마찬가지로, 평가를 활용하여 사용 사례에 맞는 적절한 예산을 찾으세요.

업데이트된 채팅 함수는 다음과 같습니다:

python
def chat(
    messages,
    system=None,
    temperature=1.0,
    stop_sequences=[],
    tools=None,
    tool_choice="auto",
    text_editor=None,
    thinking=False,
    thinking_budget=1024
):

구현 테스트하기

확장 사고를 처리하는 애플리케이션을 구축할 때는 일반적인 추론 콘텐츠와 편집된 콘텐츠 시나리오를 모두 테스트하고 싶을 것입니다. 실제로 Claude가 편집된 콘텐츠를 반환하도록 강제하는 특별한 테스트 문자열이 있습니다 - 코드가 두 경우를 모두 제대로 처리하는지 확인하는 데 유용합니다.

확장 사고에 대해 가장 중요한 결론은 이를 사용할지 여부에 대한 결정이 항상 데이터 기반이어야 한다는 것입니다. 먼저 평가를 실행하고, 프롬프트를 최적화한 다음, 복잡한 작업에서 정확도를 더 높여야 할 필요가 있을 때만 확장 사고를 고려하세요.