Skip to main content
업데이트: 2026-06-06

GPT-5 사고 모드

이 문서 페이지에는 2026-03-22에 Crazyrouter 프로덕션 환경에서 재검증된 GPT reasoning 동작만 기재되어 있습니다. 현재 주요 예시에서는 다음을 사용합니다.
  • gpt-5.5
  • POST /v1/responses
Claude는 현재 POST /v1/responses를 지원하지 않습니다. Claude를 연동하는 경우 POST /v1/messages 또는 POST /v1/chat/completions를 사용하시고, 이 페이지의 Responses 요청 형태를 그대로 적용하지 마십시오.

기본 사용법


프로덕션에서 검증된 응답 구조

현재 프로덕션에서 반환되는 주요 output.type은 다음과 같습니다.
reasoning item의 일반적인 구조는 다음과 같습니다.
message item에는 최종 출력 텍스트가 포함됩니다.

reasoning 파라미터

실용적인 판단 기준

  • 더 강한 추론만 필요하고 요약은 신경 쓰지 않는 경우: effort만 전달
  • 표시 가능한 reasoning 요약이 필요한 경우: summary도 함께 전달
현재 재검증에서:
  • effort만 전달할 경우, reasoning item은 존재하지만 summary가 빈 배열일 수 있습니다
  • summary: "detailed"를 전달하면 안정적으로 summary_text를 받을 수 있습니다

사고 요약 추출

Python

스트리밍 사고

현재 프로덕션 환경에서 다음 Responses SSE 이벤트명이 재검증되었습니다.
  • response.reasoning_summary_part.added
  • response.reasoning_summary_text.delta
  • response.reasoning_summary_text.done
  • response.output_text.delta
  • response.output_text.done
  • response.completed
예시:
Python

현재 권장 사항

  • 표시 가능한 reasoning 필드가 필요하다면 gpt-5.5 + Responses API를 우선 선택하십시오
  • gpt-5.5 Chat Completions의 reasoning_content를 현재 주요 의존 필드로 사용하지 마십시오
  • 최종 답변만 필요하다면 Chat Completions에서 계속 reasoning_effort를 사용할 수 있습니다
reasoning 모드는 지연 시간과 토큰 소비를 증가시킵니다. effort가 높을수록 일반적으로 비용도 높아집니다.