업데이트: 2026-06-06
AI 씽킹 필드
본 문서는2026-03-22에 Crazyrouter 프로덕션 환경에서 재검토된 thinking / reasoning 노출 방식만 다룹니다.
핵심 전제는 다음과 같습니다. 프로토콜마다 “씽킹”을 노출하는 방식이 서로 다릅니다.
- OpenAI Responses는 독립적인
reasoningitem을 반환하는 방식을 선호합니다 - Claude 네이티브 Messages는
thinkingblock을 반환합니다 - Gemini Native는 현재
usageMetadata.thoughtsTokenCount를 통해 씽킹이 실제로 작동했는지 판단하는 것이 더 용이합니다
현재 검증된 필드
이번 재검토에서
gpt-5.5 Chat Completions의 message.reasoning_content는 안정적으로 의존할 수 있는 내용을 반환하지 않았으므로, 여기서는 주요 관찰 필드로 나열하지 않습니다.GPT: Responses의 reasoning item
Claude: thinking block
Gemini: thoughtsTokenCount
Gemini Native에서 이번 재검토 결과 가장 안정적인 관찰 포인트는 본문에 노출되는 씽킹 텍스트가 아니라 사용량 필드입니다.
- thinking budget이 실제로 생성 과정에 참여했습니다
- 이번 요청에서 실제로 씽킹 토큰 소비가 발생했습니다
사용 시 유의 사항
- 모든 모델이 완전한 씽킹 과정을 평문으로 반환한다고 가정하지 마세요
- 서로 다른 프로토콜의 thinking 필드를 섞어서 사용하지 마세요
- 감사, 로깅, 프론트엔드 표시가 필요하다면, 먼저 프로토콜에 따라
reasoning,thinking,thoughtsTokenCount중 무엇을 읽어야 하는지 판단하세요