GPT-5.6 시리즈 API 가격 및 Codex 사용량 정리
GPT-5.6 API 가격
단위: 1M tokens
모델 | 구간 | 모델 ID | 입력 | 캐시 입력 / 캐시 읽기 | 출력 |
|---|---|---|---|---|---|
GPT-5.6 Sol |
| $5.00 | $0.50 | $30.00 | |
GPT-5.6 Terra |
| $2.50 | $0.25 | $15.00 | |
GPT-5.6 Luna |
| $1.00 | $0.10 | $6.00 | |
GPT-5.5 | Short context |
| $5.00 | $0.50 | $30.00 |
GPT-5.5 | Long context |
| $10.00 | $1.00 | $45.00 |
Codex credit rate 비교표
GPT-5.6 API 단가를, Codex rate card의 기존 환산 구조에 맞춰 계산한 값
→ credit 사용량은 API token-based rates를 기반으로 계산되기 때문
단위: credits / 1M tokens, Standard mode 기준. (Fast 모드는 2.5배 해야됨)
모델 | 모델 ID | 입력 | 캐시 읽기 / cached input | 캐시 쓰기 | 출력 |
|---|---|---|---|---|---|
GPT-5.6 Sol |
| 125 | 12.50 | 156.25 | 750 |
GPT-5.6 Terra |
| 62.50 | 6.25 | 78.125 | 375 |
GPT-5.6 Luna |
| 25 | 2.50 | 31.25 | 150 |
GPT-5.5 |
| 125 | 12.50 | — | 750 |
지금 GPT-5.5 사용량 생각하면 대충 어느정도 사용할지 감이 오실듯욤
GPT-5.6 Terra는 GPT-5.5의 절반 가격이지만..

뭐 그렇고욤..
글을 그냥 끝내기 아쉬우니
사용량 관련해서 글 읽을 때 알아두면 쓸만한 내용 던져두고 갑니다용
모델의 `reasoning_effort`는 어떻게 계산되나욤?
이제는 모르는 사람이 없겠지만 reasoning_effort는 모델이 작업을 수행할 때 얼마나 깊게 추론할지를 조절하는 설정
API 기준:
none,minimal,low,medium,high,xhighCodex 설정:
minimal,low,medium,high,xhigh를 사용할 수 있음모델에 따라
xhigh지원 안 하는 것도 있음
reasoning_effort 를 높인다
→ 모델은 더 많은 reasoning tokens 를 사용한다
→ 이게 Context window도 차지하고 output tokens 에 포함되서 과금 된다.
→ 따라서 고추론 모드(low → xhigh)를 사용할수록 reasoning 토큰 증가(출력 토큰 증가)로 전체 비용을 더 크게 차지할 수 있다.
{
"usage": {
"input_tokens": 75,
"input_tokens_details": {
"cached_tokens": 0
},
"output_tokens": 1186,
"output_tokens_details": { // 범인
"reasoning_tokens": 1024
},
"total_tokens": 1261
}
}GPT-5.6 Sol에 max 추론과 Ultra 모드(subagents 돌리기)도 추가되니

돈과 토큰 모두 텅텅

