GPT-5.6 Terra: 먼저 시험할 조건
- Responses API와 OpenAI 서버 도구를 중심으로 제품 흐름을 구성할 때
- reasoning effort를 none부터 max까지 조절해 비용·지연 시간을 튜닝할 때
- 272,000 토큰 이하 요청이 대부분이고 GPT-5.6 계열 라우팅을 유지할 때
MODEL DECISION LAB
두 모델의 표준 입력 단가는 같지만 출력 단가, 장문 가격 규칙과 실제 토큰 수는 다릅니다. 월 완료 작업 수와 모델별 평균 호출 수를 직접 넣어 명목 단가가 아니라 완료 작업당 비용을 비교하고, 272,000 토큰을 넘는 긴 입력에서는 결과가 어떻게 달라지는지 확인하세요.
SUCCESS-COST CALCULATOR
입력값은 브라우저에서만 계산되며 서버로 전송하거나 저장하지 않습니다.
OFFICIAL PRICE FACTS
USD · 토큰 100만 개 기준. 범위는 요청 길이에 따라 더 높은 가격 구간이 있음을 뜻합니다.
| 모델 | 표준 입력 | 캐시 읽기 | 표준 출력 | Batch 입력 / 출력 | 컨텍스트 / 최대 출력 |
|---|---|---|---|---|---|
| GPT-5.6 TerraOpenAI · 균형형 | $2–$4 | $0.2–$0.4 | $12–$18 | $1–$2 / $6–$9 | 1,050,000 / 128,000 |
| Claude Sonnet 5Anthropic · 균형형 | $2 | $0.2 | $10 | $1 / $5 | 1,000,000 / 128,000 |
캐시 쓰기·보관, Fast mode, 데이터 레지던시, 서버 도구와 검색 비용은 위 표준 토큰 가격과 별도일 수 있습니다. 최종 청구 전 공식 가격표를 다시 확인하세요.
DECISION CONDITIONS
아래 항목은 품질 우승 선언이 아니라 평가 순서를 좁히는 조건입니다. 동일 프롬프트로 성공률과 지연 시간을 별도 측정하세요.
EVALUATION CHECKLIST
검색 결과의 단일 벤치마크보다 내 평가 세트의 완료율·호출 수·월 비용을 의사결정 근거로 남기세요.
월 요청량이 같을 때 완료 작업당 비용은 얼마인가?
272,000 토큰 초과 장문 요청에서 비용 차이가 커지는가?
캐시 읽기와 Batch를 적용하면 더 저렴한 모델이 바뀌는가?
각 공급자의 토큰 수를 실제 API로 세면 명목 단가와 얼마나 달라지는가?
PAIR-SPECIFIC NOTES
두 모델 사이의 의사결정에 직접 영향을 주는 가격·수명주기·운영 조건을 정리했습니다.
Terra는 입력이 272,000 토큰을 넘으면 요청 전체에 입력 2배·출력 1.5배 장문 단가가 적용됩니다. 평균값 대신 긴 요청 비중을 따로 계산하세요.
Sonnet 5는 이전 Sonnet 세대와 토큰 수가 달라질 수 있습니다. 같은 글자 수를 두 모델에 동일 토큰 수로 가정하지 말고 각 공급자의 토큰 계측값을 넣으세요.
코딩 성공률, 지연 시간과 재시도는 실제 평가 세트로 측정해야 합니다. 계산기의 모델별 호출 수에 그 차이를 반영하면 완료 작업당 비용을 비교할 수 있습니다.
PRIMARY SOURCES
가격과 모델 사양은 바뀔 수 있습니다. 표시된 확인일 이후에는 링크된 공급자 문서를 우선하세요.
가격 확인 2026-08-13 · 사양 확인 2026-08-13
공식 가격표 ↗공식 모델 문서 ↗PickKit 모델 상세 →OpenAI 가격 허브 →가격 확인 2026-08-13 · 사양 확인 2026-08-13
공식 가격표 ↗공식 모델 문서 ↗PickKit 모델 상세 →Anthropic 가격 허브 →KEEP COMPARING
아래 대표 비교를 이어서 보거나 범용 도구에서 원하는 두 모델을 직접 선택해 계산할 수 있습니다.