GPT-5.6 가격 설명: API 비용, ChatGPT 요금제 및 모델 등급
Sol, Terra 및 Luna에 대한 GPT-5.6 가격 이해: 현재 토큰 요금, 캐시된 입력, 장기 컨텍스트 비용, ChatGPT 액세스 및 결과당 비용 모델링 포함.

GPT-5.6의 가격은 입력 및 출력 토큰 요율로 단순화하면 간단해 보입니다. 실제 비용은 모델 등급, 추론 노력, 컨텍스트 길이, 캐시 동작 및 허용된 결과를 얻기 위해 필요한 시도 횟수라는 다섯 가지 변수에 의해 결정됩니다.
또한 최신성 함정이 있습니다. OpenAI는 원래 출시 이후 GPT-5.6 가격을 변경했으며, 여기에는 Terra와 Luna에 대한 할인과 Sol에 대한 프로모션 가격이 포함됩니다. 현재 모델 페이지를 확인하지 않고 출시 표를 복사하는 기사는 이미 잘못된 것입니다.
이 가이드는 2026년 9월 3일 공식 OpenAI 페이지에서 확인된 가격을 사용합니다. 영구적인 요금표가 아닌 계산 프레임워크로 간주하세요.
현재 GPT-5.6 API 가격
| 모델 | 1M 토큰당 입력 | 1M 토큰당 캐시된 입력 | 1M 토큰당 출력 | 포지셔닝 | | GPT-5.6 Sol | $4.00 | $0.40 | $20.00 | 플래그십 복합 작업 | | GPT-5.6 Terra | $2.00 | $0.20 | $12.00 | 균형 잡힌 지능과 비용 | | GPT-5.6 Luna | $0.20 | $0.02 | $1.20 | 비용 민감 대량 처리 |
OpenAI의 현재 Sol 페이지에는 $4/$20 가격이 최소 2026년 11월 21일까지 프로모션임을 명시하고 있습니다. 회사는 프로모션 요금을 연장, 대체 또는 종료할 수 있으므로, 생산 예산에는 검토 날짜가 포함되어야 합니다.
토큰 청구 방식
입력 토큰
입력에는 지시사항, 사용자 콘텐츠, 요청에 포함된 이전 대화, 모델로 전달된 검색 증거 및 도구 결과가 포함됩니다. 모든 호출마다 반복되는 긴 시스템 프롬프트는 상당한 비용 부담이 될 수 있습니다.
출력 토큰
출력은 생성된 텍스트를 포함하며 입력보다 훨씬 높은 가격으로 책정될 수 있습니다. 검토자가 세 가지 대안이 필요할 때 열 가지를 요구하거나, 목표 지향적인 수정 대신 전체 재작성을 요청하면 사용량과 검토 부담이 모두 증가합니다.
캐시된 입력
프롬프트 캐싱은 안정적인 접두사를 보상합니다. 많은 요청이 동일한 정책, 스키마, 제품 지식을 공유한다면 해당 접두사를 바이트 단위로 안정적으로 유지하면 반복 입력 비용을 줄일 수 있습니다. GPT-5.6은 명시적 캐시 중단점을 지원하며, 자동 캐싱도 계속 사용할 수 있습니다.
반복적으로 보이는 프롬프트가 모두 캐시 히트라고 가정하지 마십시오. 동적 타임스탬프, 재정렬된 예제 또는 요청 초반에 배치된 사용자별 콘텐츠는 재사용성을 낮출 수 있습니다. 실제 API 응답에서 캐시된 토큰을 측정하십시오.
캐시 쓰기
현재 GPT-5.6 가이드라인에 따르면 캐시 쓰기는 캐시되지 않은 입력 요금의 1.25배로 청구되는 반면, 읽기는 할인됩니다. 따라서 캐싱은 투자입니다. 안정적인 접두사가 충분히 재사용될 때 효과를 발휘합니다.
기본 비용 공식
간단한 텍스트 요청의 경우:
비용 = 입력 토큰 ÷ 1,000,000 × 입력 요율 + 출력 토큰 ÷ 1,000,000 × 출력 요율
하나의 Terra 호출이 캐시되지 않은 입력 토큰 20,000개를 사용하고 출력 토큰 3,000개를 생성한다고 가정해 보겠습니다.
- 입력: 20,000 / 1,000,000 × $2 = $0.04
- 출력: 3,000 / 1,000,000 × $12 = $0.036
- 예상 텍스트 토큰 비용: $0.076
이는 도구, 재시도 및 특별 처리 비용을 제외합니다.
이제 입력 토큰 중 15,000개가 캐시 읽기로 인정된다고 가정해 보겠습니다.
- 캐시되지 않은 입력 5,000개: $0.01
- 15,000 캐시된 입력: $0.003
- 3,000 출력: $0.036
- 예상 총액: $0.049
이 예시는 출력 규율과 캐시 설계가 표면적인 입력 가격만큼이나 중요할 수 있는 이유를 보여줍니다.
긴 맥락 가격 책정이 방정식을 바꿀 수 있다
GPT-5.6 Sol 모델 페이지에는 105만 토큰 컨텍스트 창이 나열되어 있지만, 272,000 입력 토큰을 초과하는 프롬프트는 전체 요청에 대해 입력 요금의 2배와 출력 요금의 1.5배가 청구된다고도 명시되어 있습니다.
이는 중요한 설계 임계점을 만듭니다. 전체 저장소나 문서 아카이브를 하나의 요청으로 결합하는 것은 검색과 여러 개의 작은 호출을 합친 것보다 더 많은 비용이 들 수 있습니다. 매우 긴 컨텍스트를 사용하기 전에 다음을 물어보세요:
- 모든 문서가 동일한 결정에 영향을 미치나요?
- 검색이 더 작은 증거 집합을 선택할 수 있나요?
- 안정적인 배경 자료를 캐싱할 수 있나요?
- 단계별 재고 및 합성이 추적성을 향상시킬까요?
- 임계값을 넘는 것이 승인도를 충분히 향상시켜 승수를 정당화할 수 있을까?
긴 컨텍스트는 능력이지, 입력을 최대화하라는 권장 사항이 아닙니다.
추론 노력과 비용
GPT-5.6은 API에서 none, low, medium, high, xhigh 및 max를 지원합니다. 더 높은 추론은 더 많은 토큰과 시간을 사용할 수 있습니다. 경제적으로 올바른 설정이 반드시 가장 낮은 것은 아닙니다. 더 어려운 작업은 여러 번의 낮은 노력 시도 실패를 피할 수 있다면 높은 노력에서 더 저렴할 수 있습니다.
다음 항목을 사용하여 노력 수준을 평가하세요:
승인된 출력당 비용 = 총 모델 및 도구 비용 / 검토를 통과한 출력 수
저렴한 비용이 $0.03이지만 출력의 50%만 통과한다면, 재시도 및 검토 전에 승인된 결과당 직접 모델 비용은 최소 $0.06입니다. 통과율 95%의 $0.05 구성이 운영상 더 저렴할 수 있습니다.
빠른 모드, 배치 및 도구
OpenAI는 GPT-5.6 Sol의 Fast 모드가 더 높은 가격으로 더 빠른 API 처리를 제공할 수 있다고 보고합니다. 이 모드는 해당 모델의 Priority Processing을 대체합니다. 지연 시간이 측정 가능한 가치가 있을 때 사용하세요—대화형 코딩, 시간에 민감한 작업, 또는 응답을 기다리며 차단된 인간 워크플로우—단순히 더 빠르게 들리기 때문이 아니라요.
배치 처리는 비동기 워크로드에 적합할 수 있으며, 웹 검색, 컴퓨터 사용 및 기타 도구는 별도로 요금이 부과될 수 있습니다. 도구 루프와 실패한 호출을 포함한 전체 요청 경로를 항상 예상하세요.
ChatGPT 요금제는 토큰 번들이 아닙니다
ChatGPT 구독 액세스는 API 토큰 요금과 직접 비교해서는 안 됩니다. 구독은 요금제 한도, 사용 정책 및 워크스페이스 제어에 따라 제품 기능과 모델 옵션에 대한 액세스를 제공하며, 상호 교환 가능한 API 잔액을 생성하지 않습니다.
현재 공식 지침에 따르면:
- Plus에는 GPT-5.6 Sol Medium 및 High가 포함됩니다.
- Pro, Business 및 Enterprise에는 Medium, High, Extra High 및 Pro가 포함됩니다.
- 무료 및 Go는 일상적인 채팅과 생각을 위해 GPT-5.6 Luna를 사용합니다.
- 제한 사항은 요금제 및 관리형 작업 공간 구성에 따라 달라질 수 있습니다.
인간이 모델과 직접 상호작용할 때는 ChatGPT를 사용하세요. 소프트웨어가 프로그래밍 가능하고 측정 가능한 접근 및 운영 제어가 필요할 때는 API를 사용하세요.
단위 경제성에 따른 티어 선택
Luna: 볼륨 최적화 및 검증
분류, 추출, 메타데이터 생성, 초안 작성 및 정확성을 저렴하게 확인할 수 있는 기타 작업에는 Luna를 사용하세요. 저렴한 요금으로 플래그십 모델로는 경제성이 떨어지는 실험을 지원할 수 있습니다.
Terra: 균형 잡힌 생산을 위한 최적화
Terra는 반복적인 전문 작업에 유용한 기준선입니다. Luna에 비해 예외 처리 부담을 줄일 수 있으면서도 Sol보다는 저렴합니다.
Sol: 비용이 많이 드는 결정과 까다로운 사례에 최적화
실패 비용이 토큰 비용을 지배할 때 Sol을 사용하세요: 최종 합성, 복잡한 에이전트 작업, 어려운 코드 변경, 미묘한 디자인 검토 또는 영향력이 큰 예외 사항에 사용하세요.
애니메이션 워크플로우를 위한 비용 설계
애니메이션 파이프라인은 모든 단계를 동일한 추론 계층으로 보내서는 안 됩니다.
- Luna는 자산 이름을 정규화하고, 장면에 태그를 지정하며, 메타데이터 변형을 생성할 수 있습니다.
- Terra는 장면 분석, 캐릭터 브리핑 및 제작 프롬프트를 작성할 수 있습니다.
- Sol은 긴 서사의 모순을 감사하거나 복잡한 최종 계획을 검토할 수 있습니다.
- Elser AI는 작성된 브리프가 승인된 후 전문적인 캐릭터, 스토리보드, 애니메이션, 음성 및 편집 워크플로우를 실행할 수 있습니다.
이러한 분리는 값비싼 추론 호출이 일상적인 형식 지정에 소모되는 것을 방지하고, 언어 모델 토큰 가격에 미디어 생성이 포함되어 있다고 가장하는 것을 피합니다.
월별 비용 예측 구축하기
다음 열을 포함하는 테이블을 생성하세요:
- 작업 유형.
- 월별 요청량.
- 선택된 모델과 노력.
- 평균 캐시되지 않은 입력 토큰.
- 평균 캐시된 입력 토큰 수.
- 평균 출력 토큰.
- 도구 호출 및 요금.
- 재시도율.
- 인간 검토 회의록.
- 수락률.
기본, 대용량 및 캐시 성능이 낮은 시나리오를 실행합니다. 프로모션 가격 종료에 대한 민감도 사례를 추가합니다. 출시 기간 동안 주간 실제 사용량을 검토하고 추정치가 아닌 관찰된 토큰 수로 예측을 업데이트합니다.
자주 묻는 질문
GPT-5.6 Sol의 가격은 얼마인가요?
2026년 9월 3일 기준으로 확인된 바, 공식 모델 페이지에는 입력 토큰 100만 개당 4달러, 캐시된 입력 토큰 100만 개당 0.40달러, 출력 토큰 100만 개당 20달러로 명시되어 있습니다. 프로모션 가격은 최소 2026년 11월 21일까지 유지된다고 명시되어 있습니다.
GPT-5.6 Luna가 항상 가장 저렴한 옵션인가요?
가족 중 가장 낮은 명시된 토큰 요금을 가지고 있지만, 재시도, 검토 및 오류 비용으로 인해 다른 모델이 승인된 결과당 더 저렴해질 수 있습니다.
ChatGPT 구독에 API 사용이 포함되나요?
ChatGPT와 API 청구를 별개의 제품으로 취급하세요. API 요청은 API 요금제에 따라 측정되며, 구독 액세스는 ChatGPT 플랜의 한도와 기능을 따릅니다.
프롬프트 캐싱이 자동으로 이루어지나요?
자동 캐싱이 가능하며, GPT-5.6은 명시적 캐시 중단점도 지원합니다. 실제 절감액은 접두사 안정성과 재사용에 따라 달라집니다.
이미지나 비디오 생성 비용이 여기에 포함되나요?
아니요. 이 요금은 GPT-5.6 텍스트 토큰 사용량을 포함합니다. 특화된 미디어 엔드포인트와 타사 제작 도구는 자체 가격 정책이 있습니다.
결론
GPT-5.6 가격 책정은 시스템 문제로 관리하는 것이 가장 좋습니다. 작업 위험에 따라 등급을 선택하고, 평가를 통해 추론 노력을 설정하며, 캐시 재사용을 위한 안정적인 접두사를 설계하고, 불필요한 긴 컨텍스트 임계값을 피하며, 수용된 결과당 비용을 측정하세요.
가장 낮은 토큰 가격이 유용합니다. 완료되고 승인된 작업에 대한 더 낮은 비용이 실제로 중요합니다.

















































































