Wan3.0, GLM-5.3 Flash, and Qwen3.8 Flash are now live on CometAPI →
technology/CometAPI 리서치

GPT-5.6 2026년 가격: Sol, Terra & Luna API 비용

请提供需要翻译为韩语的原文内容。

CometAPI
Mia MarenAI 모델 및 API 리서치 팀
업데이트됨 Sep 1, 2026 10 분 읽기
GPT-5.6 2026년 가격: Sol, Terra & Luna API 비용
이 패턴 사용

첫 API 호출하기.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

TL;DR

업데이트된 가격: GPT-5.6 Standard 단문 컨텍스트 요금은 Sol 기준 입력 $5 / 출력 $30, Terra는 $2 / $12, Luna는 $0.20 / $1.20(모두 100만 토큰당)입니다.

2026년 7월 30일, OpenAI는 GPT-5.6 Terra 가격을 20%, Luna 가격을 80% 인하했습니다. Sol 가격은 변동이 없습니다.

숨은 비용 요인에 주의: 일반적 별칭 gpt-5.6 은 Sol로 라우팅되고, 272K 입력 토큰을 초과하면 장문 컨텍스트 요금이 적용되며, 세 가지 티어 모두에서 출력 토큰 비용은 입력 토큰의 6배입니다.

지연 시간에 민감한 Sol 워크로드의 경우, OpenAI의 새로운 Fast modeStandard 가격의 2배최대 2.5배 빠른 처리를 제공합니다.

OpenAI API Pricing at a Glance

OpenAI API 가격을 폭넓게 찾는 사용자에게 가장 먼저 드는 질문은 보통 다음과 같습니다: 나는 실제로 어떤 최신 모델에 비용을 지불하고 있는가? 아래 표는 GPT-5.6를 자세히 보기 전에 현재 몇 가지 텍스트 모델을 간단히 보여 줍니다.

(> 가격 업데이트 — 2026년 7월 30일: OpenAI는 GPT-5.6 Terra API 가격을 20%, Luna 가격을 80% 인하했습니다. Terra는 이제 입력 100만 토큰당 $2, 출력 100만 토큰당 $12이고, Luna는 입력 $0.20, 출력 $1.20입니다. Sol 가격은 변동이 없습니다.)

ModelInput / 1M tokensCached inputOutput / 1M tokens
gpt-5.6-sol$5.00$0.50$30.00
gpt-5.6-terra$2.00$0.20$12.00
gpt-5.6-luna$0.20$0.02$1.20
gpt-5.5$5.00$0.50$30.00
gpt-5.4$2.50$0.25$15.00
gpt-5.4-mini$0.75$0.075$4.50
gpt-5.4-nano$0.20$0.02$1.25

새 가격에서 Luna는 GPT-5.4 nano의 입력 $0.20과 일치하며, 출력은 $1.25 대비 약간 낮은 $1.20입니다.

출처*:* OpenAI API pricing

가장 중요한 패턴은 놓치기 쉽습니다: Sol, Terra, Luna 전 티어에서 GPT-5.6의 출력 토큰은 입력 토큰보다 6배 비쌉니다. 긴 답변, 장황한 에이전트, 추론 중심 워크플로우는 프롬프트 길이의 소폭 변화보다 비용을 더 빠르게 올릴 수 있습니다.

GPT-5.6 제품군의 폭넓은 개요—모델 기능, 포지셔닝, 벤치마크, API 접근, 주요 출시 기능—는 OpenAI의 GPT-5.6 announcement 나 CometAPI의 GPT-5.6 guide.를 참고하세요. 이 글은 특히 가격, 비용 계산, 실제 API 요금에 영향을 줄 수 있는 요인에 초점을 맞춥니다.

GPT-5.6 Pricing: Sol vs Terra vs Luna

GPT-5.6는 세 가지 가격 티어를 도입했습니다. OpenAI는 Sol을 플래그십 경로, Terra를 균형형 옵션, Luna를 대량 워크로드용 저가 티어로 포지셔닝합니다.

각 모델의 기능, GPT-5.6 API 접근 방법, 사용 사례에 대한 더 깊은 내용은 GPT-5.6 model 에서 확인하세요.

입력 토큰 ≤272K인 요청의 GPT-5.6 Standard 가격

ModelShort inputCached inputCache writeShort outputLong inputLong cached inputLong cache writeLong output
gpt-5.6-sol$5.00$0.50$6.25$30.00$10.00$1.00$12.50$45.00
gpt-5.6-terra$2.00$0.20$2.50$12.00$4.00$0.40$5.00$18.00
gpt-5.6-luna$0.20$0.02$0.25$1.20$0.40$0.04$0.50$1.80

출처*:* OpenAI API pricing

장문 컨텍스트 가격: 272K 입력 토큰을 초과하는 요청은 더 높은 요금이 적용됩니다. 입력, 캐시된 입력, 캐시 쓰기는 표준의 2배로 청구되고, 출력은 1.5배로 청구됩니다. 더 높은 요금은 272K 초과분만이 아니라 요청 전체에 적용됩니다.

합리적인 출발점은 단순하고 대량인 작업에는 Luna, 균형 잡힌 애플리케이션 워크로드에는 Terra, 가장 어려운 또는 임팩트가 큰 작업에는 Sol테스트하는 것입니다. 이는 보편적 권고가 아닙니다. 정확도, 재시도, 도구 동작, 휴먼 리뷰가 정가 차이를 상쇄할 수 있습니다.

하나의 중요한 별칭 세부사항

OpenAI의 모델 가이드에 따르면 일반적 별칭 gpt-5.6gpt-5.6-sol 로 라우팅됩니다.

즉, gpt-5.6 으로 보낸 요청은 Sol 가격 티어를 사용합니다. 워크로드가 Terra 또는 Luna에서 잘 동작한다면, 가장 저렴한 적합 티어를 자동 선택한다고 가정하지 말고 명시적 모델 ID를 사용하세요.

Example 1: A Typical API Request

일반적인 요청 형태로 시작해 봅시다:

  • 입력 토큰 1,000개
  • 출력 토큰 500개
ModelMonthly input costMonthly output costTotal
gpt-5.6-sol$10,000$15,000$25,000
gpt-5.6-terra$4,000$6,000$10,000
gpt-5.6-luna$400$600$1,000

이 워크로드에서 Luna의 새로운 가격은 예상 월 토큰 비용을 $5,000에서 $1,000로 낮추고, Terra는 $12,500에서 $10,000로 감소시킵니다.

Sol 계산:

(1,000 / 1,000,000 × $5) + (500 / 1,000,000 × $30) = $0.020

이 예시는 출력 길이가 왜 중요하지를 보여 줍니다. 입력 토큰이 출력 토큰보다 2배 많음에도 불구하고, 출력은 Sol 토큰 비용의 **75%**를 차지합니다. 출력이 입력보다 여섯 배 비싸기 때문입니다.

채팅, 에이전트, 코드 생성에서는 불필요한 장황함을 줄이는 것이 작은 시스템 프롬프트를 다듬는 것보다 더 큰 비용 절감을 가져올 수 있습니다.

Example 2: Monthly Cost at Scale

이제 애플리케이션이 월 100만 건의 요청을 처리한다고 가정합니다. 평균은 다음과 같습니다:

  • 요청당 입력 토큰 2,000개
  • 요청당 출력 토큰 500개

이는 월 입력 토큰 20억 개, 출력 토큰 5억 개와 같습니다.

ModelMonthly input costMonthly output costTotal
gpt-5.6-sol$10,000$15,000$25,000
gpt-5.6-terra$5,000$7,500$12,500
gpt-5.6-luna$2,000$3,000$5,000

격차는 라우팅 테스트를 정당화할 만큼 큽니다. 그러나 가장 낮은 행이 자동으로 최선의 프로덕션 선택지는 아닙니다. 더 저렴한 모델이 재시도 증가, 작업 실패, 수동 검토를 유발하면 전체 워크플로우 비용이 더 높아질 수 있습니다.

Long-Context Pricing: What Happens Above 272K Tokens?

GPT-5.6 모델은 1.05M 토큰 컨텍스트 윈도를 지원하지만, 요청에 272,000개 이상의 입력 토큰이 포함되면 OpenAI는 더 높은 요금을 적용합니다.

이런 장문 컨텍스트 요청의 경우:

  • 입력은 단문 요금의 2배로 청구됩니다
  • 캐시된 입력과 캐시 쓰기도 2배로 청구됩니다
  • 출력은 1.5배로 청구됩니다
  • 더 높은 요금은 요청 전체에 적용되며 272K 초과분만이 아닙니다

Sol의 경우 입력은 100만 토큰당 $5에서 $10로, 출력은 $30에서 $45로 바뀝니다. 동일한 배수 구조가 Terra와 Luna에도 적용됩니다.

이로 인해 272K 근처에서 비용 절벽이 생깁니다. 임계값 근처의 워크로드라면, 중복된 검색 청크, 오래된 대화 기록, 불필요한 리포지토리 파일, 장황한 도구 출력을 줄인 후 요청을 보내세요. 추가 토큰 절감 가이드는 OpenAI의 cost optimization guide를 참고하세요.

Standard, Batch, Flex, and Priority Pricing

적격 GPT-5.6 텍스트 워크로드에 대해 OpenAI는 여러 처리 티어를 제공합니다.

TierSol input/outputTerra input/outputLuna input/outputTypical use
Standard$5 / $30$2 / $12$0.20 / $1.20일반적인 동기 트래픽
Batch$2.50 / $15$1 / $6$0.10 / $0.60오프라인 비동기 작업
Flex$2.50 / $15$1 / $6$0.10 / $0.60더 느린 처리를 감수할 수 있는 비용 민감 워크로드
Fast mode$10 / $60$4 / $24$0.40 / $2.40지연 시간에 민감한 단문 컨텍스트 트래픽

Batch와 Flex는 여전히 Standard 대비 약 50% 저렴합니다. Priority Processing은 2026년 7월 30일에 Fast mode로 이름이 변경되었지만, service_tier: "priority" 를 사용하는 기존 요청은 호환됩니다.

GPT-5.6 Sol의 경우 Fast mode는 모델 지능 변화 없이 Standard 대비 최대 2.5배 빠른 처리를 Standard 토큰 가격의 2배로 제공합니다. 사용자 지연이 프리미엄을 정당화할 만큼 중요할 때 가장 적합합니다.

Prompt Caching: When Does It Save Money for GPT-5.6 ?

GPT-5.6에서 캐시 쓰기는 일반 입력 요금의 1.25배이며, 캐시 적중 읽기는 더 낮은 캐시 입력 가격이 적용됩니다.

Sol에서 재사용 가능한 100,000 토큰 프리픽스를 고려해 봅시다:

ActionCost
Process once as normal uncached input$0.50
Write the prefix to cache$0.63
Read the cached prefix later$0.05

비캐시 상태로 두 번 처리하면 $1.00이 듭니다. 한 번의 캐시 쓰기와 한 번의 일치하는 캐시 읽기는 $0.675로, 이 단순화된 예에서 $0.325를 절약합니다.

이 예시의 범위: 이 계산은 재사용 가능한 프리픽스의 입력 비용만 비교합니다. 출력 토큰, 다른 비캐시 입력, 도구, 재시도는 포함하지 않습니다. 실제 절감액은 프리픽스가 캐시 요구사항과 일치하는지, 실제로 얼마나 자주 재사용되는지에 따라 달라집니다.

따라서 캐싱은 반복적으로 일치하는 요청을 받는 길고 안정적인 프롬프트 프리픽스에 가장 유용합니다. 재사용되지 않는 캐시 쓰기는 비용을 줄이기보다 추가합니다.

OpenAI의 prompt caching guide는 캐시 쓰기 가격, 캐시 읽기, 명시적 브레이크포인트, TTL 동작을 문서화합니다.

Other Costs That Can Change Your OpenAI API Bill

Reasoning tokens and Pro mode

리저닝 토큰은 보이는 응답 텍스트로 표시되지 않더라도 출력 토큰으로 청구됩니다. 더 높은 리저닝 설정은 총 출력 토큰 사용량과 지연 시간을 증가시킬 수 있습니다.

지원되는 경우, reasoning.mode = "pro" 는 비용 절감 또는 품질의 기본 규칙이 아니라 벤치마크해야 할 구성으로 보는 것이 좋습니다. OpenAI는 이 모드에 대해 별도의 고정 Pro 할증을 명시하지 않습니다. 비용 영향은 결과적인 토큰 사용량에서 발생합니다. 합리적 기준선은 대표 작업에서 Standard와 Pro를 테스트하고 작업 성공, 총 출력 토큰, 지연 시간, 재시도를 비교하는 것입니다.

Web search and other tools

OpenAI는 현재 표준 웹 검색을 1,000회당 $10로 책정하고, 검색 콘텐츠 토큰은 선택한 모델 요금으로 청구합니다. 작은 Luna 요청에서 웹 검색 두 번이면 모델 토큰 비용보다 더 비쌀 수 있습니다.

OpenAI는 비리저닝 모델을 위한 별도의 웹 검색 프리뷰 가격을 1,000회당 $25로 책정하며, 검색 콘텐츠 토큰은 무료입니다. 모든 엔드포인트에 하나의 웹 검색 요금을 적용하지 말고 공식 가격 페이지에서 정확한 도구와 모델 조합을 확인하세요.

Regional processing

2026년 3월 5일 이후 출시된 모델의 적격 지역 처리 또는 데이터 레지던시 엔드포인트에는 OpenAI 가격 페이지에 따르면 10% 할증이 적용됩니다. 레지던시 요구사항이 있는 엔터프라이즈 팀은 예산 산정에 이를 포함해야 합니다.

How to Calculate OpenAI API Cost

기본 요청의 경우:

Token cost =

(input tokens / 1M × input rate)

  • (output tokens / 1M × output rate)

프로덕션 계획을 위해 다음을 포함하도록 확장하세요:

Total workflow cost =

uncached input

  • cached input
  • cache writes
  • output and reasoning tokens
  • tool fees
  • service-tier adjustments
  • regional uplift, if applicable
  • retries and fallback requests

가장 유용한 KPI는 보통 다음과 같습니다:

Cost per successful task = total workflow cost / successful tasks

이렇게 하면 더 저렴한 토큰 요금이 실패나 리뷰 작업을 더 많이 유발할 때 매력적으로 보이는 것을 방지할 수 있습니다.

How to Choose the Right Model Without Overpaying

가격표를 출발점으로 삼되, 실제 작업에서 테스트하세요.

  1. 작업 수행이 가능해 보이는 가장 저렴한 모델부터 시작하세요. Luna는 단순하고 대량인 작업의 첫 테스트로 타당할 수 있지만, 모든 추출 또는 요약 워크로드에 최적이라고 가정하지 마세요.
  2. 출력 길이를 측정하세요. GPT-5.6의 출력 토큰은 입력보다 6배 비싸므로 장황한 응답을 주의하세요.
  3. 272K 임계값을 주시하세요. 이를 넘으면 요청 전체에 요금이 바뀝니다.
  4. 긴급하지 않은 적격 작업에는 Batch 또는 Flex를 사용하세요. 프로덕션 트래픽 이전에 운영 제약을 테스트하세요.
  5. 재사용 가능한 프리픽스만 캐싱하세요. 긴 프롬프트라고 해서 캐시해야 한다고 가정하지 말고 실제 캐시 적중률을 측정하세요.
  6. 도구와 재시도를 추적하세요. 이들은 더 저렴한 모델의 절감을 상쇄할 수 있습니다.

프로바이더 간 경로를 비교하는 팀의 경우, CometAPI pricing은 라이브 크로스 모델 뷰를 제공합니다. CometAPI QuickstartCookbook을 사용해 동일한 테스트 세트를 여러 OpenAI 호환 경로에서 실행할 수 있습니다.

FAQ

2026년에 GPT-5.6 비용은 얼마인가요?

모델에 따라 다릅니다. GPT-5.6 Standard 단문 컨텍스트 요금은 Luna의 100만 토큰당 입력 $1 / 출력 $6부터 Sol의 $5 / $30까지 범위가 있습니다. GPT-5.4 mini 및 nano와 같은 저가 모델도 제공됩니다. 최신 가격은 OpenAI의 라이브 가격 페이지에서 확인하세요.

ChatGPT API 가격은 GPT-5.6 가격과 동일한가요?

“ChatGPT API 가격”은 종종 대화형 모델에 대한 OpenAI API 가격을 비공식적으로 의미하지만, ChatGPT 구독과 API 과금은 별개의 제품입니다. API 사용료는 특정 모델과 사용 유형에 따라 책정됩니다.

가장 저렴한 GPT-5.6 모델은 무엇인가요?

gpt-5.6-luna 가 가장 저렴한 GPT-5.6 모델로, 입력 100만 토큰당 $0.20, 출력 100만 토큰당 $1.20입니다. OpenAI는 7월 30일에 두 요금을 80% 인하하여, 대량 에이전트, 분류, 문서 처리, 잘 정의된 도구 워크플로우에서 Luna가 훨씬 경제적이 되었습니다.

gpt-5.6 은 어떤 모델을 사용하나요?

OpenAI의 모델 가이드는 gpt-5.6 별칭이 gpt-5.6-sol 로 라우팅된다고 명시합니다. Terra 또는 Luna 티어를 원할 때는 해당 모델 ID를 명시적으로 사용하세요.

GPT-5.6 장문 컨텍스트 가격은 언제 적용되나요?

입력이 272,000 토큰을 초과하면, GPT-5.6은 요청 전체에 대해 장문 컨텍스트 요금을 적용합니다: 입력 관련 요금은 2배, 출력 요금은 1.5배입니다.

GPT-5.6에서 Batch와 Flex는 Standard보다 저렴한가요?

적격 GPT-5.6 워크로드의 경우, 게시된 Batch와 Flex 토큰 요금은 Standard보다 약 50% 낮습니다. 처리 특성이 다르므로 워크로드가 해당 제약을 감내할 수 있는지 확인하세요.

GPT-5.6에서 캐시 쓰기는 추가 비용이 드나요?

예. GPT-5.6 캐시 쓰기는 일반 입력의 1.25배로 가격이 책정되며, 일치하는 캐시 읽기는 할인된 캐시 입력 요금이 적용됩니다. 절감액은 실제 재사용에 따라 달라집니다.

Compare GPT-5.6 Costs on Your Own Workload

가격표는 출발점에 불과합니다. 실제 비용은 프롬프트, 출력 길이, 캐시 적중률, 도구, 재시도, 작업 성공에 따라 달라집니다.

CometAPI를 사용하면 동일한 워크로드로 GPT-5.6 Sol, Terra, Luna 및 기타 모델을 하나의 OpenAI 호환 API를 통해 테스트할 수 있습니다.

Next steps: compare current model pricing, CometAPI Quickstart를 따르거나 CometAPI Cookbook을 사용해 반복 가능한 모델 평가를 구축하세요.

품질, 지연, 안정성 요구사항을 충족하는 범위에서 가장 저렴한 경로를 선택하세요.

학습 계속하기

이 글을 다음 결정과 연결하세요.

모든 주제 보기
게시일 Jul 15, 2026
최종 업데이트 Sep 1, 2026
605 회 조회
명확성, 출처 표기 및 최신 API 용어에 대해 검토되었습니다.

AI 개발 비용을 20% 절감할 준비가 되셨나요?

몇 분 안에 무료로 시작하세요. 무료 체험 크레딧 제공. 신용카드 불필요.

더 보기