Claude Haiku 5.5 and Nano Banana 2.1 are now live on CometAPI →
ai-model/CometAPI 리서치

GPT-6.1 Sol 가격: API 요금, 캐시된 토큰, 긴 컨텍스트 및 CometAPI 비용

GPT-6.1 Sol API 가격, 캐시 읽기 및 쓰기, 긴 컨텍스트 요금, 처리 티어, CometAPI 비용, 수락된 작업당 비용을 비교해 주세요.

CometAPI
Deon GoodwinAI 모델 및 API 리서치 팀
업데이트됨 Oct 10, 2026 12 분 읽기
GPT-6.1 Sol 가격: API 요금, 캐시된 토큰, 긴 컨텍스트 및 CometAPI 비용
이 패턴 사용

첫 API 호출하기.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

TL;DR

GPT-6.1 Sol 은 복잡한 코딩, 컴퓨터 사용, 전문 워크플로우를 위한 OpenAI의 추론 모델입니다. GPT-6 Sol의 공식 Standard 신규 입력/출력 단가 $2/$10(백만 토큰당)을 유지하면서, 단문맥 캐시 읽기 비용을 $0.20에서 $0.10으로 절반으로 낮췄습니다. 캐시 재사용에 성공하면 반복 문맥 비용을 절감할 수 있습니다. 입력이 272K 토큰을 초과하면 해당 요청 전체에 대해 더 높은 요율이 적용되므로, 청구를 합산하기 전에 각 요청을 미리 산정하세요. CometAPI는 별도의 게이트웨이 요금표를 사용합니다.

Key Takeaways

  • 신규 입력, 캐시 읽기, 캐시 쓰기, 과금 출력은 별도로 구분하세요. 출력에는 추론 토큰이 포함됩니다.
  • 각 요청에 올바른 컨텍스트 구간을 사용하세요. 1.05M 컨텍스트 용량이 단문맥 가격을 보장하는 것은 아닙니다.
  • 동일한 토큰 구성과 해당 계정의 과금 조건으로 OpenAI와 CometAPI를 비교하세요.
  • 지연 시간, 가용성, 라우트 지원에 따라 처리 모드를 선택하세요.
  • 에이전트 경제성은 실패한 시도까지 포함한 과금 기준의 총 수용 작업당 비용으로 판단하세요.

What Is the GPT-6.1 Sol Price at a Glance?

아래 모든 토큰 가격은 USD 기준, 백만(1M) 토큰당입니다. 공식 토큰 가격표는 OpenAI 기준선이며, 캐시 읽기/쓰기는 별도 과금 항목입니다. 컨텍스트 구간은 개별 요청의 입력 토큰을 기준으로 합니다.

OpenAI mode / input bandFresh inputCache readCache writeOutput
Standard: at most 272K$2.00$0.10$2.50$10.00
Standard: above 272K$4.00$0.20$5.00$15.00
Batch/Flex: at most 272K$1.00$0.05$1.25$5.00
Batch/Flex: above 272K$2.00$0.10$2.50$7.50
Fast: at most 272K$4.00$0.20$5.00$20.00
Fast: above 272K$8.00$0.40$10.00$30.00
Ultrafast: at most 272K$12.00$0.60$15.00$60.00
Ultrafast: above 272K$24.00$1.20$30.00$90.00

OpenAI 처리 등급 요금은 2026년 10월 9일 기준 확인되었으며, CometAPI 비교에는 원문 출처의 게이트웨이 요금표가 유지됩니다. 이는 OpenAI 처리 등급 요금이며, 각 등급이 게이트웨이를 통해 노출됨을 보장하지는 않습니다. 지역 처리에는 해당 시 10%가 추가됩니다. 예산 편성 전 선택한 서비스와 계정 조건을 확인하세요.

CometAPI를 통해 GPT-6.1 Sol에 접근하는 개발자의 경우, 표준 컨텍스트 요금은 OpenAI의 직접 Standard 요금보다 낮습니다.

Token categoryCometAPIOpenAI StandardDifference
Input / 1M$1.60$2.0020% lower
Cached input / 1M$0.08$0.1020% lower
Cache write / 1M$2.00$2.5020% lower
Output / 1M$8.00$10.0020% lower

장문맥 요청의 경우, CometAPI의 GPT-6.1 Sol API는 다음과 같습니다:

Long-context tokensCometAPIOpenAI
Input / 1M$3.20$4.00
Cached input / 1M$0.16$0.20
Cache write / 1M$4.00$5.00
Output / 1M$12.00$15.00

이는 주요 토큰 범주 전반에서 약 20%의 가격 차이를 유지합니다. 예산 편성에서 이는 중요합니다. 실제 프로덕션 워크로드는 신규 입력 토큰만으로 구성되지 않기 때문입니다. 캐시된 문맥, 출력 생성, 장문맥 요청을 포함하면, 광고된 입력 단가만 비교하는 것은 라우트 간 차이를 크게 과소평가할 수 있습니다.

CometAPI 토큰 가격표가 게이트웨이 기준을 제공합니다. 신규 입력 100K, 과금 출력 10K에서 OpenAI Standard 비용은 $0.30이며, 해당 CometAPI 요금은 $0.24입니다. 동일한 요청 10,000건에서는 토큰만 기준으로 총 $3,000와 $2,400입니다. 이 비교에는 도구, 캐시 쓰기, 재시도, 프리미엄이 제외됩니다.

GPT-6.1 Sol은 복잡한 코딩, 컴퓨터 사용, 전문 워크플로우에 적합하게 포지셔닝되어 있습니다. 1,050,000 토큰 컨텍스트 윈도우와 128,000 토큰 최대 출력은 용량 한계일 뿐, 단문맥 과금을 보장하지 않습니다. 입력이 272K 토큰을 초과하면 더 높은 요율이 적용됩니다. 텍스트와 이미지를 입력으로 받고 텍스트를 출력합니다. 도구 호출에는 Responses API를 사용하고, 도구 없는 요청은 Chat Completions를 사용하세요. 라우트 선택 시 게이트웨이 도구 지원과 처리 등급을 별도로 확인해야 합니다.

Additional GPT-6.1 Sol Agent Expenses

에이전트 예산에는 호스팅 도구, 실행 환경, 스토리지, 외부 서비스 요금도 포함됩니다. OpenAI는 웹 검색 호출을 1,000회당 $10로 안내합니다. 검색으로 가져온 콘텐츠는 모델 토큰 요율로 과금됩니다. 파일 검색 호출은 1,000회당 $2.50이며, 무료 1 GB를 초과한 스토리지는 하루 GB당 $0.10입니다.

Hosted Shell과 Code Interpreter는 위에 인용된 OpenAI 가격표 내에서 별도의 컨테이너 요금이 적용됩니다. 게시된 1 GB 요율은 컨테이너당 20분 세션 기준 $0.03이며, 적격 세션은 최소 5분의 분 단위 과금이 적용됩니다. 직접 서비스 요금을 그대로 적용할 수 있다고 가정하지 말고, 선택한 게이트웨이의 실제 도구 및 실행 조건을 사용하세요.

Reasoning Effort and Total GPT-6.1 Sol Spend

추론 노력은 토큰 표의 별도 요금 항목은 아니지만, 과금 출력, 도구 사용, 경로 길이, 재시도에 영향을 줄 수 있습니다. 동일한 작업 집합에서 낮음부터 최대까지 지원되는 노력 단계를 비교하세요. 보이는 답변 길이만으로 추론 비용을 추정하지 말고 사용량을 기록하세요.

How Does the 272K Threshold Change GPT-6.1 Sol Cost?

입력이 272K 토큰을 초과하면, OpenAI는 해당 요청 전체에 장문맥 요율을 적용합니다. 입력과 캐시 요율은 2배가 되고, 출력은 50% 증가합니다. 입력 임계값은 입력 대부분이 캐시에서 제공되는 경우에도 적용됩니다.

WorkloadFresh inputBilled outputOpenAI StandardCometAPI catalog
Small analysis20K2K$0.06$0.048
Document review100K10K$0.30$0.24
Below threshold270K10K$0.64$0.512
Above threshold280K10K$1.27$1.016
Repository analysis300K20K$1.50$1.20
270K input: 0.27 x $2 + 0.01 x $10 = $0.64
280K input: 0.28 x $4 + 0.01 x $15 = $1.27
Input grows about 3.7%; token cost grows about 98.4%.

이들은 캐시, 도구, 재시도, 프리미엄이 없는 독립 요청입니다. 임계값 효과 때문에, 모델이 전체 저장소를 수용할 만큼의 용량이 있더라도 컨텍스트 선택이 비용에 중요합니다.

How Does Prompt Caching Change GPT-6.1 Sol Input Costs?

단문맥 Standard에서 캐시 읽기는 $0.10/M이고 신규 입력은 $2/M입니다. 따라서 이 토큰 범주에서 성공적인 캐시 읽기는 95% 더 저렴합니다. 캐시 쓰기는 $2.50/M입니다. 절감 효과는 단순히 유사한 텍스트를 반복하는 것이 아니라, 캐시된 프리픽스의 성공적 재사용에 달려 있습니다.

100K 토큰 프리픽스를 공유하는 10개의 요청을 고려해 보겠습니다. 각 요청은 단문맥 구간에 머무릅니다. 관리된 캐시 사례에서는 전체 프리픽스를 한 번만 쓰고, 추가 쓰기 없이 9번 성공적으로 읽습니다. 첫 번째 요청의 100K 토큰 프리픽스는 캐시 쓰기 요율로만 과금되며, 동일 토큰을 신규 입력 요율로 중복 과금하지 않습니다.

Repeated-prefix costNo cacheOne write + nine reads
Fresh prefix input10 x 0.1 x $2 = $2.00$0.00
Cache write$0.000.1 x $2.50 = $0.25
Cache reads$0.009 x 0.1 x $0.10 = $0.09
Prefix subtotal$2.00$0.34

$1.66 절감은 이 반복 프리픽스 비용의 83%에 해당합니다. 이는 일반적인 전체 API 청구서에서 83% 절감이라는 뜻은 아닙니다. 각 요청이 2K 과금 출력 토큰도 생성한다면, 전체 10개 요청에서 출력이 $0.20 추가되어 총액은 각각 $2.20과 $0.54가 됩니다. 절감율은 약 75.5%입니다. 신규 입력, 미스, 추가 쓰기, 도구, 장문맥 구간은 결과를 변경합니다.

이러한 단순화된 단문맥 가정하에서, 100K 프리픽스에 대해 한 번 쓰고 N-1번 읽는 비용은 0.25 + 0.01(N-1) 달러이며, 캐시 없이 처리하면 0.20N입니다. 두 번의 요청만으로도, 두 번째 요청이 실제로 캐시에 적중하고 다른 비용이 변하지 않는다면 캐시 사용 사례가 더 저렴해집니다.

How Does GPT-6.1 Sol Pricing Compare with GPT-6 Sol and GPT-6 Astra?

OpenAI는 GPT-6 Sol 사양을 문서화합니다. 캐시 읽기 감소는 요율 비교일 뿐, 총 작업 비용이 낮아짐을 입증하지는 않습니다.

Official Standard short-context comparisonGPT-6.1 SolGPT-6 SolGPT-6 Astra
Fresh input / 1M tokens$2.00$2.00$10.00
Cache read / 1M tokens$0.10$0.20$1.00
Cache write / 1M tokens$2.50$2.50$12.50
Output / 1M tokens$10.00$10.00$50.00
Context window / maximum output1.05M / 128K1.05M / 128K1.05M / 128K

GPT-6.1 Sol은 단문맥 캐시 읽기 요율을 절반으로 낮췄습니다. 신규 입력, 쓰기, 출력 요율은 동일합니다. 최대 이득은 요금 중 성공적인 캐시 읽기가 차지하는 비중에 달려 있습니다. 마이그레이션 시 노력 설정, 도구 루프, 작업 결과를 재검증하세요.

GPT-6 Sol과 비교하면, GPT-6.1 Sol은 신규 입력, 캐시 쓰기, 출력 요율은 동일하며 캐시 읽기 요율만 50% 인하했습니다. GPT-6 Astra와 비교할 때는 위 요율을 실제 작업 품질과 총 경로 비용과 함께 고려하세요.

GPT-6 Astra 요금표는 Astra가 더 높은 토큰 가격 등급에 속함을 보여줍니다.

이 구간에서 GPT-6.1 Sol은 신규 입력, 캐시 쓰기, 출력이 80% 더 저렴하고, 캐시 읽기는 90% 더 저렴합니다. 이러한 비율이 품질 동등성을 보장하지는 않습니다. Astra는 더 높은 수용 결과가 추가 지출을 상쇄한다면 프리미엄을 지불할 가치가 있습니다. 반대로 GPT-6.1 Sol이 동일 수용 목표를 더 낮은 비용으로 달성한다면 더 적합할 수 있습니다.

저장소 패치, 문서 분석, 컴퓨터 사용 작업을 개별적으로 비교하세요. 프롬프트, 도구 권한, 노력 설정, 재시도 한도, 수용 검증을 동일하게 유지하세요. 성공적인 결과뿐 아니라 미해결 실패도 기록하세요. 토큰 가격만으로 범용 코딩/리서치 순위를 추론하지 마세요.

What Does GPT-6.1 Sol Cost for Real API Workloads?

해당 요청의 실제 구간과 처리 모드로 요청당 비용을 계산한 뒤 합산하세요. 신규 입력은 캐시 읽기를 제외합니다. 동일 입력 토큰을 신규와 캐시로 중복 과금하지 마세요. 공급자 사용 기록을 활용해 쓰기와 다른 입력을 구분하세요. 아래 공식에서 fresh_input은 cache_reads 및 cache_writes 둘 다를 제외합니다. 캐시 쓰기 요율로 과금된 토큰은 신규 입력으로 다시 계산하면 안 됩니다. 세 항목을 상호 배타적 과금 범주로 보고, 공급자 사용 기록과 대조하세요.

request_token_cost =
  fresh_input / 1_000_000 * fresh_rate
+ cache_reads / 1_000_000 * read_rate
+ cache_writes / 1_000_000 * write_rate
+ billed_output / 1_000_000 * output_rate

period_total = sum(request_token_cost) + other_charges

Aggregate Usage Across Multiple Short Requests

각각 100K 신규 입력과 20K 과금 출력을 사용하는 10개의 요청은 합산하면 입력 1M, 출력 200K가 됩니다. 개별 요청은 모두 272K 입력 미만이며 128K 출력 한도 미만입니다. OpenAI Standard 총액은 $4.00, CometAPI는 $3.20입니다. 이 20% 차이는 모델링된 토큰 범주에만 적용됩니다. 이는 입력 1M, 출력 200K의 단일 요청이 아닙니다.

A Cache-Heavy Period With Separately Billed Writes

한 기간에 신규 입력 1M, 캐시 읽기 5M, 과금 출력 500K, 캐시 쓰기 500K가 기록되었다고 가정합니다. 모든 구성 요청은 단문맥 Standard 구간에 머뭅니다. OpenAI 비용은 $2.00 + $0.50 + $5.00 + $1.25 = $8.75입니다. CometAPI 비용은 $1.60 + $0.40 + $4.00 + $1.00 = $7.00입니다. 이 범주들은 서로 구분되는 과금 수량이며, 반복 입력이 모두 캐시 적중했다고 가정하지 않습니다.

One Long-Context Request

신규 입력 400K, 과금 출력 100K의 요청은 장문맥 요율을 사용합니다. OpenAI Standard 비용은 0.4 x $4 + 0.1 x $15 = $3.10입니다. CometAPI 비용은 0.4 x $3.20 + 0.1 x $12 = $2.48입니다. 둘 다 새로운 캐시 쓰기 및 비토큰 요금을 제외합니다. 100K 출력 수량에는 추론이 포함되며, 모델의 출력 예산 내에 있어야 합니다.

How Do Standard, Batch, Flex, Fast, and Ultrafast Change GPT-6.1 Sol Cost?

신규 입력 300K, 과금 출력 20K 요청의 경우 장문맥 구간을 사용합니다.

OpenAI modeInput costOutput costToken subtotal
Batch/Flex$0.60$0.15$0.75
Standard$1.20$0.30$1.50
Fast$2.40$0.60$3.00
Ultrafast$7.20$1.80$9.00

Ultrafast 계산: 0.30M 신규 입력 x $24/M + 0.02M 과금 출력 x $90/M = $7.20 + $1.80 = $9.00. 이는 장문맥 구간을 사용하며 캐시, 도구, 지역 요금은 제외합니다.

Batch는 오프라인 평가, 보강, 백필, 대량 문서 처리에 적합합니다. Flex는 가변 처리와 가용성을 허용하는 워크로드에 더 낮은 요율을 제공합니다. Standard는 대화형 요청의 기준입니다. Fast는 해당 토큰 요율을 2배로 올립니다. 대기 시간 감소의 가치가 측정 가능할 때 선택하세요.

Ultrafast는 더 높은 토큰 가격으로 지연 시간을 우선합니다. GPT-6.1 Sol의 경우 Responses 요청에서 service_tier를 ultrafast로 설정하세요. OpenAI는 빠른 에이전트 도구 루프에 WebSockets를 권장합니다. 프로덕션 트래픽 라우팅 전 등급별 제한과 게이트웨이 지원을 확인하세요. 요율은 공식 OpenAI 가격표를 따릅니다.

이 요율이 각 등급이 귀하의 게이트웨이 계정에서 활성화됨을 의미하지는 않습니다. 롤아웃 전에 지원되는 라우팅과 지역 제약을 확인하세요. 가격이 공개되지 않았거나 사용할 수 없는 처리 옵션을 Standard 요율로 예산에 반영하지 마세요.

Why Is Cost per Successful GPT-6.1 Sol Task the Better Metric?

평가 집합 전체에서 모델/도구/실행 지출을 수용된 결과 수로 나누세요. 실패한 시도도 분모가 아닌 분자에 포함합니다. 사람이 보정한 시간과 미해결 실패는 별도로 보고하여, 어려운 작업을 포기하는 방식으로 비용이 개선된 것처럼 보이지 않도록 하세요.

observed_cost_per_accepted_task =
  all_evaluation_model_tool_execution_cost / accepted_tasks

예를 들어, 성공 확률 60%에서 $0.40 시도의 기대 성공 비용은 $0.40 / 0.60 = 약 $0.67입니다. 성공 확률 85%에서 $0.55 시도는 동일한 모델하에 약 $0.65입니다. 이는 가상의 수치이며 특정 모델에 대한 벤치마크 결과나 주장에 해당하지 않습니다.

이 추정은 비용과 성공 확률이 변하지 않는 독립 재시도를 가정하고, 성공할 때까지 반복합니다. 재시도 허용치를 이중으로 더하지 마세요. 이미 나눗셈이 반복을 반영합니다. 상관된 실패, 재시도 상한, 작업 난이도 차이, 도구 사용, 인간 개입은 이 모델을 부적합하게 만들 수 있습니다. 프로덕션 의사결정에는 관측된 수용 작업당 비용을 사용하세요.

How Can You Reduce GPT-6.1 Sol API Costs?

재사용 가능한 프롬프트 프리픽스를 극대화하세요. 안정적인 시스템 지침, 도구 정의, 스키마, 배경 컨텍스트를 재사용 가능한 프리픽스에 넣으세요. GPT-6.1 Sol의 $0.10/M 캐시 입력 가격은 신규 입력 대비 반복 문맥을 저렴하게 만듭니다.

필요하지 않다면 요청을 272K 미만으로 유지하세요. 272K 입력 토큰을 넘으면 전체 요청의 요율이 바뀝니다. 검색, 컨텍스트 압축, 선택적 파일 로딩은 모델이 1.05M 컨텍스트를 지원하더라도 비용을 줄일 수 있습니다.

대량 비동기 워크플로우에는 Batch를 사용하세요. 오프라인 평가, 보강, 백필, 대량 문서 처리는 Batch를 사용할 수 있습니다.

지연과 자원 가용성 변동을 허용하는 저우선 워크로드에는 Flex를 사용하세요. 지연과 재시도를 계획하고, 적격 워크로드와 라우트 지원을 확인하세요. Batch와 Flex는 위의 더 낮은 요율을 사용하지만, 서로 다른 처리 요구를 충족합니다.

수용 작업당 비용을 측정하세요. 신규 입력, 캐시 입력, 캐시 쓰기, 출력 토큰, 처리 모드, 도구 요금, 재시도, 작업 성공을 기록하세요. 그리고 실제 성공 완료당 비용을 계산하세요.

단순 작업은 더 저렴한 모델로 라우팅하세요. 모든 요청에 Sol급 추론이 필요한 것은 아닙니다. 분류, 라우팅, 단순 추출, 고검증 작업은 더 저렴한 모델에 적합할 수 있으며, GPT-6.1 Sol은 더 강한 추론이 수용률을 실질적으로 높이는 작업을 담당하도록 하세요.

이는 에이전트에서 특히 중요합니다. $0.50 실패 후 두 번의 재시도는 단일 $1.00 성공보다 더 비쌀 수 있기 때문입니다.

명시적 완료 한도, 도구 루프 한도, 재시도 예산을 사용하세요. 신규 입력, 캐시 읽기·쓰기, 추론 출력, 등급, 컨텍스트 구간, 도구 요금의 사용 기록을 검토하세요. 각 변경 이후 수용 품질 대비 절감을 비교하세요.

Conclusion

GPT-6.1 Sol은 Sol 등급 가격에서 복잡한 추론이 필요하고 안정적인 컨텍스트를 재사용할 수 있는 워크플로우에 유리합니다. Standard의 $2/$10 헤드라인 요율을 유지하면서 단문맥 캐시 읽기를 $0.10/M으로 낮췄습니다. Astra는 더 높은 토큰 요율을 갖지만, 선택은 워크로드 품질과 수용 작업당 비용을 따라야 합니다.

요청당 추정을 시작하고, 캐시 쓰기와 읽기를 분리하며, 272K 경계에 유의하세요. 그런 다음 전체 에이전트 경로를 측정하고 지연/가용성에 맞는 처리 등급을 선택하세요. CometAPI는 별도의 가격표를 제공합니다. 규모 확장 전에 실제 계정과 도구 조건을 확인하세요.

FAQ

실패하거나 취소된 요청은 GPT-6.1 Sol 예산에서 어떻게 처리해야 하나요?

완료, 미완료, 실패, 취소된 요청의 공급자 사용량을 별도로 추적하세요. 모든 실패 요청이 무료라고 가정하거나 모든 클라이언트 취소가 서버 측 작업을 방지한다고 가정하지 마세요. 요청 식별자와 사용량을 청구 기록과 대조하고, 수용 작업 계산에 과금된 실패 작업을 포함하세요. HTTP 상태로부터 유추하지 말고 공급자별 과금 및 환불 규칙을 확인하세요.

변동 트래픽에 대해 팀은 GPT-6.1 Sol 비용을 어떻게 예측해야 하나요?

입력 구간, 처리 등급, 캐시 구성, 워크로드별로 트래픽을 세분화하세요. 평균 프롬프트 하나 대신 측정된 토큰 및 완료 분포를 사용하세요. 적중률 저하, 재시도 증가, 출력 길이 증가 시나리오와 함께 기준 예측을 구축하고, 272K를 넘는 비중도 모니터링하세요. 작업 구성 변화에 따라 예측을 업데이트하세요.

팀은 GPT-6.1 Sol 예측과 청구서를 어떻게 대사해야 하나요?

완료된 청구 기간을 선택하고 라우트, 처리 등급, 입력 구간별로 요청을 그룹화하세요. 조정, 도구 요금, 적용 가능한 세금 또는 환율 변환을 포함해 송장 범주와 크레딧을 대조하세요. 설명되지 않은 보정 계수를 적용하기보다, 요청 식별자와 청구 타임스탬프를 사용해 불일치를 조사하세요. 예측 변경 전 지연 보고와 공급자 반올림 규칙을 확인하세요.

학습 계속하기

이 글을 다음 결정과 연결하세요.

모든 주제 보기
게시일 Oct 10, 2026
최종 업데이트 Oct 10, 2026
0 회 조회
명확성, 출처 표기 및 최신 API 용어에 대해 검토되었습니다.

더 보기