TL;DR
AI 이미지 API 가격은 직접 비교하기 어렵습니다. GPT Image 2는 이미지 토큰을, Nano Banana 2는 해상도 연동을, FLUX.2는 메가픽셀 기준을, Ideogram 4.0은 이미지당 요금제를 사용합니다. 프로덕션 팀에 더 유용한 지표는 재시도, 이미지 입력, 편집 및 기타 워크플로 비용까지 반영한 실제 지출, 즉 사용 가능한 이미지당 비용입니다.
AI 이미지 생성은 더 저렴해졌지만, API 가격 비교는 더 복잡해졌습니다.
GPT Image 2 출력은 달러의 수천분의 일 수준까지 내려갈 수 있는 반면, Ideogram은 이미지당 고정 요금을, FLUX.2는 메가픽셀 기준으로 과금합니다. 숫자만 보면 간단히 비교할 수 있어 보이지만, 과금 체계가 서로 다르고 참조 이미지, 재시도, 후처리 등의 비용이 제외되는 경우가 많습니다.
이 가이드는 현재의 GPT Image 2, Gemini 3.1 Flash Image (Nano Banana 2), FLUX.2, Ideogram 4.0 가격을 비교하고, 프로덕션에서 중요한 비용, 즉 실제로 사용할 수 있는 이미지를 얻는 데 드는 비용을 추정하는 방법을 설명합니다.
AI Image API Pricing at a Glance
| Model | Billing model | Example price | Main cost variables |
|---|---|---|---|
| GPT Image 2 | 이미지 토큰 | 1024×1024 Low 기준 $0.006 | 품질, 크기, 이미지 입력 |
| Gemini 3.1 Flash Image (Nano Banana 2) | 해상도에 매핑된 이미지 토큰 | 1K 기준 $0.067 | 해상도, 입력 토큰, 그라운딩 |
| Gemini 3.1 Flash Lite Image | 해상도에 매핑된 이미지 토큰 | 1K 기준 $0.0336 | 해상도, 입력 토큰 |
| FLUX.2 [klein] 4B | 메가픽셀 기반 | $0.014부터 | 해상도 |
| FLUX.2 max] | 메가픽셀 기반 | $0.07부터 | 해상도, 편집, 그라운딩 검색 |
| Ideogram 4.0 Turbo | 이미지당 과금 | $0.03 | 모델 티어, 추가 도구 |
표시는 2026년 7월 21일 기준 제공업체의 리스트 가격입니다. 재시도, 참조 이미지 입력, 추가 도구, 스토리지, 인력 검수 비용 등이 포함되지 않을 수 있습니다.
실시간 플랫폼 요금은 CometAPI pricing을 참고하세요.
Why AI Image API Prices Are Hard to Compare
이미지 API에는 표준화된 단일 과금 단위가 없습니다.
제공업체에 따라 다음에 대해 비용을 지불할 수 있습니다:
- 이미지 출력 토큰
- 해상도에 연동된 고정 토큰 수
- 메가픽셀
- 생성된 이미지당 고정 가격
- 편집에 사용된 이미지 입력
- 그라운딩, 업스케일링 등 추가 도구
따라서 $0.03/이미지 같은 가격은 $30/백만 이미지 토큰과 직접 비교할 수 없습니다.
의미 있는 비교를 위해 세 가지를 정규화하세요:
해상도, 워크플로 유형, 승인율.
GPT Image 2 Pricing: Quality and Size Drive Cost
OpenAI의 image generation guide에 따르면, GPT Image 2의 일반 해상도별 예상 출력 비용은 다음과 같습니다:
| Quality | 1024×1024 | 1024×1536 | 1536×1024 |
|---|---|---|---|
| Low | $0.01 | $0.01 | $0.01 |
| Medium | $0.05 | $0.04 | $0.04 |
| High | $0.21 | $0.17 | $0.17 |
이 수치는 출력 기준의 추정치이며, 요청 전체 비용을 반드시 의미하지는 않습니다.
OpenAI의 API pricing documentation는 이미지 입력, 캐시된 이미지 입력, 이미지 출력, 텍스트 입력에 대해 별도 요율을 제공합니다.
이는 편집 워크플로에서 특히 중요합니다. 여러 개의 참조/소스 이미지를 전송하면 해당 입력 비용이 요청 총액에 추가됩니다.
구현 세부사항과 프롬프트 패턴은 CometAPI GPT Image 2 guide를 참고하세요.
Nano Banana 2 Pricing: Resolution Maps to Image Tokens
Google의 공식 모델명은 Gemini 3.1 Flash Image이며, 일반적으로 Nano Banana 2로 알려져 있습니다.
Google의 Gemini API pricing에 따르면:
| Model | Resolution | Standard | Batch |
|---|---|---|---|
| Gemini 3.1 Flash Image | 0.5K | $0.05 | $0.02 |
| Gemini 3.1 Flash Image | 1K | $0.07 | $0.03 |
| Gemini 3.1 Flash Image | 2K | $0.10 | $0.05 |
| Gemini 3.1 Flash Image | 4K | $0.15 | $0.08 |
| Gemini 3.1 Flash Lite Image | 1K | $0.03 | $0.02 |
Nano Banana 2는 일반 해상도를 고정 이미지 토큰 수에 매핑합니다. 1K 출력은 1,120개의 이미지 토큰을 사용하며, 표준 요금으로 약 $0.067의 실효 가격이 됩니다.
Nano Banana 2 Lite는 동일한 1K 출력(1,120 토큰)에 더 낮은 이미지 출력 요율을 적용해 $0.0336로 내려갑니다.
Google Web 또는 Image Search로 그라운딩을 수행하면 비용이 추가될 수 있으므로, 검색 의존적 워크플로는 그라운딩 비용을 별도로 추적하세요.
API 사용 세부사항은 Nano Banana 2 API guide를 참고하세요.
FLUX.2 Pricing: Megapixels Change the Baseline
Black Forest Labs는 FLUX.2에 메가픽셀 기반 과금을 사용합니다.
official BFL pricing documentation에 따르면:
| FLUX.2 model | Text-to-image | Image editing |
|---|---|---|
| FLUX.2 [klein] 4B | $0.014부터 | $0.014부터 |
| FLUX.2 [klein] 9B | $0.015부터 | $0.015부터 |
| FLUX.2 [pro] | $0.03부터 | $0.045부터 |
| FLUX.2 [max] | $0.07부터 | $0.07부터 |
| FLUX.2 [flex] | $0.05부터 | $0.05부터 |
중요한 단어는 "from"입니다.
FLUX.2 비용은 출력 해상도에 따라 달라지며, 편집의 시작 가격이 기본 텍스트-투-이미지 생성과 다를 수 있습니다.
FLUX.2를 다른 제공업체와 비교할 때는 최저가가 아니라 실제로 실행할 해상도와 워크플로를 기준으로 비교하세요.
구현 세부사항은 CometAPI FLUX.2 Pro API guide를 참고하세요.
Ideogram 4.0 Pricing: Simple Per-Image Rates
Ideogram 4.0은 주요 워크플로에 대해 단순한 이미지당 과금제를 사용합니다.
Ideogram's official API pricing에 따르면:
| Tier | Price per output |
|---|---|
| Turbo | $0.03 |
| Default | $0.06 |
| Quality | $0.10 |
Instructional Edit, Upscale, Describe, Layerize 등의 추가 작업은 별도 가격이 적용됩니다.
단순 생성에서는 예산 책정이 쉽지만, 전체 에셋 파이프라인에서는 생성 이후 사용하는 추가 도구 비용까지 포함해 계산해야 합니다.
Why Midjourney and Self-Hosted Models Need Separate Pricing Logic
Midjourney는 개발자를 위한 일반 공개 API를 직접 제공하지 않으므로, 공식 구독 가격은 위의 사용량 기반 API들과 직접 비교하기 어렵습니다. 다만 개발자는 CometAPI Midjourney API를 통해 Midjourney 워크플로에 접근할 수 있습니다. MidJourney API는 Discord 버튼 상호작용을 시뮬레이션합니다. 일반적인 REST API와 달리 상태 머신처럼 작동하며, 각 작업은 다음 단계의 새 버튼을 반환합니다.
자가 호스팅 오픈 모델은 전혀 다른 비용 구조를 가집니다. 단순 API 요청당 요금이 아니라 GPU 인프라, 활용률, 호스팅, 엔지니어링, 유지보수에 비용이 좌우됩니다.
따라서 본 비교는 투명한 사용량 기반 가격을 제공하는 제공업체 호스팅 API에 초점을 맞추며, Midjourney API 접근과 자가 호스팅 모델은 별도의 비용 범주로 평가하는 것이 바람직합니다.
The Metric That Matters: Cost per Usable Image
가장 낮은 생성 단가가 항상 최저 프로덕션 비용으로 이어지지는 않습니다.
간단한 지표는 다음과 같습니다:
사용 가능한 이미지당 비용 = 총 변동 지출 ÷ 승인된 이미지 수
생성만 고려한 추정치:
사용 가능한 이미지당 비용 ≈ 공시 생성 가격 ÷ 승인율
| Listed price | Approval rate | Attempts for 100 approved images | Spend | Cost per usable image |
|---|---|---|---|---|
| $0.03 | 60% | 167 | $5.01 | $0.05 |
| $0.07 | 80% | 125 | $8.38 | $0.08 |
| $0.10 | 90% | 112 | $11.20 | $0.11 |
이 승인율 수치는 예시이며, 모델 벤치마크 결과가 아닙니다.
더 저렴한 모델이라도 잦은 재시도가 필요하면, 더 높은 가격의 모델보다 총비용이 더 커질 수 있습니다.
What Else Affects the Real Cost?
프로덕션 비용을 추정할 때 다음도 고려하세요:
Image Inputs and Editing
참조 이미지, 업스케일, 고급 편집 및 기타 처리 단계는 요청 비용을 증가시킬 수 있습니다.
Retries and Failed Requests
거절된 초안과 안전성 관련 실패는 비용과 지연을 모두 늘립니다.
Grounding
검색 기반 그라운딩 워크플로는 별도의 쿼리 비용이 발생할 수 있습니다.
Human Review
API 가격이 낮아도 출력물의 후속 수동 수정이 크게 늘면 전체 비용이 증가할 수 있습니다.
Storage and Delivery
대규모에서는 스토리지, 리사이즈, 포맷 변환, CDN 전송 비용도 중요합니다.
모든 비용을 완벽히 모델링할 필요는 없습니다. 비교 대상 경로 간에 차이가 큰 변수부터 반영하세요.
Batch Pricing: Useful When Latency Is Flexible
OpenAI와 Google 모두 일부 이미지 생성 작업에 대해 더 낮은 배치 요금을 제공합니다.
배치 처리가 잘 맞는 경우:
- 야간 카탈로그 생성
- 대량 마케팅 에셋
- 예약 콘텐츠 파이프라인
- 대규모 평가 실행
사용자가 즉시 결과를 기대하는 인터랙티브 제품에는 덜 적합합니다.
배치 할인은 추가 지연이 워크플로에 부합할 때만 가치가 있습니다.
A Practical Image API Routing Strategy
모든 이미지 요청을 같은 모델로 처리할 필요는 없습니다.
| Stage | Goal | Key metric |
|---|---|---|
| Exploration | 아이디어를 저렴하게 생성 | 초안당 비용 |
| Selection | 약한 콘셉트 제거 | 승인율 |
| Final generation | 프로덕션 품질 달성 | 사용 가능한 이미지당 비용 |
| Editing | 참조 보존 | 편집 성공률 |
| Delivery | 최종 에셋 준비 | 처리 비용 |
실용적인 워크플로:
- 초기 초안은 더 낮은 비용 또는 해상도로 생성합니다.
- 최종 렌더링 전 약한 콘셉트를 제거합니다.
- 어려운 프롬프트 범주는 성능이 가장 좋은 모델로 라우팅합니다.
- 편집 모델은 편집 성공률을 기준으로 선택합니다.
- 비대화형 작업에는 배치 처리를 사용합니다.
- 실제 승인·재시도 데이터를 기반으로 라우트를 재평가합니다.
최적의 프로덕션 구성은 초안, 최종 생성, 편집에 각각 다른 모델을 사용할 수 있습니다.
How to Compare Image APIs Yourself
가장 좋은 비교는 공개 데모 결과가 아니라, 여러분의 프롬프트와 프로덕션 요구사항을 사용하는 것입니다.
CometAPI의 model comparison tool로 지원 모델을 나란히 비교한 뒤, 고려 중인 라우트를 대표 테스트셋으로 실행하세요. 테스트 중 실제 사용량과 지출은 CometAPI 대시보드로 추적합니다.
추천 시작점:
- 제품/라이프스타일 프롬프트 10개
- 텍스트가 포함된 광고/포스터 10개
- 참조 이미지 편집 10개
- 복잡한 구성 프롬프트 10개
각 라우트에 대해 기록하세요:
| Field | Why it matters |
|---|---|
| Dimensions | 해상도 기반 가격을 정규화 |
| Model or quality tier | 가격 차이를 설명 |
| Input images | 편집 비용을 포착 |
| Attempts per approved output | 재시도 비용을 측정 |
| Latency | 워크플로 적합성 측정 |
| Human edit time | 숨은 인력 비용을 포착 |
| Final approval | 승인율 계산 |
이미지 생성은 확률적이므로 프롬프트는 여러 번 실행하세요.
그다음 계산합니다:
승인율 = 승인된 출력 ÷ 총 출력
사용 가능한 이미지당 비용 = 워크플로 총 지출 ÷ 승인된 출력
이렇게 하면 제공업체의 가격 페이지를 비교하는 것보다 훨씬 유용한 프로덕션 벤치마크를 얻을 수 있습니다.
FAQ
가장 저렴한 AI 이미지 API는 무엇인가요?
보편적인 최저 옵션은 없습니다. GPT Image 2 Low, FLUX.2 [klein], Nano Banana 2 Lite, Ideogram 4.0 Turbo는 비교적 낮은 시작가를 제공하지만, 실제 프로덕션 비용은 해상도, 재시도, 편집, 지연, 승인율에 따라 달라집니다.
GPT Image 2는 이미지당 얼마인가요?
OpenAI가 공개한 추정치는 일반적인 Low 품질 출력의 경우 약 $0.005–$0.006에서, High 품질 1024×1024 이미지는 $0.211까지입니다. 이미지 및 텍스트 입력 비용이 총 요청 비용에 추가될 수 있습니다.
Nano Banana 2는 얼마인가요?
Gemini 3.1 Flash Image(Nano Banana 2)는 표준 1K 이미지가 약 $0.067입니다. Nano Banana 2 Lite는 1K 이미지가 $0.0336입니다.
FLUX.2는 얼마인가요?
FLUX.2는 메가픽셀 기반 가격을 사용합니다. 현재 텍스트-투-이미지 시작가는 모델과 해상도에 따라 FLUX.2 [klein] 4B의 $0.014부터 FLUX.2 [max]의 $0.07까지입니다.
프로덕션에 가장 적합한 이미지 생성 API는 무엇인가요?
품질, 지연, 해상도, 텍스트 정확도, 편집 일관성 요구사항을 충족하면서 사용 가능한 이미지당 비용이 가장 낮은 라우트가 최적입니다.
Test Multiple Image Models With the Same Workload
CometAPI는 단일 API 플랫폼을 통해 여러 이미지 모델에 접근할 수 있어, 동일한 프롬프트와 평가 프로세스로 다른 라우트를 쉽게 비교할 수 있습니다.
먼저 current CometAPI pricing을 확인한 뒤 다음을 추적하세요:
- 요청 비용
- 해상도
- 지연
- 재시도
- 이미지 입력
- 승인된 출력
저비용 초안에는 한 모델이, 최종 에셋에는 다른 모델이, 참조 중심 편집에는 또 다른 모델이 가장 잘 맞을 수 있습니다.
목표는 영구적인 단 하나의 승자를 고르는 것이 아니라, 각 워크로드에 가장 적합한 라우트를 사용하는 것입니다.
