요약: CometAPI Changelog는 2026년 8월에 텍스트, 멀티모달, 이미지, 비디오 작업 전반에서 15개의 신규 모델 ID를 기록했습니다. 비디오는 Seedance 2.5 또는 Wan3.0부터 시작하고, 비용에 민감한 멀티모달 작업에는 GLM 5.3 Flash를, 코딩과 롱컨텍스트 작업에는 Gemini 3.7 Flash를 권장합니다. 배포 전에는 라이브 모델 페이지, 엔드포인트, 가격을 반드시 확인하세요.
2026년 8월 CometAPI에 어떤 새로운 AI 모델이 추가되었나요?
CometAPI의 2026년 8월 모델 요약은 모든 모델이 하나의 API 키와 하나의 과금 워크플로우로 제공되고, 안정적인 카탈로그 ID, 문서화된 엔드포인트, 모델별 가격이 있다는 점에서 유용합니다. 개발자는 전체 통합을 재구축하지 않고도 모델 ID를 전환할 수 있으며, 각 공급자에 가장 적합한 네이티브 또는 호환 요청 형식을 계속 사용할 수 있습니다.
2026년 9월 1일 기준, 공식 CometAPI Changelog는 8월 릴리스 타이밍의 출처이며 텍스트 추론, 비주얼 이해, 이미지 생성, 비디오 전반에 걸쳐 15개의 신규 모델 ID를 기록합니다. 현재 가용성과 가격의 출처는 Models Catalog 및 개별 모델 페이지입니다. 최우선 테스트 모델로는 멀티모달 비디오용 Seedance 2.5, 프로덕션 비디오 워크플로우용 Wan3.0, 비용 민감 멀티모달 추론용 GLM 5.3 Flash, 코딩과 롱컨텍스트 작업용 Gemini 3.7 Flash를 권장합니다.
CometAPI 2026년 8월 모델 릴리스 요약
| 모델 / ID | 모달리티 | 현재 CometAPI 요금(2026년 9월 3일 기준) | 권장 엔드포인트 |
|---|---|---|---|
| Gemini 3.7 Flash gemini-3.7-flash | 멀티모달 → 텍스트 | 입력 $0.60 / 출력 $3.00 (100만 토큰당) | POST /v1beta/models/{model}:generateContent |
| Grok 4.6 grok-4.6 | 텍스트, 이미지 → 텍스트 | 입력 $1.60 / 출력 $4.80 (100만 토큰당) | POST /v1/chat/completions POST /v1/responses |
| GLM 5.3 glm-5.3 | 텍스트 → 텍스트 | 입력 $1.12 / 출력 $3.528 (100만 토큰당) | POST /v1/chat/completions |
| DeepSeek V4 Flash Vision deepseek-v4-flash-vision | 텍스트, 이미지 → 텍스트 | 입력 $0.352 / 출력 $1.056 (100만 토큰당) | POST /v1/chat/completions |
| Grok Imagine Image 2.0 grok-imagine-image-2.0 | 텍스트, 이미지 → 이미지 | 요청당 $0.032 | POST /v1/images/generations |
| GLM 5.3 Flash glm-5.3-flash | 텍스트, 이미지, 비디오 → 텍스트 | 입력 $0.06 / 출력 $0.20 (100만 토큰당) | POST /v1/chat/completions |
| Seedance 2.5 seedance-2-5 | 멀티모달 → 비디오 | 초당 $0.0824부터; 상세 과금: 초당 $0.103(480p), 초당 $0.231(720p) | POST /v1/videos |
| Qwen3.8 Max qwen3.8-max | 멀티모달 → 텍스트 | 입력 $1.60 / 출력 $4.80 (100만 토큰당) | POST /v1/chat/completions POST /v1/responses |
| MiniMax H3 minimax-h3 | 텍스트, 이미지, 비디오, 오디오 → 비디오 | 초당 $0.064부터; 게시 요금: 초당 $0.08(768p), 초당 $0.13(2K) | POST /v1/videos GET /v1/videos/{task_id} |
| DeepSeek V4 Pro 0813 deepseek-v4-pro-0813 | 텍스트 → 텍스트 | 입력 $0.528 / 출력 $1.584 / 캐시 읽기 $0.0176 (100만 토큰당); 명시된 UTC 창에서 2× | POST /v1/chat/completions |
| FLUX 3 flux-3 | 멀티모달 → 비디오 | $0.136/s (720p); $0.232/s (1080p) | POST /v1/videos GET /v1/videos/{task_id} |
| Qwen3.8 2.4T A95B qwen3.8-2.4t-a95b | 텍스트 → 텍스트 | 입력 $1.60 / 출력 $4.80 (100만 토큰당) | POST /v1/chat/completions |
| Grok Imagine Video 1.5 grok-imagine-video-1.5 | 텍스트, 이미지 → 비디오 | 이미지 입력 $0.008; 출력: 초당 $0.064(480p), 초당 $0.112(720p), 초당 $0.20(1080p) | POST /grok/v1/videos/generations GET /grok/v1/videos/{request_id} |
| Wan3.0 wan3.0 | 텍스트, 이미지 → 비디오 | 초당 $0.04부터; 게시 요금: 초당 $0.05(480p), 초당 $0.10(720p), 초당 $0.20(1080p) | POST /v1/videos |
| Qwen3.8 Flash qwen3.8-flash | 멀티모달 → 텍스트 | 입력 $0.12 / 출력 $0.376001 (100만 토큰당) | POST /v1/chat/completions |
이 표는 CometAPI 8월 Changelog에 기록된 15개 추가분 중 우선순위 모델을 강조하며, CometAPI가 명시한 기간 한정 할인 가격도 포함합니다. 벤치마크 주장은 공급자와 발표 시점이 다르므로, 통합 계획과 탐색에는 카탈로그를 사용하고, 보편적인 정면 비교표로 쓰지 않는 것이 좋습니다.
gpt-5.6-sol과 minimax-m3의 가격만 변경된 업데이트, 기존 DeepSeek 모델의 서비스 조정은 신규 릴리스로 간주하지 않습니다.
8월에 강력히 추천하는 모델 4개
8월 카탈로그는 폭넓지만, 다양한 워크로드에 특히 돋보이는 네 개 모델이 있습니다. 아래 추천은 가격표 반복 대신 실용적 적합성에 초점을 둡니다. 프로덕션 사용 전 각 모델 페이지에서 라이브 요율과 요청 형식을 확인하세요.
Seedance 2.5: 더 긴 멀티모달 비디오
비디오는 초당 과금되며 해상도에 따라 요금이 달라집니다. 스냅샷 날짜를 보존하고 라이브 모델 페이지로 연결을 유지하세요. Seedance 2.5의 경우 480p 클립은 초당 $0.103, 720p 클립은 초당 $0.231로 두 배 이상이므로, 실제 사용하는 해상도에 맞춰 예산을 책정하십시오.
Wan3.0: 더 낮은 진입 가격의 프로덕션 비디오
Wan3.0은 텍스트-투-비디오 및 이미지-투-비디오 워크플로우에서 이제 라이브입니다. 비동기 프로덕션 엔드포인트, 예측 가능한 초당 과금, 다른 비디오 모델과의 속도, 모션 품질, 해상도 비교가 필요한 팀에 실용적인 선택입니다.
GLM 5.3 Flash: 저비용 멀티모달 추론
GLM 5.3 Flash는 텍스트와 이미지 이해의 비용 중심 선택지입니다. 추출, 비주얼 질의응답, 코딩 보조, 지연과 비용이 최대 성능보다 중요한 에이전트 단계에 테스트해 보세요.
Kimi K3: 롱컨텍스트 코딩과 지식 작업
Kimi K3는 7월에 출시되었지만 8월에도 채택 가치가 높은 모델로 남았습니다. 100만 토큰 컨텍스트와 OpenAI 호환 채팅 경로를 제공하여 대규모 리포지토리, 연구 종합, 장시간 코딩 워크플로우에 유용합니다.
사용 사례별로 어떤 신규 AI 모델을 써야 하나요?
Gemini 3.7 Flash: 코딩과 롱컨텍스트 작업
공개 신호는 소프트웨어 엔지니어링과 지식 작업을 강조하지만, 유용한 프로덕션 테스트는 본인의 리포지토리나 문서 세트입니다. 고정 프롬프트 팩을 실행하고, 수락된 작업 비율, 지연, 과금된 토큰을 기록한 뒤 현재 사용하는 모델과 결과를 비교하세요.
비디오 모델: 모션, 레퍼런스 충실도, 승인 클립당 비용
Seedance 2.5, Wan3.0, MiniMax H3에 대해 동일한 프롬프트, 길이, 종횡비, 레퍼런스 이미지를 사용하세요. 모션 일관성, 프롬프트 충실도, 시각적 아티팩트, 생성 시간, 검수를 통과한 클립당 비용을 점수화합니다.
멀티모달 모델: 최대 컨텍스트보다 정확도 우선
GLM 5.3 Flash, DeepSeek V4 Flash Vision, Gemini 3.7 Flash로 스크린샷, 차트, PDF, 텍스트-이미지 혼합 입력을 테스트하세요. 큰 컨텍스트 윈도우의 가치는 모델이 올바른 증거를 회수하고 안정적인 답을 생성할 때에만 의미가 있습니다.
DeepSeek V4 Flash Vision: 비주얼 코딩 에이전트, 차트 분석, 스크린샷, 브라우저 자동화 입력에 사용하세요. 자체 혼합 텍스트-이미지 작업으로 벤치마킹하고, 프로덕션 도입 전 정확도, 지연, 과금된 토큰을 비교하세요.
Grok Imagine Image 2.0: 생성+편집 파이프라인, 다양한 종횡비, 제품 크리에이티브, 레퍼런스 기반 반복에 사용하세요. 가장 낮은 시작가만 보지 말고 워크로드가 요구하는 품질과 해상도에 맞춰 예산을 잡으세요.
CometAPI 출시 예정: 관찰 목록
2026년 9월 3일 기준, 이 관찰 목록에는 CometAPI 페이지에 Coming Soon으로 표시된 모델만 포함됩니다. 카탈로그가 라이브 프로덕션 접근을 확인할 때까지 모델 ID, 경로, 가격을 잠정적인 것으로 취급하세요.
| 모델 | 모델 ID | 상태 | 결정 |
|---|---|---|---|
| Qwen-Image-3.0 | qwen-image-3.0 | Coming Soon | 관찰 목록; 아직 프로덕션 트래픽을 계획하지 마세요. |
| Veo 4 | veo4 | Coming Soon | 라이브 경로와 과금이 확인될 때까지 프로덕션 사용을 대기하세요. |
CometAPI에서 OpenAI 호환 및 네이티브 API를 어떻게 호출하나요?
CometAPI는 하나의 API 키와 과금 워크플로우를 사용하지만, 모든 공급자를 하나의 요청 형태로 강제하지는 않습니다. 모델 페이지에서 가장 적합한 경로를 선택하세요: Gemini는 네이티브 Gemini 콘텐츠 생성, 많은 LLM은 OpenAI 호환 채팅, 이미지 모델은 이미지 엔드포인트, 비디오 모델은 비동기 비디오 API를 사용합니다. 아래의 짧은 POST 예시는 경로와 model 필드만 보여줍니다. 전체 파라미터는 API 문서를 참조하세요.
- 텍스트 및 멀티모달 LLM 예시: POST https://api.cometapi.com/v1beta/models/gemini-3.7-flash:generateContent
- 이미지 생성: POST
https://api.cometapi.com/v1/images/generations - 비디오 생성: POST
https://api.cometapi.com/v1/videos
POST 경로는 모달리티에 따라 달라집니다. Gemini는 네이티브 /v1beta/models/{model}:generateContent와 호환 패턴 모두를 지원하며, Grok Imagine Image 2.0은 /v1/images/generations, Seedance 2.5는 /v1/videos를 사용한 뒤 작업 상태 폴링이 이어집니다. 진실의 단일 소스로 Text API, Image API, Video API를 사용하세요.
자주 묻는 질문(FAQ)
개발자를 위한 최고의 AI API 어그리게이터는 무엇인가요?
텍스트 LLM만 필요한지, 텍스트·이미지·오디오·비디오까지 넓은 스택이 필요한지에 따라 달라집니다. 라이브 모델 ID, 엔드포인트 호환성, 사용 가시성, 폴백 지원, 과금 투명성, 카탈로그 신선도로 각 어그리게이터를 평가하세요. 여러 모달리티에서 하나의 키와 하나의 과금 워크플로우가 우선이라면 CometAPI를 후보군에 둘 가치가 있습니다.
2026년 8월 모델 중 실제로 CometAPI에서 라이브인 것은 무엇인가요?
9월 1일 기준, 8월 Changelog는 15개의 신규 모델 ID를 기록합니다. 완전한 목록, 지원 형식, 가격 메모는 위 표에 요약되어 있습니다. 가용성, 별칭, 가격은 변동될 수 있으므로 배포 전에는 Models Catalog를 다시 확인하세요.
전체 SDK를 바꾸지 않고 공급자를 전환할 수 있나요?
종종 가능하지만 항상 그런 것은 아닙니다. 많은 텍스트 모델이 /v1/chat/completions를 지원하는 반면, Gemini는 네이티브 콘텐츠 생성 경로도 사용할 수 있고, 미디어 모델은 이미지, 리얼타임, 비디오 엔드포인트를 사용합니다. CometAPI는 이러한 형식 전반에서 하나의 키와 과금 워크플로우를 유지하므로, 요청 본문이 동일하지 않더라도 공급자 전환이 더 간단합니다.
비디오 생성은 어떻게 작동하나요?
비디오 생성은 비동기입니다. 작업을 생성하고 반환된 task ID를 저장한 뒤, 작업이 성공 또는 실패할 때까지 폴링하거나 웹훅을 수신하세요. 완료 후에만 애플리케이션이 결과를 가져와 저장해야 합니다.
모델 ID와 가격은 얼마나 자주 재확인해야 하나요?
통합 전에, 프로덕션 롤아웃 전에, 대규모 배치 전에 확인하세요. 자동화 시스템은 또한 각 비용 추정에 사용한 정확한 모델 ID와 가격 스냅샷을 기록하여, 이후 카탈로그 변경이 배포 결정의 이력을 바꾸지 않도록 해야 합니다.
결론
CometAPI의 8월 15개 추가는 코딩, 비전, 이미지, 비디오 전반에서 실용적인 선택지를 확장하면서 하나의 키와 하나의 과금 워크플로우를 유지합니다. 워크로드에 따라 Seedance 2.5, Wan3.0, GLM 5.3 Flash, Gemini 3.7 Flash부터 시작한 뒤, 고정 프롬프트 테스트로 품질, 지연, 신뢰성, 과금 비용을 측정해 모델을 승격하세요.
