GPT-5.6 Luna price down 80%, Terra down 20% →

2026년 7월 모델 러시: GPT-5.6, Gemini 3.6 Flash, Grok 4.5, Kimi K3 등

CometAPI
AnnaAug 1, 2026
2026년 7월 모델 러시: GPT-5.6, Gemini 3.6 Flash, Grok 4.5, Kimi K3 등

TL;DR: 2026년 7월 약 3주 사이에 여섯 개의 주요 모델이 연달아 공개되었다: OpenAI의 3단계 GPT-5.6 제품군(Sol/Terra/Luna), Google's Gemini 3.6 Flash, xAI의 Grok 4.5, Moonshot AI의 Kimi K3, Anthropic의 Claude Opus 5, 그리고 Zhipu의 GLM-5.2. 만능의 단일 최적 선택지는 없다. 실제 결정은 추론 깊이, 코딩 성능, 토큰당 비용, 컨텍스트 요구 사항, 그리고 오픈 가중치 배포 여부에 달려 있다. 본 비교는 각 제공업체의 최신 공식 정보와 CometAPI 목록을 기반으로 하며, 벤치마크 주장은 단일 보편 순위로 취급하지 않고 출처를 명기해 제시한다.

핵심 정리:

  • GPT-5.6은 단일 모델이 아니라 — 세 가지(Sol, Terra, Luna)이며 서로 다른 가격대이다. 잘못된 티어를 고르는 것이 아예 다른 모델 패밀리를 고르는 것보다 비용 측면에서 더 큰 실수일 수 있다.
  • Gemini 3.6 Flash와 GLM-5.2는 모두 1,000,000 토큰 컨텍스트 윈도우를 공개했으며, Kimi K3도 동일한 수치를 제시한다 — 이 세대 선도 모델들 사이에서 컨텍스트 크기는 더 이상 차별화 요소가 아니다.
  • GLM-5.2와 Kimi K3는 모두 오픈 가중치 배포를 지원하지만, 라이선스는 다르다. GLM-5.2는 MIT License로 배포되며, Kimi K3는 별도의 Kimi K3 License를 사용하므로 자체 호스팅이나 모델-서비스 제공 전에 상업적 조건을 확인해야 한다.
  • Claude Opus 5는 공식 출시되었다. Anthropic는 2026년 7월 24일 1M 토큰 컨텍스트, 최대 128K 동기 출력, 그리고 공식 요금(백만 입력 토큰당 $5, 백만 출력 토큰당 $25)을 발표했으며, CometAPI에는 현재 $4/$20로 게재되어 있다.

이번 달 실제 출시 현황

2026년 7월은 프런티어 및 준(準)프런티어 모델 출시가 유난히 밀집한 달이었다. 약 3주 사이에 OpenAI가 GPT-5.6 제품군(7월 9일), xAI가 Grok 4.5(7월 8일), Moonshot AI가 Kimi K3(7월 16일), Google이 Gemini 3.6 Flash(7월 21일), 그리고 Anthropic가 Claude Opus 5(7월 24일)를 각각 공개했다. Zhipu의 GLM-5.2는 6월에 약간 앞서 공개되었지만, 1M 토큰 컨텍스트와 MIT 라이선스 기반의 오픈 릴리스를 제공해 동일한 구매·배포 결정에 관련성이 높다.

이들 모델을 기반으로 구축하려는 이들에게 실질적인 질문은 추상적으로 “무엇이 최고인가”가 아니라, “확정된 옵션 중 어떤 것이 특정 업무에 맞는가”이다. 여섯 모델은 비용, 컨텍스트, 코딩 동작, 라이선스, 배포 유연성에서 의미 있게 다르다.

가격과 사양, 한눈에 비교

아래 모든 가격은 백만 토큰 기준이다. 티어가 여러 개인 모델은 각 티어를 별도로 표기했다.

모델입력출력컨텍스트 윈도우라이선스출시일
GPT-5.6 Sol$5.00$30.00공개적으로 명시되지 않음독점Jul 9, 2026
GPT-5.6 Terra$2.50$15.00공개적으로 명시되지 않음독점Jul 9, 2026
GPT-5.6 Luna$1.00$6.00공개적으로 명시되지 않음독점Jul 9, 2026
Grok 4.5$2.00$4.00공개적으로 명시되지 않음독점Jul 8, 2026
Kimi K3$3.00$15.001,048,576 토큰오픈 가중치(Kimi K3 License)Jul 16, 2026
Gemini 3.6 Flash$1.50$7.501,048,576 토큰(출력 65,536)독점Jul 21, 2026
GLM-5.2$1.40$4.411,000,000 토큰오픈(MIT License)Jun 13, 2026
Claude Opus 5$5.00$25.001,000,000 토큰(출력 128K)독점Jul 24, 2026

*위 표에는 공식 제공업체 요금을 표시했다. 통합 API가 표준 할인을 적용한다면 각 요금은 비례해 낮아질 것이다 — 이 표의 요지는 특정 벤더의 결제 금액이 아니라 모델 간 상대적 격차다.

가격과 사양 표에서 몇 가지가 눈에 띈다. 최상위 티어인 Sol은 일상적 사용이 아니라 프런티어급 추론과 에이전트형 작업을 겨냥한 가격이며, Grok 4.5는 포지셔닝 대비 출력 단가가 비교적 낮다. GLM-5.2는 이 그룹에서 가장 낮은 출력 단가를 제시하고, MIT License를 사용한다. Kimi K3 역시 다운로드 가능한 가중치와 1M 토큰 컨텍스트를 제공하지만, MIT가 아닌 Kimi K3 License로 배포된다. Gemini 3.6 Flash, Kimi K3, GLM-5.2, Claude Opus 5는 모두 대략 1M 토큰 컨텍스트를 공개하고 있어, 이제 컨텍스트 용량만으로는 선택을 가르기 어렵다. CometAPI에 게시된 요금은 대체로 제공업체 리스트가보다 낮지만, 토큰 가격만 비교하기보다 실제 워크로드에 대한 평가가 더 유의미하다.

각 모델의 실제 튜닝 방향

GPT-5.6 Sol은 프런티어 추론, 에이전트형 코딩, 장기 지평의 기술 작업을 목표로 한다 — "Max Reasoning Effort" 모드와 병렬 서브-에이전트를 활용하는 "Ultra Mode"를 지원한다. 가격 격차를 고려하면, 일상 업무가 아니라 난도 높은 다단계 문제에 적합하다.

GPT-5.6 Terra는 균형 잡힌 미들 티어 — 일상 생산성, 문서화, 코딩 보조, 비즈니스 자동화에 초점을 둔다. Sol의 추론 깊이가 특별히 필요하지 않은 대부분의 애플리케이션 백엔드에는 Terra가 더 방어적인 기본값이다.

GPT-5.6 Luna는 경량·대량 트래픽 용도: 분류, 고객지원 플로우, 온보딩, 반복적 콘텐츠 생성 등을 겨냥한다. 백만 토큰당 $1.00/$6.00(게이트웨이 할인 전)이라는 가격은 바로 그런 고호출·저복잡 워크로드에 맞춰져 있으며, 표준 입력 단가 대비 90% 할인되는 캐시된 입력 요금도 지원한다. 이는 반복이 많은 대량 워크로드 특성상 상위 티어보다 더 큰 의미가 있다.

Grok 4.5는 GPT-5.6 티어처럼 명확한 전문화를 공표하진 않았지만, 가격은 보급형과 중간급 사이에 위치한다 — 가격만으로 포지셔닝을 단정하기보다, 특정 워크로드에 대해 Terra나 Kimi K3와 직접 벤치마크 비교해볼 만하다.

Kimi K3는 2.8조 파라미터 Mixture-of-Experts 모델로, 장기 지평 코딩, 멀티모달 지식 작업, 그리고 1M 토큰 컨텍스트 내 대규모 문서·리포지토리 분석을 목표로 한다. Moonshot AI는 전체 가중치를 공개해 자체 호스팅이 가능하지만, 배포는 Kimi K3 License를 사용하며 표준 MIT 릴리스와 상업적 조건이 다르다.

Gemini 3.6 Flash는 Google의 효율성 중심 릴리스다: 새로운 프런티어 모델이라기보다 3.5 Flash의 점진적 개선판으로, 코딩·에이전트 벤치마크에서의 실질적 향상과 함께 이전작보다 낮은 출력 단가를 제시한다. 완료당 비용과 토큰 효율이 원시 성능만큼 중요한 에이전트형 워크로드에 적합하다.

GLM-5.2는 이 비교군에서 더 관대한 오픈 라이선스를 가진 옵션이다. Z.ai는 이를 MIT License로 공개하고 1M 토큰 컨텍스트, 장기 지평 코딩, 도구 사용, 조정 가능한 사고 노력(thinking effort)을 강조했다. 팀은 API로 접근하거나 공개된 가중치를 로컬에서 실행할 수 있으며, 이는 자체 인프라·평가 요건에 좌우된다.

코딩 역량 비교

여섯 릴리스는 서로 다른 엔지니어링 패턴을 겨냥하므로, 코딩 능력은 단일 순위보다 워크로드 적합성으로 이해하는 편이 낫다.

  • Claude Opus 5는 어려운 디버깅, 근본 원인 분석, 대규모 리팩터링, 장시간 구동 소프트웨어 에이전트에 가장 적합하다. Anthropic는 더 강한 검증·반복 행동을 강조한다.
  • GPT-5.6 Sol, Terra, Luna는 복잡한 코딩·추론부터 균형 잡힌 개발 업무, 대량 코드 보조까지 티어를 따라 경로를 제공한다.
  • Gemini 3.6 Flash는 지연·반복당 비용이 중요한 빠른 에이전트형 코딩 루프에 맞춰 튜닝되었다.
  • Kimi K3는 매우 큰 리포지토리에 대한 장기 지평 코딩을 위해 설계되었으며, 1M 토큰 컨텍스트와 다운로드 가능한 가중치를 제공한다.
  • GLM-5.2는 장기 지평 코딩, 도구 사용, 조정 가능한 사고 노력, MIT 라이선스의 로컬 배포를 결합한다.
  • Grok 4.5는 GPT 계열처럼 코딩 특화 분해가 공개되지 않았으므로, 다른 모델과의 직접 평가 대상으로 다루는 것이 좋다.

이렇게 자주 비교(그리고 교체)할 때의 트레이드오프

이 글은 매 출시마다 쫓아가라는 주장이 아니다. 신규 모델로 프로덕션 워크로드를 바꿀 때마다 실제 비용이 든다: 프롬프트 재테스트, 출력 품질 재검증, 벤치마크의 합성 수치가 아니라 실제 트래픽을 기준으로 완료당 비용을 다시 계산해야 한다. 통합 API는 이러한 평가 작업을 없애주진 않지만, 비교 자체를 실행하는 데 필요한 별도 계정·결제의 오버헤드는 없애준다 — 동일한 요청 형태와 하나의 청구서로 GPT-5.6 Terra, Gemini 3.6 Flash, Kimi K3, GLM-5.2를 호출할 수 있으면, 기존에 키가 있는 제공업체를 그냥 기본값으로 택하는 대신, 실제로 둘 이상의 후보를 테스트하기가 현실적으로 쉬워진다.

이는 분명한 이점이지만 완전한 해법은 아니다 — 각 모델의 실제 문서를 읽는 일을 대체하지 않으며, 앞서 말한 전환 비용을 없애주지도 않는다. 다만 특정 워크로드에 실제로 맞는 모델을 찾아내는 비용을 낮춰 준다. 이는 “이 모델이 최고다”라는 주장과는 다른(그리고 더 정직한) 이야기다.

FAQ

2026년 7월에 출시된 AI 모델 가운데 무엇이 최고인가? 단일한 정답은 없다. GPT-5.6 Sol과 Claude Opus 5는 고난도 추론·코딩을 겨냥하고, Gemini 3.6 Flash는 효율적인 에이전트 루프를 강조한다. Kimi K3는 긴 컨텍스트와 오픈 가중치를 결합하며, GLM-5.2는 장기 지평 능력과 MIT 라이선스를 결합한다. 올바른 선택은 워크로드와 배포 제약에 달려 있다.

GPT-5.6은 하나인가, 여러 개인가? 세 가지다: Sol(플래그십, 프런티어 추론), Terra(균형·일상용), Luna(빠르고 저비용, 대량 작업) — 각자 별도 가격이며, Luna는 백만 토큰당 $0.80/$4.80부터 Sol은 $4.00/$24.00까지다.

Claude Opus 5는 공식 출시되었나? 그렇다. Anthropic는 2026년 7월 24일 Claude Opus 5를 발표했다. 공식 발표는 1M 토큰 컨텍스트를 설명하고, 복잡한 에이전트형 코딩과 지식 작업을 위한 모델로 포지셔닝한다. 공식 API 가격은 백만 입력 토큰당 $5, 백만 출력 토큰당 $25다.

이 중 어떤 모델이 대규모 운영에서 가장 저렴한가? 표의 제공업체 기준 출력 가격으론 GLM-5.2가 가장 낮으며 MIT License로 제공된다. Kimi K3도 오픈 가중치를 제공하지만, 별도의 Kimi K3 License와 훨씬 큰 모델 규모 때문에 자체 호스팅의 경제성이 달라진다. GPT-5.6 Luna는 여기서 다루는 옵션 중 최저가의 독점·API 전용 모델이다.

한 모델을 정해 커밋해야 하나, 여러 개를 테스트할 수 있나? 프로덕션 투입 전에 실제 프롬프트·트래픽으로 둘 이상을 테스트할 가치는 대체로 있다 — 통합 API(CometAPI 등)는 비교 실행에 필요한 별도 계정 오버헤드를 없애줘 이를 특히 저렴하게 해준다. 다만 각 모델의 문서를 읽는 일을 대체하진 않는다.

결론

2026년 7월의 출시 물결은 단 하나의 명확한 승자를 내지 않았다. 추론 깊이, 코딩 성능, 토큰 비용, 컨텍스트, 라이선스에서 서로 다른 트레이드오프를 지닌 여섯 가지 확정 옵션을 내놓았다. GPT-5.6 Sol과 Claude Opus 5는 가장 어려운 추론·소프트웨어 엔지니어링 작업을 겨냥하고, Gemini 3.6 Flash와 GPT-5.6 Luna는 효율을 강조한다. Kimi K3는 자체 라이선스 하의 오픈 가중치와 1M 토큰 멀티모달 컨텍스트를 제공하며, GLM-5.2는 1M 토큰, MIT 라이선스 대안을 제시한다. 모두 CometAPI 하나의 키로 접근할 수 있어 통제된 테스트가 쉬워지지만, 모델 선택은 결국 실제 워크로드의 프롬프트, 도구, 지연 목표, 성공 기준에 기반해야 한다.

AI 개발 비용을 20% 절감할 준비가 되셨나요?

몇 분 안에 무료로 시작하세요. 무료 체험 크레딧 제공. 신용카드 불필요.

더 보기