GPT-6 Astra is now live on CometAPI →
ai-model/Pesquisa CometAPI

GPT-5.6 API: Preços, Sol vs Terra vs Luna, Benchmarks, e Acesso

请提供需要翻译的原文内容或具体片段(可为纯文本、HTML、Markdown、JSON、XML、CSV 或代码中的可见字符串/注释),我将在严格保留结构与技术元素不变的前提下,将其精准翻译为葡萄牙语。

CometAPI
Bobby SpencerEquipe de pesquisa de modelos e API de IA
Atualizado Sep 4, 2026 11 min de leitura
GPT-5.6 API: Preços, Sol vs Terra vs Luna, Benchmarks, e Acesso
Use este padrão

Faça a primeira chamada à API.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

O que você deve saber sobre a API GPT-5.6?

O GPT-5.6 não é mais apenas um item de observação de lançamento. A OpenAI lista os modelos Sol, Terra e Luna como geralmente disponíveis, enquanto a CometAPI documenta o acesso por meio de uma API compatível com a OpenAI. Em 2 de setembro de 2026, a página do modelo GPT-5.6 da CometAPI lista preços de tokens para contexto curto 20% abaixo das tarifas atuais da API Padrão da OpenAI para os três níveis.

A escolha prática não é simplesmente “usar o modelo mais novo”. Use gpt-5.6-sol para o trabalho mais difícil de codificação e raciocínio, gpt-5.6-terra quando capacidade e custo importam, e gpt-5.6-luna para tarefas de alto volume e bem delimitadas. Equipes que já usam o SDK da OpenAI podem testar a família por meio da CometAPI definindo a URL base como https://api.cometapi.com/v1, fornecendo uma chave da CometAPI e escolhendo um ID de modelo explícito.

Quanto custa a API GPT-5.6?

Os preços abaixo foram verificados em 2 de setembro de 2026. São em dólares americanos por 1 milhão de tokens para solicitações com no máximo 272.000 tokens de entrada. As tarifas da CometAPI vêm da página do modelo GPT-5.6; as tarifas diretas vêm do catálogo oficial de modelos da OpenAI.

ModeloEntrada CometAPISaída CometAPIEntrada OpenAISaída OpenAIDiferença listada
gpt-5.6-sol$3.20$16.00$4.00$20.0020% menor
gpt-5.6-terra$1.60$9.60$2.00$12.0020% menor
gpt-5.6-luna$0.16$0.96$0.20$1.2020% menor

As tarifas de leitura e gravação de cache seguem a mesma diferença publicada de 20% na página da CometAPI. Solicitações acima de 272.000 tokens de entrada passam para a categoria de contexto longo para toda a solicitação: as tarifas relacionadas à entrada dobram e as tarifas de saída aumentam em 50%. Como preços e promoções podem mudar, use esta tabela como um instantâneo datado e volte a verificar a página do modelo ou o painel da conta antes de estimar um orçamento de produção.

Uma estimativa simples de custo para uma solicitação é:

estimated_cost =
  (input_tokens / 1,000,000 × input_rate)
  + (output_tokens / 1,000,000 × output_rate)

Por exemplo, uma chamada Terra de contexto curto com 100.000 tokens de entrada não em cache e 10.000 tokens de saída custaria cerca de $0.256 nas tarifas listadas da CometAPI: $0.160 para entrada mais $0.096 para saída. Esta estimativa exclui taxas de ferramentas, novas tentativas e comportamento de cache.

O GPT-5.6 é mais barato via CometAPI?

Sim—na página pública do modelo verificada em 2 de setembro de 2026, a CometAPI lista cada nível do GPT-5.6 20% abaixo da tarifa atual da API Padrão da OpenAI. Para chamadas de contexto curto, Sol custa $3.20/$16, Terra $1.60/$9.60 e Luna $0.16/$0.96 por 1 milhão de tokens de entrada/saída. Isto é pague conforme o uso, e não um desconto por assinatura: a página de preços da CometAPI afirma que o preço para modelos oficiais é a tarifa oficial multiplicada por 0,8, sem assinatura mensal ou gasto mínimo. Há níveis adicionais por volume mensal, enquanto preços empresariais são negociados. Reconfirme a página do modelo ao vivo antes de fazer orçamento, pois promoções e termos em nível de conta podem mudar.

O que acontece quando solicitações do GPT-5.6 excedem 272K tokens?

A categoria superior se aplica a toda a solicitação, não apenas aos tokens acima de 272K. Nas tarifas atuais da CometAPI, Sol passa a $6.40 de entrada/$24 de saída, Terra $3.20/$14.40 e Luna $0.32/$1.44 por 1 milhão de tokens; tarifas de leitura e gravação de cache também dobram. Perto do limite, remova trechos recuperados duplicados, histórico de chat obsoleto, logs de ferramentas verbosos e arquivos-fonte desnecessários antes de enviar a solicitação.

Como se comparam GPT-5.6 Sol, Terra e Luna?

A OpenAI introduziu o GPT-5.6 como uma família de três níveis, e não um único modelo. Sol é a rota carro-chefe, Terra é a rota equilibrada, e Luna é a rota de baixo custo. Os modelos compartilham uma janela de contexto de 1.050.000 tokens e um máximo de saída de 128.000 tokens. Eles aceitam entrada de texto e imagem e produzem saída em texto; áudio e vídeo não são suportados por essas rotas de modelo.

ID do modeloPosiçãoModalidadesContexto / saídaRotas suportadas
gpt-5.6-solCapacidade de pontaTexto e imagem de entrada; texto de saída1.05M / 128K tokensChat Completions, Responses
gpt-5.6-terraEquilíbrio entre capacidade e custoTexto e imagem de entrada; texto de saída1.05M / 128K tokensChat Completions, Responses
gpt-5.6-lunaEficiência para alto volumeTexto e imagem de entrada; texto de saída1.05M / 128K tokensChat Completions, Responses

O alias sem sufixo gpt-5.6 roteia para o GPT-5.6 Sol de acordo com a documentação oficial de modelos da OpenAI. Use um ID explícito de Terra ou Luna quando o controle de custo fizer parte da decisão de roteamento.

O GPT-5.6 está disponível via API?

Sim. A OpenAI lista GPT-5.6 Sol, Terra e Luna como geralmente disponíveis por meio de sua API, com rotas de Chat Completions e Responses documentadas para a família. A disponibilidade foi verificada em 2 de setembro de 2026. Use o ID de modelo exato exigido pela sua carga de trabalho e confirme quaisquer limites de taxa em nível de conta ou restrições regionais antes da implantação em produção.

Gateways de terceiros podem fornecer outro caminho de acesso. A CometAPI documenta gpt-5.6-sol, gpt-5.6-terra e gpt-5.6-luna por meio de formatos compatíveis com a OpenAI de Chat Completions e Responses. Trate uma listagem pública como documentação de rota, e não como garantia de cota: verifique o ID exato na sua conta antes da implantação.

O que mostram os benchmarks publicados do GPT-5.6?

A OpenAI publica resultados de benchmark para os três níveis do GPT-5.6. O pequeno conjunto a seguir é útil porque cobre agentes de codificação, navegação em estilo de pesquisa e recuperação de contexto longo, em vez de repetir um ranking amplo.

AvaliaçãoSolTerraLuna
Artificial Analysis Coding Agent Index v1.180.077.474.6
BrowseComp90.4%87.5%83.3%
MRCR v2, 8-needle, 512K–1M73.8%72.5%41.3%

Fonte: relatório de lançamento do GPT-5.6 da OpenAI. Esses são resultados publicados pelo fornecedor, não testes independentes executados por meio da CometAPI. As pontuações dependem do framework de avaliação, do esforço de raciocínio, das ferramentas e do snapshot do modelo, portanto não devem ser convertidas diretamente em uma alegação de preço versus desempenho para sua aplicação.

Como você deve avaliar o GPT-5.6 antes da produção?

Execute o mesmo conjunto de prompts em Sol, Terra e Luna com o mesmo esforço de raciocínio e limite de saída. Registre sucesso da tarefa, latência, tokens de entrada e saída, novas tentativas e custo total. Um conjunto de prompts em quatro partes geralmente é suficiente para expor as principais diferenças:

  1. Tarefa de repositório: diagnosticar um bug real em múltiplos arquivos e propor um patch com testes.
  2. Tarefa de contexto longo: extrair requisitos conflitantes de uma especificação grande e citar suas localizações.
  3. Tarefa de uso de ferramentas: planejar e executar um fluxo de trabalho delimitado com saídas estruturadas.
  4. Tarefa de alto volume: classificar ou resumir 100 entradas de produção representativas.

Pontue a correção antes do estilo. Em seguida, calcule o custo por tarefa bem-sucedida, não apenas o custo por token. Um modelo mais barato que aciona mais novas tentativas, saídas mais longas ou revisão humana pode ser mais caro em produção. Por outro lado, Luna ou Terra podem superar uma estratégia apenas com o modelo carro-chefe quando a tarefa é bem especificada e repetida em escala.

Qual modelo GPT-5.6 você deve escolher?

Escolha o GPT-5.6 Sol para codificação agente difícil, revisão de arquitetura, síntese de pesquisa, análise de segurança em ambientes autorizados e decisões em que uma resposta falha é cara. É o nível de custo mais alto, então direcione apenas o trabalho que se beneficia de capacidade de ponta.

Escolha o GPT-5.6 Terra para assistentes de codificação do dia a dia, redação técnica, análise de documentos, automação de negócios e cargas de trabalho de produção mistas. É o candidato padrão mais forte quando você quer um modelo para iniciar uma avaliação controlada.

Escolha o GPT-5.6 Luna para extração, classificação, triagem de suporte, etapas de agente repetidas, monitoramento e outras tarefas de alto volume com critérios claros de aceitação. Seu preço de lista baixo é atraente, mas os resultados de benchmark de contexto longo mostram por que as equipes devem testá-lo cuidadosamente antes de usá-lo para recuperação de milhões de tokens ou raciocínio difícil de múltiplas etapas.

O GPT-5.6 não é a melhor opção quando a aplicação requer saída nativa de áudio ou vídeo, um modelo ajustado (fine-tuned) ou um custo fixo independente do uso de tokens. Nesses casos, escolha uma rota projetada para a modalidade ou modelo de implantação exigido, em vez de forçar a família GPT-5.6 no fluxo de trabalho.

Como acessar a API GPT-5.6 pela CometAPI?

A CometAPI é mais útil quando você deseja uma única chave de API e conta de cobrança para GPT-5.6 Sol, Terra, Luna e centenas de outros modelos. Em 2 de setembro de 2026, GPT-5.6 lista tarifas 20% abaixo dos preços da API Padrão da OpenAI, enquanto sua página de preços documenta cobrança pague conforme o uso sem assinatura mensal ou gasto mínimo e níveis adicionais por volume mensal. Para equipes que já usam o SDK da OpenAI, testar o GPT-5.6 requer mudar a URL base, a chave da API e o ID do modelo em vez de construir uma integração específica de provedor. Cobrança unificada e failover podem reduzir ainda mais operações com múltiplos provedores, embora as equipes ainda devam verificar acesso à conta, latência, cota e disponibilidade regional. Para a API da OpenAI, a CometAPI aceita formatos de chat e de responses. Os exemplos abaixo usam \\ Chat Completions API em https://api.cometapi.com/v1/chat/completions.

Como chamar o GPT-5.6 Sol com Python?

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["COMETAPI_KEY"],
    base_url="https://api.cometapi.com/v1",
)

completion = client.chat.completions.create(
    model="gpt-5.6-sol",
    messages=[
        {
            "role": "user",
            "content": "Review this migration plan and identify the three highest-risk assumptions.",
        }
    ],
)

print(completion.choices[0].message.content)

Como chamar o GPT-5.6 Sol com Node.js?

import OpenAI from "openai";

const client = new OpenAI({
  apiKey: process.env.COMETAPI_KEY,
  baseURL: "https://api.cometapi.com/v1",
});

const completion = await client.chat.completions.create({
  model: "gpt-5.6-sol",
  messages: [
    {
      role: "user",
      content: "Review this migration plan and identify the three highest-risk assumptions.",
    },
  ],
});

console.log(completion.choices[0].message.content);

Como chamar o GPT-5.6 Sol com curl?

curl https://api.cometapi.com/v1/chat/completions \
  -H "Authorization: Bearer $COMETAPI_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-5.6-sol",
    "messages": [
      {
        "role": "user",
        "content": "Review this migration plan and identify the three highest-risk assumptions."
      }
    ]
  }'

Veja o Início Rápido da CometAPI, o guia de URL base e a referência da Chat Completions API para detalhes de autenticação e parâmetros.

FAQ

Onde posso acessar a API GPT-5.6 com desconto?

Em 2 de setembro de 2026, a página do modelo GPT-5.6 da CometAPI lista tarifas de tokens de Sol, Terra e Luna 20% abaixo das tarifas atuais da API Padrão da OpenAI para solicitações de contexto curto e longo. O acesso usa a URL base compatível com a OpenAI https://api.cometapi.com/v1. Confirme o ID de modelo exato, o preço e a disponibilidade da conta no catálogo ao vivo da CometAPI ou no painel antes do uso em produção.

O GPT-5.6 ainda é apenas um modelo em observação?

Não. A OpenAI descreve a família GPT-5.6 como geralmente disponível, e o changelog da CometAPI diz que a família está disponível por meio dos formatos de Chat e Responses da API. A “lista de observação” útil agora diz respeito à mudança de preços, promoções, quotas, IDs de rotas e disponibilidade em nível de conta, em vez de se a família foi lançada.

O que o ID de modelo gpt-5.6 usa?

A OpenAI afirma que o alias genérico gpt-5.6 roteia para o GPT-5.6 Sol. Use gpt-5.6-terra ou gpt-5.6-luna explicitamente quando você precisar desses níveis de custo.

Qual modelo GPT-5.6 é o mais barato?

O GPT-5.6 Luna é o nível de menor custo. Na página do modelo da CometAPI verificada em 2 de setembro de 2026, sua tarifa de contexto curto é $0.16 por milhão de tokens de entrada e $0.96 por milhão de tokens de saída.

A diferença de 20% se aplica a solicitações de contexto longo?

A página do modelo da CometAPI lista a mesma diferença de 20% para os níveis de contexto curto e longo. Uma vez que a entrada exceda 272.000 tokens, as tarifas superiores se aplicam a toda a solicitação, portanto testes de contexto longo devem ter orçamento separado.

Posso alternar entre Sol, Terra e Luna sem mudar o SDK?

Sim. Com uma integração compatível com a OpenAI via CometAPI, a URL base e a autenticação permanecem as mesmas. Altere o ID do modelo e, depois, valide qualquer comportamento específico do modelo, configurações de raciocínio, metas de qualidade e limites de taxa antes de rotear tráfego de produção.

Continuar aprendendo

Conecte este artigo à próxima decisão.

Ver todos os tópicos
Publicado em Sep 3, 2026
Última atualização Sep 4, 2026
13 visualizações
Revisado para maior clareza, atribuição de fontes e terminologia de API atual.

Pronto para reduzir os custos de desenvolvimento de IA em 20%?

Comece gratuitamente em minutos. Créditos de avaliação gratuita incluídos. Não é necessário cartão de crédito.

Leia Mais