O modelo deepseek-v4-flash-vision-exp aceita imagens juntamente com texto, assim você pode pedir ao modelo para descrever imagens, ler texto de capturas de tela, analisar gráficos e muito mais. Formatos de imagem compatíveis: JPEG, PNG, GIF e WebP. O formato é detectado com base no conteúdo real do arquivo, não no nome do arquivo nem no tipo MIME declarado.
Teste DeepSeek-V4-Flash-Vision com uma solicitação real, revise os parâmetros e valide a saída antes de integrar a API.
Use a estimativa rápida acima para uma única execução e depois veja a comparação completa entre CometAPI e preço oficial.
Explore preços competitivos para DeepSeek-V4-Flash-Vision, projetado para atender diversos orçamentos e necessidades de uso. Nossos planos flexíveis garantem que você pague apenas pelo que usar, facilitando o dimensionamento conforme suas necessidades crescem. Descubra como DeepSeek-V4-Flash-Vision pode aprimorar seus projetos mantendo os custos gerenciáveis.
| Model | Comet Price (USD / M Tokens) | Official Price (USD / M Tokens) | Discount |
|---|---|---|---|
| deepseek-v4-flash-vision | Entrada:$0.352/M Saída:$1.056/M | Entrada:$0.44/M Saída:$1.32/M | -20% |
| deepseek-v4-flash-vision-exp | Entrada:$0.352/M Saída:$1.056/M | Entrada:$0.44/M Saída:$1.32/M | -20% |
Copie um endpoint funcional e um exemplo de código, e abra a referência completa da API quando precisar de todos os parâmetros.
Autentique-se uma vez, chame o endpoint do modelo e mantenha o mesmo fluxo de cobrança e observabilidade entre provedores.
Acesse código de exemplo abrangente e recursos de API para DeepSeek-V4-Flash-Vision para otimizar seu processo de integração. Nossa documentação detalhada fornece orientação passo a passo, ajudando você a aproveitar todo o potencial do DeepSeek-V4-Flash-Vision em seus projetos.
#!/usr/bin/env bash
# Get your CometAPI key from https://www.cometapi.com/console/token
COMETAPI_KEY="${COMETAPI_KEY:-<YOUR_COMETAPI_KEY>}"
IMAGE_BASE64="${IMAGE_BASE64:-<BASE64_DATA>}"
chat_response=$(curl --silent --show-error --fail-with-body --max-time 180 --retry 0 \
--request POST "https://api.cometapi.com/v1/chat/completions" \
--header "Authorization: Bearer $COMETAPI_KEY" \
--header "Content-Type: application/json" \
--data-raw "$(jq -nc --arg model 'deepseek-v4-flash-vision-exp' --arg image_base64 "$IMAGE_BASE64" '{
model: $model,
thinking: {type: "disabled"},
messages: [{
role: "user",
content: [
{type: "text", text: "Describe the main visual elements in this image in one concise sentence."},
{type: "image_url", image_url: {url: ("data:image/png;base64," + $image_base64)}}
]
}],
max_tokens: 512
}')" \
${COMETAPI_RUNTIME_EVIDENCE:+--write-out $'%{stderr}__COMETAPI_RUNTIME__{"method":"POST","path":"/v1/chat/completions","http_status":%{http_code},"headers":{"content-type":"%header{content-type}","x-cometapi-request-id":"%header{x-cometapi-request-id}","x-request-id":"%header{x-request-id}","request-id":"%header{request-id}","cf-ray":"%header{cf-ray}"}}
'})
printf 'Chat Completions response:
'
printf '%s
' "$chat_response" | jq -r '.choices[0].message.content'Veja os principais dados do modelo antes de escolher uma arquitetura ou estimar a carga em produção.
Use DeepSeek-V4-Flash-Vision em fluxos de produção compatíveis com suas capacidades de text, e compare alternativas antes de um compromisso de integração de longo prazo.
Chat de produção e fluxos de trabalho com agentes
Programação, análise e geração estruturada
Automação de alto volume por meio de uma API
Compare outros modelos disponíveis na CometAPI considerando qualidade, latência, capacidades e preço.
3.7 Flash oferece melhorias substanciais nos fluxos de trabalho de engenharia de software, trabalho do conhecimento e desenvolvimento web — com um preço de lançamento equivalente à metade do custo original do 3.6 Flash por milhão de tokens.
DeepSeek V4 Pro é um modelo de Mixture-of-Experts em larga escala da DeepSeek, com 1.6T de parâmetros totais e 49B de parâmetros ativados, com suporte a uma janela de contexto de 1M tokens. Ele foi projetado para raciocínio avançado, programação e fluxos de trabalho de agentes de longo horizonte, com desempenho forte em benchmarks de conhecimento, matemática e engenharia de software.
O modelo carro-chefe para código e tudo o mais: invocação de ferramentas com autonomia, alucinações mínimas, raciocínio configurável.
GLM-5.3 é um modelo de linguagem de grande porte de próxima geração e de código aberto, otimizado para programação complexa, tarefas de longo horizonte e cenários de cibersegurança. Ele oferece capacidades de programação e desempenho de agentes significativamente aprimorados em comparação com o GLM-5.2.
O acesso ao Claude Fable 5 foi restabelecido. Ele traz inteligência de 5ª geração para seus projetos de programação e trabalhos profissionais mais ambiciosos.
Modelo de alto desempenho para programação e agentes
Veja dados de heartbeat em tempo real, disponibilidade do endpoint e tempos de resposta observados antes de ir para produção.
Veja os identificadores de modelo disponíveis antes de fixar uma integração de produção.