DeepSeek V4 Flash API

Modelo MoE leve com 284B total / 13B parâmetros ativos e contexto nativo de 1M, sintonizado para uso de alta concorrência de baixa latência e econômico.

DeepSeekGeração de Texto1M contextoLançado 24 de abr. de 2026GermanyEndpoint proprietário

Sobre DeepSeek V4 Flash

Modelo MoE leve com 284B total / 13B parâmetros ativos e contexto nativo de 1M, sintonizado para uso de alta concorrência de baixa latência e econômico.

Também conhecido como DeepSeek Flash, DeepSeek-V4-Flash

reasoningfunction calling

Especificações de DeepSeek V4 Flash

ID do modelo
deepseek-v4-flash
Provedor
DeepSeek
Categoria
Geração de Texto
Lançado
24 de abr. de 2026
Janela de contexto
1M tokens
Saída máxima
393.216 tokens
Entrada
Texto
Saída
Texto
Saída estruturada
JSON Schema
Região
Germany
Endpoints
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/deepseek-v4-flash:generateContent
IDs de modelo alternativos
deepseek/deepseek-v4-flash

Preços da API DeepSeek V4 Flash

Tarifas pay-as-you-go ao vivo do catálogo EmpirioLabs. Você paga só pelo que usa, sem mínimo mensal.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.14
Saída
por tokens gerados 1M
$0.28
Web Search (Linkup)
per call when invoked
$0.013
Comparar na página completa de preços

Como chamar a API DeepSeek V4 Flash

DeepSeek V4 Flash atende a API Chat Completions compatível com OpenAI. Aponte qualquer SDK OpenAI para https://api.empiriolabs.ai/v1 com sua chave de API EmpirioLabs e use o id de modelo deepseek-v4-flash. Obtenha uma chave de API no painel EmpirioLabs.

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4-flash",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="deepseek-v4-flash",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
Referência completa da API DeepSeek V4 Flash

Parâmetros da API DeepSeek V4 Flash

Parâmetros de requisição suportados pela API DeepSeek V4 Flash na EmpirioLabs. Os padrões valem quando um campo é omitido.

ParâmetroTipoPadrãoIntervalo / valoresDescrição
temperaturenumber0.70 a 2Temperatura de amostragem. 0 = determinística, 2 = aleatoriedade máxima.
top_pnumber0.90 a 1Amostragem do núcleo com a probabilidade de massa. Menor = mais focado.
max_tokensnumber40961 a 393216Tokens de saída máximos.
stopstring--Até 4 strings em que o modelo para de gerar mais tokens.
enable_thinkingbooleantrue-Ative step-by-step raciocínio antes de responder.
thinking_budgetnumber327681 a 393216Tokens máximos reservados para o processo de raciocínio. Até 393216.
reasoning_effortenummediumnone, low, medium, high, maxNível de esforço de raciocínio. Nenhum impede o pensamento. orçamentos limitados de pensamento de conjuntos baixos, médios, altos e máximos, dimensionados para o...
response_formatenum--Restringa a saída a JSON. Use o modo JSON para qualquer objeto JSON válido, ou esquema JSON para forçar a saída que corresponda a um esquema que você fornece.
web_search_linkupbooleanfalse-Busca opcional na web alimentada pelo Linkup. Quando ativadas, fontes web recentes são recuperadas usando sua última mensagem de usuário como consulta e fornecidas ao modelo como contexto adicional. Adiciona $0.013 por chamada quando invocada, além do custo normal do token do modelo. Desativado por padrão.
disable_formattingbooleanfalse-Quando ativado, o gateway não adiciona o rodapé "Fontes" às respostas assistentes que usaram busca web do Linkup. Útil quando a saída do modelo é canalizada para...

Variantes de DeepSeek V4 Flash

Variantes são versões alternativas de DeepSeek V4 Flash com id de modelo próprio. Dependendo da variante, podem diferir em região de serviço, preços ou parâmetros suportados; todo o resto funciona igual.

DeepSeek V4 Flash :variant1

ID do modelo
deepseek-v4-flash:variant1
Região
Singapore
Janela de contexto
1M tokens
Saída estruturada
JSON Schema
Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.20
Saída
por tokens gerados 1M
$0.40
Pesquisa Web
por solicitação quando habilitado
$0.02
Testar :variant1 no playground

DeepSeek V4 Flash :variant2Economize até 2%

ID do modelo
deepseek-v4-flash:variant2
Região
China
Janela de contexto
1M tokens
Saída estruturada
JSON Schema
Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.14$0.138
Saída
por tokens gerados 1M
$0.28$0.275
Leu a 'cache' implícita
por fichas de entrada em cache de 1M
$0.028
Pesquisa Web
por solicitação quando habilitado
$0.01
Testar :variant2 no playground

API DeepSeek V4 Flash: perguntas frequentes

Quanto custa a API DeepSeek V4 Flash?

Na EmpirioLabs, DeepSeek V4 Flash é cobrado por uso: Entrada $0.14 por fichas de alerta de 1M; Saída $0.28 por tokens gerados 1M; Web Search (Linkup) $0.013 per call when invoked. A tabela de tarifas ao vivo desta página sempre corresponde ao que a API cobra.

Qual é a janela de contexto de DeepSeek V4 Flash?

DeepSeek V4 Flash suporta uma janela de contexto de 1M tokens com até 393.216 tokens de saída por resposta.

A API DeepSeek V4 Flash é compatível com OpenAI?

Sim. DeepSeek V4 Flash atende a API Chat Completions compatível com OpenAI, então SDKs OpenAI existentes funcionam apontando base_url para https://api.empiriolabs.ai/v1 e definindo o id de modelo deepseek-v4-flash.

Quais variantes de DeepSeek V4 Flash estão disponíveis?

DeepSeek V4 Flash está disponível como 3 ids de modelo: o padrão deepseek-v4-flash mais deepseek-v4-flash:variant1 (Singapore), deepseek-v4-flash:variant2 (China). Variantes podem diferir em região de serviço, preços ou parâmetros suportados; as tabelas de tarifas de cada uma estão nesta página.

Posso testar DeepSeek V4 Flash no navegador antes de integrar?

Sim. O playground da EmpirioLabs executa DeepSeek V4 Flash no navegador com os mesmos parâmetros que a API expõe, para você testar prompts antes de escrever código.

Como consigo uma chave de API DeepSeek V4 Flash?

Crie uma conta EmpirioLabs e gere uma chave em API Keys no painel. A cobrança usa créditos pay-as-you-go, então você paga apenas pelas requisições que faz.

Pronto para usar endpoints melhores?

Confira nossos preços ou entre em contato se quiser que seu próprio modelo seja implementado em nossa pilha.