DeepSeek V4 Flash 0731 API

Lançamento pós-treinado do 0731 com grandes ganhos em programação, trabalho com repositórios, uso de ferramentas e tarefas full-stack, além de uma janela de contexto de 1M.

DeepSeekGeração de Texto1M contextoLançado 31 de jul. de 2026GermanyEndpoint proprietárioNovo

Sobre DeepSeek V4 Flash 0731

Lançamento pós-treinado do 0731 com grandes ganhos em programação, trabalho com repositórios, uso de ferramentas e tarefas full-stack, além de uma janela de contexto de 1M.

Suporta entrada de texto, pensamento híbrido com enable_thinking e thinking_budget, chamada de funções, saída rigorosa do esquema JSON e busca opcional na web Linkup. Tokens de pensamento são anunciados como tokens de saída.

Também conhecido como DeepSeek Flash 0731

reasoningfunction callingstructured outputagentic coding

Especificações de DeepSeek V4 Flash 0731

ID do modelo
deepseek-v4-flash-0731
Provedor
DeepSeek
Categoria
Geração de Texto
Lançado
31 de jul. de 2026
Janela de contexto
1M tokens
Saída máxima
393.216 tokens
Entrada
Texto
Saída
Texto
Saída estruturada
JSON Schema
Região
Germany
Endpoints
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/deepseek-v4-flash-0731:generateContent
IDs de modelo alternativos
deepseek/deepseek-v4-flash-0731deepseek-ai/deepseek-v4-flash-0731

Preços da API DeepSeek V4 Flash 0731

Tarifas pay-as-you-go ao vivo do catálogo EmpirioLabs. Você paga só pelo que usa, sem mínimo mensal.

Tipo
Especificação
Tarifa
Entrada
por 1M de tokens de prompt
$0.14
Saída
por 1M de tokens gerados
$0.28
Busca na Web (Linkup)
por chamada quando invocada
$0.013
Comparar na página completa de preços

Como chamar a API DeepSeek V4 Flash 0731

DeepSeek V4 Flash 0731 atende a API Chat Completions compatível com OpenAI. Aponte qualquer SDK OpenAI para https://api.empiriolabs.ai/v1 com sua chave de API EmpirioLabs e use o id de modelo deepseek-v4-flash-0731. Obtenha uma chave de API no painel EmpirioLabs.

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4-flash-0731",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="deepseek-v4-flash-0731",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
Referência completa da API DeepSeek V4 Flash 0731

Parâmetros da API DeepSeek V4 Flash 0731

Parâmetros de requisição suportados pela API DeepSeek V4 Flash 0731 na EmpirioLabs. Os padrões valem quando um campo é omitido.

ParâmetroTipoPadrãoIntervalo / valoresDescrição
temperaturenumber0.70 a 2Temperatura de amostragem. 0 = determinística, 2 = aleatoriedade máxima.
top_pnumber0.90 a 1Amostragem do núcleo com a probabilidade de massa. Menor = mais focado.
max_tokensnumber40961 a 393216Tokens de saída máximos.
stopstring--Até 4 strings em que o modelo para de gerar mais tokens.
enable_thinkingbooleantrue-Ative step-by-step raciocínio antes de responder.
reasoning_effortenummediumnone, low, medium, high, maxNível de esforço de raciocínio. Nenhum impede o pensamento. orçamentos limitados de pensamento de conjuntos baixos, médios, altos e máximos, dimensionados para o...
thinking_budgetnumber327681 a 393216Tokens máximos reservados para o processo de raciocínio. Até 393216.
response_formatenum--Restringa a saída a JSON. Use o modo JSON para qualquer objeto JSON válido, ou esquema JSON para forçar a saída que corresponda a um esquema que você fornece.
web_search_linkupbooleanfalse-Busca opcional na web alimentada pelo Linkup. Quando ativadas, fontes web recentes são recuperadas usando sua última mensagem de usuário como consulta e fornecidas ao modelo como contexto adicional. Adiciona $0.013 por chamada quando invocada, além do custo normal do token do modelo. Desativado por padrão.
disable_formattingbooleanfalse-Quando ativado, o gateway não adiciona o rodapé "Fontes" às respostas assistentes que usaram busca web do Linkup. Útil quando a saída do modelo é canalizada para...

Bom saber

O pensamento é ativado por padrão e pode ser desativado. Tokens de raciocínio são anunciados como tokens de saída. A busca opcional no Linkup na web é cobrada apenas quando invocada.

API DeepSeek V4 Flash 0731: perguntas frequentes

Quanto custa a API DeepSeek V4 Flash 0731?

Na EmpirioLabs, DeepSeek V4 Flash 0731 é cobrado por uso: Entrada $0.14 por 1M de tokens de prompt; Saída $0.28 por 1M de tokens gerados; Busca na Web (Linkup) $0.013 por chamada quando invocada. A tabela de tarifas ao vivo desta página sempre corresponde ao que a API cobra.

Qual é a janela de contexto de DeepSeek V4 Flash 0731?

DeepSeek V4 Flash 0731 suporta uma janela de contexto de 1M tokens com até 393.216 tokens de saída por resposta.

A API DeepSeek V4 Flash 0731 é compatível com OpenAI?

Sim. DeepSeek V4 Flash 0731 atende a API Chat Completions compatível com OpenAI, então SDKs OpenAI existentes funcionam apontando base_url para https://api.empiriolabs.ai/v1 e definindo o id de modelo deepseek-v4-flash-0731.

Posso testar DeepSeek V4 Flash 0731 no navegador antes de integrar?

Sim. O playground da EmpirioLabs executa DeepSeek V4 Flash 0731 no navegador com os mesmos parâmetros que a API expõe, para você testar prompts antes de escrever código.

Como consigo uma chave de API DeepSeek V4 Flash 0731?

Crie uma conta EmpirioLabs e gere uma chave em API Keys no painel. A cobrança usa créditos pay-as-you-go, então você paga apenas pelas requisições que faz.

Pronto para usar endpoints melhores?

Confira nossos preços ou entre em contato se quiser que seu próprio modelo seja implementado em nossa pilha.