
Lançamento pós-treinado do 0731 com grandes ganhos em programação, trabalho com repositórios, uso de ferramentas e tarefas full-stack, além de uma janela de contexto de 1M.
Lançamento pós-treinado do 0731 com grandes ganhos em programação, trabalho com repositórios, uso de ferramentas e tarefas full-stack, além de uma janela de contexto de 1M.
Suporta entrada de texto, pensamento híbrido com enable_thinking e thinking_budget, chamada de funções, saída rigorosa do esquema JSON e busca opcional na web Linkup. Tokens de pensamento são anunciados como tokens de saída.
Também conhecido como DeepSeek Flash 0731
deepseek-v4-flash-0731/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/deepseek-v4-flash-0731:generateContentdeepseek/deepseek-v4-flash-0731deepseek-ai/deepseek-v4-flash-0731Tarifas pay-as-you-go ao vivo do catálogo EmpirioLabs. Você paga só pelo que usa, sem mínimo mensal.
DeepSeek V4 Flash 0731 atende a API Chat Completions compatível com OpenAI. Aponte qualquer SDK OpenAI para https://api.empiriolabs.ai/v1 com sua chave de API EmpirioLabs e use o id de modelo deepseek-v4-flash-0731. Obtenha uma chave de API no painel EmpirioLabs.
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4-flash-0731",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="deepseek-v4-flash-0731",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)Parâmetros de requisição suportados pela API DeepSeek V4 Flash 0731 na EmpirioLabs. Os padrões valem quando um campo é omitido.
| Parâmetro | Tipo | Padrão | Intervalo / valores | Descrição |
|---|---|---|---|---|
| temperature | number | 0.7 | 0 a 2 | Temperatura de amostragem. 0 = determinística, 2 = aleatoriedade máxima. |
| top_p | number | 0.9 | 0 a 1 | Amostragem do núcleo com a probabilidade de massa. Menor = mais focado. |
| max_tokens | number | 4096 | 1 a 393216 | Tokens de saída máximos. |
| stop | string | - | - | Até 4 strings em que o modelo para de gerar mais tokens. |
| enable_thinking | boolean | true | - | Ative step-by-step raciocínio antes de responder. |
| reasoning_effort | enum | medium | none, low, medium, high, max | Nível de esforço de raciocínio. Nenhum impede o pensamento. orçamentos limitados de pensamento de conjuntos baixos, médios, altos e máximos, dimensionados para o... |
| thinking_budget | number | 32768 | 1 a 393216 | Tokens máximos reservados para o processo de raciocínio. Até 393216. |
| response_format | enum | - | - | Restringa a saída a JSON. Use o modo JSON para qualquer objeto JSON válido, ou esquema JSON para forçar a saída que corresponda a um esquema que você fornece. |
| web_search_linkup | boolean | false | - | Busca opcional na web alimentada pelo Linkup. Quando ativadas, fontes web recentes são recuperadas usando sua última mensagem de usuário como consulta e fornecidas ao modelo como contexto adicional. Adiciona $0.013 por chamada quando invocada, além do custo normal do token do modelo. Desativado por padrão. |
| disable_formatting | boolean | false | - | Quando ativado, o gateway não adiciona o rodapé "Fontes" às respostas assistentes que usaram busca web do Linkup. Útil quando a saída do modelo é canalizada para... |
O pensamento é ativado por padrão e pode ser desativado. Tokens de raciocínio são anunciados como tokens de saída. A busca opcional no Linkup na web é cobrada apenas quando invocada.
Variantes são versões alternativas de DeepSeek V4 Flash 0731 com id de modelo próprio. Dependendo da variante, podem diferir em região de serviço, preços ou parâmetros suportados; todo o resto funciona igual.
deepseek-v4-flash-0731:variant1Na EmpirioLabs, DeepSeek V4 Flash 0731 é cobrado por uso: Entrada $0.424 por 1M de tokens de prompt; Saída $1.272 por 1M de tokens gerados; Busca na Web (Linkup) $0.013 por chamada quando invocada. A tabela de tarifas ao vivo desta página sempre corresponde ao que a API cobra.
DeepSeek V4 Flash 0731 suporta uma janela de contexto de 1M tokens com até 393.216 tokens de saída por resposta.
Sim. DeepSeek V4 Flash 0731 atende a API Chat Completions compatível com OpenAI, então SDKs OpenAI existentes funcionam apontando base_url para https://api.empiriolabs.ai/v1 e definindo o id de modelo deepseek-v4-flash-0731.
DeepSeek V4 Flash 0731 está disponível como 2 ids de modelo: o padrão deepseek-v4-flash-0731 mais deepseek-v4-flash-0731:variant1 (United States). Variantes podem diferir em região de serviço, preços ou parâmetros suportados; as tabelas de tarifas de cada uma estão nesta página.
Sim. O playground da EmpirioLabs executa DeepSeek V4 Flash 0731 no navegador com os mesmos parâmetros que a API expõe, para você testar prompts antes de escrever código.
Crie uma conta EmpirioLabs e gere uma chave em API Keys no painel. A cobrança usa créditos pay-as-you-go, então você paga apenas pelas requisições que faz.
Confira nossos preços ou entre em contato se quiser que seu próprio modelo seja implementado em nossa pilha.