DeepSeek V4.1 Flash API

Flagship leve da nova arquitetura da DeepSeek, com compreensão nativa de imagens, pensamento híbrido, contexto de 1M e até 384K tokens de saída.

DeepSeekGeração de Texto1M contextoLançado 10 de set. de 2026SingaporeEndpoint proprietárioNovo

Sobre DeepSeek V4.1 Flash

Flagship leve da nova arquitetura da DeepSeek, com compreensão nativa de imagens, pensamento híbrido, contexto de 1M e até 384K tokens de saída.

Suporta entrada de texto e imagem, pensamento híbrido com enable_thinking e thinking_budget, chamada de funções, saída em modo JSON e busca web opcional no Linkup. Tokens de pensamento são anunciados como tokens de saída.

Também conhecido como DeepSeek Flash

reasoningvisionfunction callingagentic coding

Especificações de DeepSeek V4.1 Flash

ID do modelo
deepseek-v4-1-flash
Autor
DeepSeek
Categoria
Geração de Texto
Lançado
10 de set. de 2026
Janela de contexto
1M tokens
Saída máxima
393.216 tokens
Entrada
TextoImagem
Saída
Texto
Saída estruturada
Modo JSON
Região
Singapore
Endpoints
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/deepseek-v4-1-flash:generateContent
IDs de modelo alternativos
deepseek-v4.1-flashdeepseek/deepseek-v4-1-flashdeepseek-ai/deepseek-v4-1-flash

Preços da API DeepSeek V4.1 Flash

Tarifas pay-as-you-go ao vivo do catálogo EmpirioLabs. Você paga só pelo que usa, sem mínimo mensal.

Tipo
Especificação
Tarifa
Entrada
por 1M de tokens de prompt
$0.30
Saída
por 1M de tokens gerados
$1.20
Busca na Web (Linkup)
por chamada quando invocada
$0.013
Comparar na página completa de preços

Como chamar a API DeepSeek V4.1 Flash

DeepSeek V4.1 Flash atende a API Chat Completions compatível com OpenAI. Aponte qualquer SDK OpenAI para https://api.empiriolabs.ai/v1 com sua chave de API EmpirioLabs e use o id de modelo deepseek-v4-1-flash. Obtenha uma chave de API no painel EmpirioLabs.

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4-1-flash",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="deepseek-v4-1-flash",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
Referência completa da API DeepSeek V4.1 Flash

Parâmetros da API DeepSeek V4.1 Flash

Parâmetros de requisição suportados pela API DeepSeek V4.1 Flash na EmpirioLabs. Os padrões valem quando um campo é omitido.

ParâmetroTipoPadrãoIntervalo / valoresDescrição
temperaturenumber0.70 a 2Temperatura de amostragem. 0 = determinística, 2 = aleatoriedade máxima.
top_pnumber0.90 a 1Amostragem do núcleo com a probabilidade de massa. Menor = mais focado.
max_tokensnumber40961 a 393216Tokens de saída máximos.
stopstring--Até 4 strings em que o modelo para de gerar mais tokens.
enable_thinkingbooleantrue-Ative step-by-step raciocínio antes de responder.
reasoning_effortenummediumnone, low, medium, high, maxNível de esforço de raciocínio. Nenhum impede o pensamento. orçamentos limitados de pensamento de conjuntos baixos, médios, altos e máximos, dimensionados para o...
thinking_budgetnumber327681 a 393216Tokens máximos reservados para o processo de raciocínio. Até 393216.
response_formatenum--Devolva a saída como um objeto JSON válido (modo JSON). Descreva as áreas que você quer no seu prompt.
web_search_linkupbooleanfalse-Busca opcional na web alimentada pelo Linkup. Quando ativadas, fontes web recentes são recuperadas usando sua última mensagem de usuário como consulta e fornecidas ao modelo como contexto adicional. Adiciona $0.013 por chamada quando invocada, além do custo normal do token do modelo. Desativado por padrão.
disable_formattingbooleanfalse-Quando ativado, o gateway não adiciona o rodapé "Fontes" às respostas assistentes que usaram busca web do Linkup. Útil quando a saída do modelo é canalizada para...

Bom saber

O pensamento é ativado por padrão e pode ser desativado. Tokens de raciocínio são anunciados como tokens de saída. A entrada de imagem é aceita junto com o texto. O modo JSON é suportado. A saída estrita do Esquema JSON não está disponível neste modelo. A busca opcional na web Linkup é cobrada apenas quando invocada.

API DeepSeek V4.1 Flash: perguntas frequentes

Quanto custa a API DeepSeek V4.1 Flash?

Na EmpirioLabs, DeepSeek V4.1 Flash é cobrado por uso: Entrada $0.30 por 1M de tokens de prompt; Saída $1.20 por 1M de tokens gerados; Busca na Web (Linkup) $0.013 por chamada quando invocada. A tabela de tarifas ao vivo desta página sempre corresponde ao que a API cobra.

Qual é a janela de contexto de DeepSeek V4.1 Flash?

DeepSeek V4.1 Flash suporta uma janela de contexto de 1M tokens com até 393.216 tokens de saída por resposta.

A API DeepSeek V4.1 Flash é compatível com OpenAI?

Sim. DeepSeek V4.1 Flash atende a API Chat Completions compatível com OpenAI, então SDKs OpenAI existentes funcionam apontando base_url para https://api.empiriolabs.ai/v1 e definindo o id de modelo deepseek-v4-1-flash.

Posso testar DeepSeek V4.1 Flash no navegador antes de integrar?

Sim. O playground da EmpirioLabs executa DeepSeek V4.1 Flash no navegador com os mesmos parâmetros que a API expõe, para você testar prompts antes de escrever código.

Como consigo uma chave de API DeepSeek V4.1 Flash?

Crie uma conta EmpirioLabs e gere uma chave em API Keys no painel. A cobrança usa créditos pay-as-you-go, então você paga apenas pelas requisições que faz.

Pronto para usar endpoints melhores?

Confira nossos preços ou entre em contato se quiser que seu próprio modelo seja implementado em nossa pilha.