Casa Blog

Como Usar a API Flash DeepSeek v4.1

Capa do blog da API Flash DeepSeek V4.1

Sep 14, 2026

EmpirioLabs AI

DeepSeek V4.1 Flash está disponível no EmpirioLabs. É o modelo leve de referência da nova família de arquiteturas da DeepSeek: um modelo de mixture-of-experts com 552B parâmetros e 8B para entrada e 16B para saída, compreensão nativa de imagens, janela de contexto de 1M de token e até 384K tokens de saída. A DeepSeek apresenta resultados de benchmarks antes do DeepSeek V4 Pro.

O que o modelo faz

O Flash V4.1 lê texto e imagens na mesma solicitação, então você pode enviar capturas de tela, diagramas e fotos junto com um prompt. O pensamento híbrido está ativado por padrão: o modelo raciocina antes de responder, e você pode desativar o pensamento para respostas de menor latência ou limitar com um orçamento de pensamento. A chamada de função e o modo JSON funcionam na superfície padrão de conclusão do chat, e a busca opcional no Linkup adiciona contexto recente quando você ativa.

Como chamar o DeepSeek V4.1 Flash

Use o endpoint de conclusão de chat compatível com OpenAI e configure modelo para deepseek-v4-1-flash. As partes de imagem usam o padrão image_url Bloco de conteúdo:

curl https://api.empiriolabs.ai/v1/chat/completions \ -H 'Autorização: Portador $EMPIRIOLABS_API_KEY' \ -H 'Tipo-de-Conteúdo: application/json' \ -d '{ "modelo": "deepseek-v4-1-flash", "enable_thinking": verdadeiro, "thinking_budget": 32768, "mensagens": [ { "Função": "Usuário", "Conteúdo": [ {"Tipo": "Texto", "Texto": "O que este gráfico mostra? Resuma a tendência em duas frases."}, {"tipo": "image_url", "image_url": {"URL": "https://example.com/chart.png"}} ] } ] }'

O mesmo id de modelo funciona nos endpoints compatíveis com Respostas, Mensagens e Gemini listados na página do modelo.

Notas operacionais

  • Modo JSON (a response_format do tipo json_object) requer a palavra json em algum lugar das suas mensagens. O formato estrito de resposta do esquema JSON não está disponível neste modelo.
  • Tokens de raciocínio são anunciados como tokens de saída. Set activar pensar para falso para abreviar, respostas sensíveis à latência, ou inferiores thinking_budget para vincular o raciocínio.

Preços

O uso do token é cobrado em uma taxa de entrada publicada e uma taxa de saída publicada, sem taxa separada de entrada em cache. A busca web do Linkup adiciona uma pequena taxa por chamada apenas quando está rodando. Assista ao vivo página do modelo e página de preços Para as taxas atuais.

Comece a construir

Tente o Flash DeepSeek v4.1 no Área de reprodução, ler Documentação da API, ou comparar com outros modelos na Catálogo de modelos.

Divulgação: Este artigo foi escrito com assistência de IA e revisado por EmpirioLabs IA.

Pronto para usar endpoints melhores?

Explore nossos modelos ou entre em contato conosco para consultas de negócios, implantações personalizadas ou qualquer outra coisa.