DeepSeek V4.1 Flash está disponível no EmpirioLabs. É o modelo leve de referência da nova família de arquiteturas da DeepSeek: um modelo de mixture-of-experts com 552B parâmetros e 8B para entrada e 16B para saída, compreensão nativa de imagens, janela de contexto de 1M de token e até 384K tokens de saída. A DeepSeek apresenta resultados de benchmarks antes do DeepSeek V4 Pro.
O que o modelo faz
O Flash V4.1 lê texto e imagens na mesma solicitação, então você pode enviar capturas de tela, diagramas e fotos junto com um prompt. O pensamento híbrido está ativado por padrão: o modelo raciocina antes de responder, e você pode desativar o pensamento para respostas de menor latência ou limitar com um orçamento de pensamento. A chamada de função e o modo JSON funcionam na superfície padrão de conclusão do chat, e a busca opcional no Linkup adiciona contexto recente quando você ativa.
Como chamar o DeepSeek V4.1 Flash
Use o endpoint de conclusão de chat compatível com OpenAI e configure modelo para deepseek-v4-1-flash. As partes de imagem usam o padrão image_url Bloco de conteúdo:
curl https://api.empiriolabs.ai/v1/chat/completions \ -H 'Autorização: Portador $EMPIRIOLABS_API_KEY' \ -H 'Tipo-de-Conteúdo: application/json' \ -d '{ "modelo": "deepseek-v4-1-flash", "enable_thinking": verdadeiro, "thinking_budget": 32768, "mensagens": [ { "Função": "Usuário", "Conteúdo": [ {"Tipo": "Texto", "Texto": "O que este gráfico mostra? Resuma a tendência em duas frases."}, {"tipo": "image_url", "image_url": {"URL": "https://example.com/chart.png"}} ] } ] }'
O mesmo id de modelo funciona nos endpoints compatíveis com Respostas, Mensagens e Gemini listados na página do modelo.
Notas operacionais
- Modo JSON (a
response_formatdo tipojson_object) requer a palavra json em algum lugar das suas mensagens. O formato estrito de resposta do esquema JSON não está disponível neste modelo. - Tokens de raciocínio são anunciados como tokens de saída. Set
activar pensarparafalsopara abreviar, respostas sensíveis à latência, ou inferioresthinking_budgetpara vincular o raciocínio.
Preços
O uso do token é cobrado em uma taxa de entrada publicada e uma taxa de saída publicada, sem taxa separada de entrada em cache. A busca web do Linkup adiciona uma pequena taxa por chamada apenas quando está rodando. Assista ao vivo página do modelo e página de preços Para as taxas atuais.
Comece a construir
Tente o Flash DeepSeek v4.1 no Área de reprodução, ler Documentação da API, ou comparar com outros modelos na Catálogo de modelos.
Divulgação: Este artigo foi escrito com assistência de IA e revisado por EmpirioLabs IA.



