Accueil Blog

Comment utiliser l’API Flash DeepSeek v4.1

Couverture du blog de l’API Flash DeepSeek V4.1

Sep 14, 2026

EmpirioLabs AI

DeepSeek V4.1 Flash est disponible sur EmpirioLabs. C’est le modèle léger de la nouvelle famille d’architectures de DeepSeek: un modèle mixture-of-experts à 552B paramètres avec 8B de paramètres actifs pour l’entrée et 16B pour la sortie, une compréhension native des images, une fenêtre de contexte de 1M de jetons, et jusqu’à 384K jetons de sortie. DeepSeek rapporte des résultats de benchmarks avant DeepSeek V4 Pro.

Ce que fait le modèle

La version 4.1 Flash lit le texte et les images dans la même requête, vous pouvez donc envoyer des captures d’écran, des diagrammes et des photos accompagnés d’une invite. La pensée hybride est activée par défaut: le modèle raisonne avant de répondre, et vous pouvez désactiver la réflexion pour des réponses à faible latence ou limiter avec un budget de réflexion. L’appel de fonctions et le mode JSON fonctionnent sur la surface standard de complétions de chat, et la recherche web optionnelle Linkup ajoute un contexte web récent lorsque vous l’activez.

Comment appeler DeepSeek V4.1 Flash

Utilisez le point de terminaison de complétions de chat compatible OpenAI et définissez modèle à deepseek-v4-1-flash. Les parties image utilisent la norme image_url Bloc de contenu:

curl https://api.empiriolabs.ai/v1/chat/completions \ -H 'Autorisation: Porteur $EMPIRIOLABS_API_KEY' \ -H 'Type-de-contenu: application/json' \ -d '{ « modèle »: « deepseek-v4-1-flash », « enable_thinking »: true, « thinking_budget »: 32768, « messages »: [ { « role »: « user », « content »: [ {"type »: « text », « texte »: « Que montre ce graphique ? Résume la tendance en deux phrases."}, {"type »: « image_url », « image_url »: {"url »: « https://example.com/chart.png"}} ] } ] }'

Le même identifiant de modèle fonctionne sur les points de terminaison compatibles Responses, Messages et Gemini listés sur la page du modèle.

Notes opérationnelles

  • Mode JSON (a response_format de type json_object) nécessite le mot json quelque part dans vos messages. Le format strict de réponse JSON Schema n’est pas disponible sur ce modèle.
  • Les jetons de raisonnement sont présentés comme des jetons de sortie. Set considérer à faux pour faire court, des réponses sensibles à la latence, ou moindres thinking_budget pour lier le raisonnement.

Prix

L’utilisation du token est facturée à un taux d’entrée publié et un débit de sortie publié, sans débit d’entrée cache séparé. La recherche web Linkup ajoute un petit frais par appel uniquement lorsqu’elle est exécutée. Voir le live page modèle et page de prix pour les tarifs actuels.

Commencez à construire

Essayez DeepSeek V4.1 Flash dans le Terrain de jeu, lire Documentation API, ou comparer avec d’autres modèles dans le Catalogue de modèles.

Divulgation: Cet article a été rédigé avec l'aide d'AI et examiné par EmpirioLabs AI.

Prêt à utiliser de meilleurs points de terminaison ?

Explorez nos modèles, ou contactez-nous pour toute demande d’entreprise, des déploiements personnalisés ou pour tout autre sujet.