DeepSeek V4 Flash API

Leichtes MoE-Modell mit insgesamt 284 Milliarden / 13 Milliarden aktiven Parametern und nativem 1M Kontext, abgestimmt auf eine niedrige Latenz und kosteneffiziente Nutzung mit hoher Nebenläufigkeit.

DeepSeekTextgenerierung1M KontextVeröffentlicht 24. Apr. 2026GermanyProprietärer Endpoint

Über DeepSeek V4 Flash

Leichtes MoE-Modell mit insgesamt 284 Milliarden / 13 Milliarden aktiven Parametern und nativem 1M Kontext, abgestimmt auf eine niedrige Latenz und kosteneffiziente Nutzung mit hoher Nebenläufigkeit.

Auch bekannt als DeepSeek Flash

reasoningfunction calling

DeepSeek V4 Flash Spezifikationen

Modell-ID
deepseek-v4-flash
Autor
DeepSeek
Kategorie
Textgenerierung
Veröffentlicht
24. Apr. 2026
Kontextfenster
1M Token
Max. Ausgabe
393.216 Token
Eingabe
Text
Ausgabe
Text
Strukturierte Ausgabe
JSON Schema
Region
Germany
Endpoints
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/deepseek-v4-flash:generateContent
Alternative Modell-IDs
deepseek/deepseek-v4-flash

DeepSeek V4 Flash API-Preise

Live Pay-as-you-go-Preise aus dem EmpirioLabs-Katalog. Du zahlst nur für das, was du nutzt, ohne monatliches Minimum.

Typ
Spezifikation
Preis
Eingabe
pro 1M Prompt-Token
$0.14
Ausgabe
pro 1 Million generierter Token
$0.28
Websuche (Linkup)
pro Aufruf beim Aufruf
$0.013
Auf der vollständigen Preisseite vergleichen

So rufst du die DeepSeek V4 Flash API auf

DeepSeek V4 Flash bedient die OpenAI-kompatible Chat Completions API. Richte ein beliebiges OpenAI SDK mit deinem EmpirioLabs API-Schlüssel auf https://api.empiriolabs.ai/v1 und verwende die Modell-ID deepseek-v4-flash. Hol dir einen API-Schlüssel im EmpirioLabs Dashboard.

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4-flash",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="deepseek-v4-flash",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
Vollständige DeepSeek V4 Flash API-Referenz

DeepSeek V4 Flash API-Parameter

Request-Parameter, die die DeepSeek V4 Flash API auf EmpirioLabs unterstützt. Standardwerte gelten, wenn ein Feld weggelassen wird.

ParameterTypStandardBereich / WerteBeschreibung
temperaturenumber0.70 bis 2Temperatur wird geprochen. 0 = deterministisch, 2 = maximale Zufälligkeit.
top_pnumber0.90 bis 1Kernprobenwahrscheinlichkeitsmasse. Niedriger = fokussierter.
max_tokensnumber40961 bis 393216Maximale Ausgabe-Token.
stopstring--Bis zu 4 Zeichenketten, bei denen das Modell aufhört, weitere Token zu generieren.
enable_thinkingbooleantrue-Aktiviere step-by-step Argumentation, bevor du antwortest.
reasoning_effortenummediumnone, low, medium, high, maxDer Aufwand des Schlussfolgerungsaufwands. Keiner verhindert das Denken. Niedrige, mittlere, hohe und maximale begrenzte Denkbudgets, die auf das gewählte Modell...
thinking_budgetnumber327681 bis 393216Maximale Token, die für den Schlussfolgerungsprozess reserviert sind. Bis 393216.
response_formatenum--Beschränke die Ausgabe auf JSON. Verwenden Sie den JSON-Modus für jedes gültige JSON-Objekt oder ein JSON-Schema, um eine Ausgabe zu erzwingen, die mit einem von...
web_search_linkupbooleanfalse-Optionale Websuche, betrieben von Linkup. Wenn aktiviert, werden aktuelle Webquellen mit Ihrer neuesten Benutzernachricht als Abfrage abgerufen und dem Modell als zusätzlicher Kontext bereitgestellt. Fügt $0.013 pro Aufruf hinzu, wenn er aufgerufen wird, zusätzlich zu den normalen Tokenkosten des Modells. Standardmäßig deaktiviert.
disable_formattingbooleanfalse-Wenn aktiviert, fügt das Gateway den "Sources"-Footer nicht an Assistant-Antworten an, die die Linkup-Websuche verwendet haben. Nützlich, wenn die Modellausgabe an...

DeepSeek V4 Flash Varianten

Varianten sind alternative Versionen von DeepSeek V4 Flash mit eigener Modell-ID. Je nach Variante können sich Serving-Region, Preise oder unterstützte Parameter unterscheiden; alles andere funktioniert gleich.

DeepSeek V4 Flash :variant1

Modell-ID
deepseek-v4-flash:variant1
Region
Singapore
Kontextfenster
1M Token
Strukturierte Ausgabe
JSON Schema
Typ
Spezifikation
Preis
Eingabe
pro 1M Prompt-Token
$0.20
Ausgabe
pro 1 Million generierter Token
$0.40
Web-Suche
pro Anfrage, wenn aktiviert
$0.02
:variant1 im Playground testen

DeepSeek V4 Flash :variant2Spare bis zu 2%

Modell-ID
deepseek-v4-flash:variant2
Region
China
Kontextfenster
1M Token
Strukturierte Ausgabe
JSON Schema
Typ
Spezifikation
Preis
Eingabe
pro 1M Prompt-Token
$0.14$0.138
Ausgabe
pro 1 Million generierter Token
$0.28$0.275
Implizite Cache-Leseart
pro 1M zwischengespeicherten Eingabetoken
$0.028
Web-Suche
pro Anfrage, wenn aktiviert
$0.01
:variant2 im Playground testen

DeepSeek V4 Flash :variant3

Modell-ID
deepseek-v4-flash:variant3
Region
United States
Kontextfenster
1M Token
Strukturierte Ausgabe
JSON Schema
Typ
Spezifikation
Preis
Eingabe
pro 1M Prompt-Token
$0.20
Ausgabe
pro 1 Million generierter Token
$0.40
Websuche (Linkup)
pro Aufruf beim Aufruf
$0.013
:variant3 im Playground testen

DeepSeek V4 Flash API: häufige Fragen

Wie viel kostet die DeepSeek V4 Flash API?

Auf EmpirioLabs wird DeepSeek V4 Flash nach Verbrauch abgerechnet: Eingabe $0.14 pro 1M Prompt-Token; Output $0.28 pro 1 Million generierter Token; Websuche (Linkup) $0.013 pro Aufruf beim Aufruf. Die Live-Preistabelle auf dieser Seite entspricht immer dem, was die API berechnet.

Wie groß ist das Kontextfenster von DeepSeek V4 Flash?

DeepSeek V4 Flash unterstützt ein Kontextfenster von 1M Token mit bis zu 393.216 Ausgabe-Token pro Antwort.

Ist die DeepSeek V4 Flash API OpenAI-kompatibel?

Ja. DeepSeek V4 Flash bedient die OpenAI-kompatible Chat Completions API. Bestehende OpenAI SDKs funktionieren, indem du base_url auf https://api.empiriolabs.ai/v1 setzt und als Modell-ID deepseek-v4-flash verwendest.

Welche DeepSeek V4 Flash Varianten sind verfügbar?

DeepSeek V4 Flash ist als 4 Modell-IDs verfügbar: der Standard deepseek-v4-flash plus deepseek-v4-flash:variant1 (Singapore), deepseek-v4-flash:variant2 (China), deepseek-v4-flash:variant3 (United States). Varianten können sich in Serving-Region, Preisen oder unterstützten Parametern unterscheiden; die Preistabellen stehen auf dieser Seite.

Kann ich DeepSeek V4 Flash im Browser testen, bevor ich integriere?

Ja. Der EmpirioLabs Playground führt DeepSeek V4 Flash im Browser mit denselben Parametern aus, die die API bietet. So kannst du Prompts testen, bevor du Code schreibst.

Wie bekomme ich einen DeepSeek V4 Flash API-Schlüssel?

Erstelle ein EmpirioLabs-Konto und generiere dann einen Schlüssel unter API Keys im Dashboard. Die Abrechnung erfolgt über Pay-as-you-go-Guthaben, du zahlst also nur für deine Requests.

Bereit, bessere Endpunkte zu nutzen?

Schauen Sie sich unsere Preise an oder kontaktieren Sie uns, wenn Sie Ihr eigenes Modell auf unserem Stack implementieren möchten.