Text Embedding v4 API

Mehrsprachige Texteinbettung mit wählbaren Ausgabedimensionen (64-2048). Bis zu 8.192 Token pro Eingang.

Alibaba CloudEinbettungen8192 KontextVeröffentlicht 4. Juni 2025SingaporeProprietärer Endpoint

Über Text Embedding v4

Mehrsprachige Texteinbettung mit wählbaren Ausgabedimensionen (64-2048). Bis zu 8.192 Token pro Eingang.

Auch bekannt als Text Embedding, Alibaba Cloud Text Embedding v4, Text-Embedding-v4

custom dimensionssparse vectorstask instructionsbatch

Text Embedding v4 Spezifikationen

Modell-ID
text-embedding-v4
Anbieter
Alibaba Cloud
Kategorie
Einbettungen
Veröffentlicht
4. Juni 2025
Kontextfenster
8192 Token
Eingabe
Text
Ausgabe
Embedding
Region
Singapore
Endpoints
POST/v1/embeddings

Text Embedding v4 API-Preise

Live Pay-as-you-go-Preise aus dem EmpirioLabs-Katalog. Du zahlst nur für das, was du nutzt, ohne monatliches Minimum.

Typ
Spezifikation
Preis
Eingabe
pro 1M prompte Token
$0.07
Auf der vollständigen Preisseite vergleichen

So rufst du die Text Embedding v4 API auf

Text Embedding v4 bedient die OpenAI-kompatible Embeddings API. Richte ein beliebiges OpenAI SDK auf https://api.empiriolabs.ai/v1 und verwende die Modell-ID text-embedding-v4. Hol dir einen API-Schlüssel im EmpirioLabs Dashboard.

cURL
curl https://api.empiriolabs.ai/v1/embeddings \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "text-embedding-v4",
    "input": "The quick brown fox jumps over the lazy dog."
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

embedding = client.embeddings.create(
    model="text-embedding-v4",
    input="The quick brown fox jumps over the lazy dog.",
)
print(embedding.data[0].embedding[:8])
Vollständige Text Embedding v4 API-Referenz

Text Embedding v4 API-Parameter

Request-Parameter, die die Text Embedding v4 API auf EmpirioLabs unterstützt. Standardwerte gelten, wenn ein Feld weggelassen wird.

ParameterTypStandardBereich / WerteBeschreibung
inputstring--Text oder ein Array von Texten zum Einbetten (maximal 10 Einträge, jeweils 8192 Token).
dimensionsnumber10242048, 1536, 1024, 768, 512, 256, 128, 64Vektordimension. Höher = mehr semantische Informationen, mehr Speicherkosten.
encoding_formatenumfloatfloat, base64Einbettungsausgabeformat: Float (Standard-Array von Floats) oder base64.
userstring--Optionale Anruferkennung (weitergeleitet an Upstream).

Gut zu wissen

Ausgabedimensionen (wählbar pro Anfrage) - 64, 128, 256, 512, 768, 1024 (Standard), 1536, 2048 - Höhere Dimensionen behalten mehr semantische Details bei höheren Speicherkosten Batch - Bis zu 10 Eingaben pro Anfrage, jeweils 8,192 Token Sprachen - 100+ natürliche Sprachen einschließlich Chinesisch, Englisch, Spanisch, Französisch, Japanisch, Koreanisch, Deutsch, Russisch - plus die gängigsten Programmiersprachen

Text Embedding v4 API: häufige Fragen

Wie viel kostet die Text Embedding v4 API?

Auf EmpirioLabs wird Text Embedding v4 nach Verbrauch abgerechnet: Input $0.07 pro 1M prompte Token. Die Live-Preistabelle auf dieser Seite entspricht immer dem, was die API berechnet.

Wie groß ist das Kontextfenster von Text Embedding v4?

Text Embedding v4 unterstützt ein Kontextfenster von 8192 Token.

Welchen Endpoint verwendet Text Embedding v4?

Text Embedding v4 wird über POST /v1/embeddings auf api.empiriolabs.ai mit normaler Bearer-Token-Authentifizierung bereitgestellt.

Kann ich Text Embedding v4 im Browser testen, bevor ich integriere?

Ja. Der EmpirioLabs Playground führt Text Embedding v4 im Browser mit denselben Parametern aus, die die API bietet. So kannst du Prompts testen, bevor du Code schreibst.

Wie bekomme ich einen Text Embedding v4 API-Schlüssel?

Erstelle ein EmpirioLabs-Konto und generiere dann einen Schlüssel unter API Keys im Dashboard. Die Abrechnung erfolgt über Pay-as-you-go-Guthaben, du zahlst also nur für deine Requests.

Bereit, bessere Endpunkte zu nutzen?

Schauen Sie sich unsere Preise an oder kontaktieren Sie uns, wenn Sie Ihr eigenes Modell auf unserem Stack implementieren möchten.