
Multimodal embedding that fuses text, images, and video into one 1024 or 2048 dimension vector for cross-modal search and retrieval.
Multimodal embedding that fuses text, images, and video into one 1024 or 2048 dimension vector for cross-modal search and retrieval.
También conocido como ByteDance Skylark Embedding Vision
skylark-embedding-vision/v1/embeddingsbyteplus/skylark-embedding-visionskylark-embedding-vision-250615doubao-embedding-visionTarifas de pago por uso en vivo del catálogo de EmpirioLabs. Solo pagas por lo que usas, sin mínimo mensual.
Skylark Embedding Vision sirve la API de Embeddings compatible con OpenAI. Apunta cualquier SDK de OpenAI a https://api.empiriolabs.ai/v1 y usa el id de modelo skylark-embedding-vision. Consigue una clave de API en el panel de EmpirioLabs.
curl https://api.empiriolabs.ai/v1/embeddings \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "skylark-embedding-vision",
"input": "The quick brown fox jumps over the lazy dog."
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
embedding = client.embeddings.create(
model="skylark-embedding-vision",
input="The quick brown fox jumps over the lazy dog.",
)
print(embedding.data[0].embedding[:8])Parámetros de solicitud compatibles con la API de Skylark Embedding Vision en EmpirioLabs. Los valores por defecto se aplican cuando se omite un campo.
| Parámetro | Tipo | Predeterminado | Rango / valores | Descripción |
|---|---|---|---|---|
| input | string | - | - | Text to embed, an array of up to 16 strings (one embedding each), or an array of text, image_url, and video_url parts fused into one embedding. |
| dimensions | enum | 2048 | 1024, 2048 | Output vector dimensionality. |
| encoding_format | enum | float | float, base64 | Embedding encoding of the response. |
| instructions | string | - | - | Optional retrieval instruction that conditions the embedding, such as a query-side or corpus-side template. |
En EmpirioLabs, Skylark Embedding Vision se factura por uso: Text input $0.25 per 1M tokens; Image / video input $0.65 per 1M tokens. La tabla de tarifas en vivo de esta página siempre coincide con lo que cobra la API.
Skylark Embedding Vision admite una ventana de contexto de 8K tokens.
Skylark Embedding Vision se sirve a través de POST /v1/embeddings en api.empiriolabs.ai con autenticación estándar de token Bearer.
Sí. El playground de EmpirioLabs ejecuta Skylark Embedding Vision en el navegador con los mismos parámetros que expone la API, para que pruebes prompts antes de escribir código.
Crea una cuenta de EmpirioLabs y genera una clave en API Keys en el panel. La facturación es con créditos de pago por uso, así que solo pagas por las solicitudes que haces.
Consulta nuestros precios o contacta con nosotros si quieres que tu propio modelo se implemente en nuestra pila.