
Multimodal embedding that fuses text, images, and video into one 1024 or 2048 dimension vector for cross-modal search and retrieval.
Multimodal embedding that fuses text, images, and video into one 1024 or 2048 dimension vector for cross-modal search and retrieval.
Também conhecido como ByteDance Skylark Embedding Vision
skylark-embedding-vision/v1/embeddingsbyteplus/skylark-embedding-visionskylark-embedding-vision-250615doubao-embedding-visionTarifas pay-as-you-go ao vivo do catálogo EmpirioLabs. Você paga só pelo que usa, sem mínimo mensal.
Skylark Embedding Vision atende a API Embeddings compatível com OpenAI. Aponte qualquer SDK OpenAI para https://api.empiriolabs.ai/v1 e use o id de modelo skylark-embedding-vision. Obtenha uma chave de API no painel EmpirioLabs.
curl https://api.empiriolabs.ai/v1/embeddings \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "skylark-embedding-vision",
"input": "The quick brown fox jumps over the lazy dog."
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
embedding = client.embeddings.create(
model="skylark-embedding-vision",
input="The quick brown fox jumps over the lazy dog.",
)
print(embedding.data[0].embedding[:8])Parâmetros de requisição suportados pela API Skylark Embedding Vision na EmpirioLabs. Os padrões valem quando um campo é omitido.
| Parâmetro | Tipo | Padrão | Intervalo / valores | Descrição |
|---|---|---|---|---|
| input | string | - | - | Text to embed, an array of up to 16 strings (one embedding each), or an array of text, image_url, and video_url parts fused into one embedding. |
| dimensions | enum | 2048 | 1024, 2048 | Output vector dimensionality. |
| encoding_format | enum | float | float, base64 | Embedding encoding of the response. |
| instructions | string | - | - | Optional retrieval instruction that conditions the embedding, such as a query-side or corpus-side template. |
Na EmpirioLabs, Skylark Embedding Vision é cobrado por uso: Text input $0.25 per 1M tokens; Image / video input $0.65 per 1M tokens. A tabela de tarifas ao vivo desta página sempre corresponde ao que a API cobra.
Skylark Embedding Vision suporta uma janela de contexto de 8K tokens.
Skylark Embedding Vision é servido por POST /v1/embeddings em api.empiriolabs.ai com autenticação padrão por token Bearer.
Sim. O playground da EmpirioLabs executa Skylark Embedding Vision no navegador com os mesmos parâmetros que a API expõe, para você testar prompts antes de escrever código.
Crie uma conta EmpirioLabs e gere uma chave em API Keys no painel. A cobrança usa créditos pay-as-you-go, então você paga apenas pelas requisições que faz.
Confira nossos preços ou entre em contato se quiser que seu próprio modelo seja implementado em nossa pilha.