Skylark Embedding Vision API

Multimodal embedding that fuses text, images, and video into one 1024 or 2048 dimension vector for cross-modal search and retrieval.

ByteDance嵌入8K 上下文发布日期 2025年6月28日Malaysia专有端点

关于 Skylark Embedding Vision

Multimodal embedding that fuses text, images, and video into one 1024 or 2048 dimension vector for cross-modal search and retrieval.

也称为 ByteDance Skylark Embedding Vision

multimodalfused vectors

Skylark Embedding Vision 规格

模型 ID
skylark-embedding-vision
提供方
ByteDance
类别
嵌入
发布日期
2025年6月28日
上下文窗口
8K 个 token
输入
文本图像视频
输出
向量
区域
Malaysia
端点
POST/v1/embeddings
备用模型 ID
byteplus/skylark-embedding-visionskylark-embedding-vision-250615doubao-embedding-vision

Skylark Embedding Vision API 价格

来自 EmpirioLabs 目录的实时按量计费价格。只为实际用量付费,没有月度最低消费。

类型
规格
价格
Text input
per 1M tokens
$0.25
Image / video input
per 1M tokens
$0.65
在完整价格页比较

如何调用 Skylark Embedding Vision API

Skylark Embedding Vision 提供 OpenAI 兼容的 Embeddings API。把任意 OpenAI SDK 指向 https://api.empiriolabs.ai/v1,并使用模型 ID skylark-embedding-vision。 在EmpirioLabs 控制台获取 API 密钥。

cURL
curl https://api.empiriolabs.ai/v1/embeddings \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "skylark-embedding-vision",
    "input": "The quick brown fox jumps over the lazy dog."
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

embedding = client.embeddings.create(
    model="skylark-embedding-vision",
    input="The quick brown fox jumps over the lazy dog.",
)
print(embedding.data[0].embedding[:8])
Skylark Embedding Vision API 完整参考

Skylark Embedding Vision API 参数

EmpirioLabs 上 Skylark Embedding Vision API 支持的请求参数。省略字段时使用默认值。

参数类型默认值范围 / 值描述
inputstring--Text to embed, an array of up to 16 strings (one embedding each), or an array of text, image_url, and video_url parts fused into one embedding.
dimensionsenum20481024, 2048Output vector dimensionality.
encoding_formatenumfloatfloat, base64Embedding encoding of the response.
instructionsstring--Optional retrieval instruction that conditions the embedding, such as a query-side or corpus-side template.

须知

输出

  • One fused vector per request across all input items (text, image, and video combine into a single embedding). Choose 1024 or 2048 dimensions.
  • An array of plain strings returns one embedding per string, up to 16 per request.

Per-input limits

  • Text: up to 8,000 tokens per item.
  • Image: JPEG, PNG, WEBP, BMP, or TIFF, sides over 14 px, up to 36MP.
  • Video: MP4, AVI, or MOV, up to 50 MB; audio tracks are ignored.

Retrieval

  • An optional instructions field conditions the embedding for the query or corpus side. Apply L2 normalization before cosine or dot-product comparison.

Skylark Embedding Vision API:常见问题

Skylark Embedding Vision API 收费多少?

在 EmpirioLabs,Skylark Embedding Vision 按量计费:Text input $0.25 per 1M tokens; Image / video input $0.65 per 1M tokens。本页的实时价格表始终与 API 的实际计费一致。

Skylark Embedding Vision 的上下文窗口有多大?

Skylark Embedding Vision 支持 8K token 的上下文窗口。

Skylark Embedding Vision 使用哪个端点?

Skylark Embedding Vision 通过 api.empiriolabs.ai 上的 POST /v1/embeddings 提供,使用标准的 Bearer 令牌认证。

集成之前可以在浏览器里试用 Skylark Embedding Vision 吗?

可以。EmpirioLabs Playground在浏览器中以与 API 相同的参数运行 Skylark Embedding Vision,你可以在写代码之前先测试提示词。

如何获取 Skylark Embedding Vision API 密钥?

创建 EmpirioLabs 账户,然后在控制台的 API Keys生成密钥。计费使用按量付费的额度,只为实际发出的请求付费。

准备好使用更好的终端了吗?

查看我们的定价,或者如果你想将自己的模型部署到我们的堆栈中,请联系我们。