Skylark Embedding Vision API

Multimodal embedding that fuses text, images, and video into one 1024 or 2048 dimension vector for cross-modal search and retrieval.

ByteDance埋め込み8K コンテキストリリース 2025年6月28日Malaysia独自エンドポイント

Skylark Embedding Vision について

Multimodal embedding that fuses text, images, and video into one 1024 or 2048 dimension vector for cross-modal search and retrieval.

別名 ByteDance Skylark Embedding Vision

multimodalfused vectors

Skylark Embedding Vision の仕様

モデルID
skylark-embedding-vision
プロバイダー
ByteDance
カテゴリ
埋め込み
リリース
2025年6月28日
コンテキスト長
8K トークン
入力
テキスト画像動画
出力
埋め込み
リージョン
Malaysia
エンドポイント
POST/v1/embeddings
代替モデルID
byteplus/skylark-embedding-visionskylark-embedding-vision-250615doubao-embedding-vision

Skylark Embedding Vision API の料金

EmpirioLabs カタログのライブ従量課金料金です。使った分だけの支払いで、月額最低料金はありません。

タイプ
仕様
料金
Text input
per 1M tokens
$0.25
Image / video input
per 1M tokens
$0.65
料金ページ全体で比較

Skylark Embedding Vision API の呼び出し方

Skylark Embedding Vision は OpenAI 互換の Embeddings API を提供します。任意の OpenAI SDK を https://api.empiriolabs.ai/v1 に向けて、モデル ID skylark-embedding-vision を使ってください。 EmpirioLabs ダッシュボードで API キーを取得してください。

cURL
curl https://api.empiriolabs.ai/v1/embeddings \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "skylark-embedding-vision",
    "input": "The quick brown fox jumps over the lazy dog."
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

embedding = client.embeddings.create(
    model="skylark-embedding-vision",
    input="The quick brown fox jumps over the lazy dog.",
)
print(embedding.data[0].embedding[:8])
Skylark Embedding Vision API の完全リファレンス

Skylark Embedding Vision API のパラメーター

EmpirioLabs 上の Skylark Embedding Vision API が対応するリクエストパラメーターです。フィールドを省略した場合はデフォルト値が適用されます。

パラメータタイプデフォルト範囲 / 値説明
inputstring--Text to embed, an array of up to 16 strings (one embedding each), or an array of text, image_url, and video_url parts fused into one embedding.
dimensionsenum20481024, 2048Output vector dimensionality.
encoding_formatenumfloatfloat, base64Embedding encoding of the response.
instructionsstring--Optional retrieval instruction that conditions the embedding, such as a query-side or corpus-side template.

知っておくと便利

出力

  • One fused vector per request across all input items (text, image, and video combine into a single embedding). Choose 1024 or 2048 dimensions.
  • An array of plain strings returns one embedding per string, up to 16 per request.

Per-input limits

  • Text: up to 8,000 tokens per item.
  • Image: JPEG, PNG, WEBP, BMP, or TIFF, sides over 14 px, up to 36MP.
  • Video: MP4, AVI, or MOV, up to 50 MB; audio tracks are ignored.

Retrieval

  • An optional instructions field conditions the embedding for the query or corpus side. Apply L2 normalization before cosine or dot-product comparison.

Skylark Embedding Vision API: よくある質問

Skylark Embedding Vision API の料金はいくらですか?

EmpirioLabs では Skylark Embedding Vision は従量課金です: Text input $0.25 per 1M tokens; Image / video input $0.65 per 1M tokens。このページのライブ料金表は常に API の請求額と一致します。

Skylark Embedding Vision のコンテキストウィンドウはどれくらいですか?

Skylark Embedding Vision は 8K トークンのコンテキストウィンドウに対応しています。

Skylark Embedding Vision はどのエンドポイントを使いますか?

Skylark Embedding Vision は api.empiriolabs.ai 上の POST /v1/embeddings で提供され、標準的な Bearer トークン認証を使用します。

統合する前にブラウザで Skylark Embedding Vision を試せますか?

はい。EmpirioLabs プレイグラウンドでは API と同じパラメーターで Skylark Embedding Vision をブラウザ上で実行できるので、コードを書く前にプロンプトを試せます。

Skylark Embedding Vision の API キーはどうやって取得しますか?

EmpirioLabs アカウントを作成し、ダッシュボードの API Keysでキーを生成してください。課金は従量制クレジットなので、実行したリクエストの分だけ支払います。

より良いエンドポイントを使う準備はできていますか?

ご自身のモデルを当社のスタックに展開したい方は、ぜひご価格をご覧ください。