Qwen3.5 122B-A10B API

Qwen3.5 122B-A10B는 256K 컨텍스트, 효율적인 sparse MoE inference 및 텍스트, 이미지 및 비디오 입력을 가진 다소 이유 모델입니다.

Alibaba Cloud텍스트 생성256K 컨텍스트출시 2026년 2월 24일China독점 엔드포인트

Qwen3.5 122B-A10B 소개

Qwen3.5 122B-A10B는 256K 컨텍스트, 효율적인 sparse MoE inference 및 텍스트, 이미지 및 비디오 입력을 가진 다소 이유 모델입니다.

텍스트, 이미지 및 비디오 입력, 생각 모드, 호출 기능, 구조 출력 및 tool_web_search 를 통해 웹 검색을 지원합니다. 웹 검색은 사용할 때 $0.01 를 추가합니다. Thinking 토큰은 출력 토큰으로 청구됩니다.

다른 이름 Alibaba Cloud Qwen3.5 122B-A10B, Qwen3.5-122B-A10B, qwen3-5-122b-a10b

reasoningvisionweb searchfunction callingmultimodal

Qwen3.5 122B-A10B 사양

모델 ID
qwen3-5-122b-a10b
제공자
Alibaba Cloud
카테고리
텍스트 생성
출시
2026년 2월 24일
컨텍스트 창
256K 토큰
최대 출력
64,000 토큰
입력
텍스트이미지비디오
출력
텍스트
구조화된 출력
JSON 모드
리전
China
엔드포인트
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/qwen3-5-122b-a10b:generateContent
대체 모델 ID
qwen3.5-122b-a10b

Qwen3.5 122B-A10B API 요금최대 71% 절약

EmpirioLabs 카탈로그의 실시간 종량제 요금입니다. 사용한 만큼만 결제하며 월 최소 요금이 없습니다.

유형
사양
요금
이름 *
1M 신속한 토큰 당
$0.40<=128K $0.115$0.40128K-256K $0.287
제품정보
1M 생성 토큰
$3.20<=128K $0.917$3.20128K-256K $2.294
웹 검색
사용 가능한 경우
$0.01
전체 가격 페이지에서 비교

Qwen3.5 122B-A10B API 호출 방법

Qwen3.5 122B-A10B은(는) OpenAI 호환 Chat Completions API를 제공합니다. 아무 OpenAI SDK나 EmpirioLabs API 키와 함께 https://api.empiriolabs.ai/v1로 지정하고 모델 ID qwen3-5-122b-a10b를 사용하세요. EmpirioLabs 대시보드에서 API 키를 발급받으세요.

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3-5-122b-a10b",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="qwen3-5-122b-a10b",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
Qwen3.5 122B-A10B API 전체 레퍼런스

Qwen3.5 122B-A10B API 파라미터

EmpirioLabs에서 Qwen3.5 122B-A10B API가 지원하는 요청 파라미터입니다. 필드를 생략하면 기본값이 적용됩니다.

파라미터유형기본값범위 / 값설명
temperaturenumber0.70 ~ 2샘플링 온도. 0은 결정론적이고 2는 최대 무작위성입니다.
top_pnumber0.90 ~ 1핵 샘플링 확률 질량. 값이 낮을수록 출력이 더 집중됩니다.
max_tokensnumber40961 ~ 64000최대 출력 토큰.
stopstring--최대 4개의 문자열에서 모델이 더 이상 토큰 생성을 멈춥니다.
enable_thinkingbooleantrue-답변하기 전에 추론을 가능하게 하세요.
thinking_budgetnumber327681 ~ 80000사고할 때 추론용으로 예약된 최대 토큰이 활성화되어 있습니다.
reasoning_effortenummediumnone, low, medium, high, max추론 노력 수준. 어떤 것도 사고를 막지 못한다. 로우, 미디엄, 하이, 최대는 선택한 모델에 맞춘 제한된 사고 예산을 설정합니다. OpenAI 스타일의 reasoning_effort 필드로 전송되었고, 모델 서비스에 대한 enable_thinking와 thinking_budget로 번역되었습니다.
vl_high_resolution_imagesbooleantrue-이미지 입력에는 고해상도 처리를 사용하세요.
max_pixelsnumber26214404096 ~ 16777216고해상도 처리가 비활성화되었을 때 이미지당 최대 픽셀 수.
video_fpsnumber20.1 ~ 10초당 프레임으로 비디오 입력을 샘플링하는 것.
tool_web_searchbooleanfalse-실시간 정보를 웹에서 검색하세요. 활성화 시 요청 비용이 $0.01 증가합니다.
response_formatenum--출력을 유효한 JSON 객체(JSON 모드)로 반환합니다. 프롬프트에 원하는 필드를 설명하세요.

알아두면 좋은 점

텍스트, 이미지 및 비디오 입력을 지원합니다. 웹 검색은 tool_web_search 을 통해 사용할 수 있으며, 사용시 요청당 $0.01 를 추가합니다. Thinking 토큰은 출력 토큰으로 청구됩니다.

Qwen3.5 122B-A10B API: 자주 묻는 질문

Qwen3.5 122B-A10B API 비용은 얼마인가요?

EmpirioLabs에서 Qwen3.5 122B-A10B은(는) 종량제로 청구됩니다. 이 페이지의 실시간 요금표는 항상 API 청구 금액과 일치합니다.

Qwen3.5 122B-A10B의 컨텍스트 윈도우는 얼마인가요?

Qwen3.5 122B-A10B은(는) 256K 토큰 컨텍스트 윈도우를 지원합니다 (응답당 최대 64,000 출력 토큰).

Qwen3.5 122B-A10B API는 OpenAI와 호환되나요?

네. Qwen3.5 122B-A10B은(는) OpenAI 호환 Chat Completions API를 제공하므로, 기존 OpenAI SDK에서 base_urlhttps://api.empiriolabs.ai/v1로 지정하고 모델 ID를 qwen3-5-122b-a10b로 설정하면 바로 동작합니다.

통합하기 전에 브라우저에서 Qwen3.5 122B-A10B을(를) 사용해 볼 수 있나요?

네. EmpirioLabs 플레이그라운드에서 API와 동일한 파라미터로 Qwen3.5 122B-A10B을(를) 브라우저에서 실행하므로 코드를 작성하기 전에 프롬프트를 테스트할 수 있습니다.

Qwen3.5 122B-A10B API 키는 어떻게 발급받나요?

EmpirioLabs 계정을 만든 다음 대시보드의 API Keys에서 키를 생성하세요. 요금은 종량제 크레딧이라 실행한 요청에 대해서만 결제합니다.

더 나은 엔드포인트를 사용할 준비가 되셨나요?

저희 가격을 확인하시거나 저희 스택에 자체 모델을 배포하고 싶으시면 연락해 주세요.