Qwen3.5 Plus API

텍스트, 이미지, 비디오 전반에 걸쳐 1M 맥락에서 효율적인 심층 사고와 시각적 이해를 위한 하이브리드 아키텍처의 멀티모달 모델.

Alibaba Cloud텍스트 생성1M 컨텍스트출시 2026년 2월 16일Singapore독점 엔드포인트

Qwen3.5 Plus 소개

텍스트, 이미지, 비디오 전반에 걸쳐 1M 맥락에서 효율적인 심층 사고와 시각적 이해를 위한 하이브리드 아키텍처의 멀티모달 모델.

다른 이름 Alibaba Cloud Qwen3.5 Plus

visionweb searchcode interpreterfunction callingreasoning

Qwen3.5 Plus 사양

모델 ID
qwen3-5-plus
개발사
Alibaba Cloud
카테고리
텍스트 생성
출시
2026년 2월 16일
컨텍스트 창
1M 토큰
최대 출력
65,536 토큰
입력
텍스트이미지비디오
출력
텍스트
구조화된 출력
JSON 모드
리전
Singapore
엔드포인트
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/qwen3-5-plus:generateContent
대체 모델 ID
qwen3.5-plus

Qwen3.5 Plus API 요금최대 10% 절약

EmpirioLabs 카탈로그의 실시간 종량제 요금입니다. 사용한 만큼만 결제하며 월 최소 요금이 없습니다.

유형
사양
요금
입력
1M 프롬프트 토큰당
$0.40<=256K $0.36$1.20256K-1M $1.08
제품정보
생성된 토큰 1M 단위
$2.40<=256K $2.21$7.20256K-1M $6.62
웹 검색
호출 시 통화당
$0.015
텍스트-이미지 검색
호출 시 통화당
$0.012
이미지 간 검색
호출 시 통화당
$0.012
웹 추출기
호출 시 통화당
$0.00
코드 인터프리터
호출 시 통화당
$0.00
전체 가격 페이지에서 비교

Qwen3.5 Plus API 호출 방법

Qwen3.5 Plus은(는) OpenAI 호환 Chat Completions API를 제공합니다. 아무 OpenAI SDK나 EmpirioLabs API 키와 함께 https://api.empiriolabs.ai/v1로 지정하고 모델 ID qwen3-5-plus를 사용하세요. EmpirioLabs 대시보드에서 API 키를 발급받으세요.

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3-5-plus",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="qwen3-5-plus",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
Qwen3.5 Plus API 전체 레퍼런스

Qwen3.5 Plus API 파라미터

EmpirioLabs에서 Qwen3.5 Plus API가 지원하는 요청 파라미터입니다. 필드를 생략하면 기본값이 적용됩니다.

파라미터유형기본값범위 / 값설명
temperaturenumber0.70 ~ 2샘플링 온도. 0은 결정론적이고 2는 최대 무작위성입니다.
top_pnumber0.90 ~ 1핵 샘플링 확률 질량. 값이 낮을수록 출력이 더 집중됩니다.
max_tokensnumber40961 ~ 65536최대 출력 토큰.
stopstring--최대 4개의 문자열에서 모델이 더 이상 토큰 생성을 멈춥니다.
enable_thinkingbooleantrue-답변하기 전에 추론을 가능하게 하세요.
vl_high_resolution_imagesbooleantrue-이미지 입력에는 고해상도 처리를 사용하세요.
max_pixelsnumber26214401 ~ 99999999고해상도 처리가 비활성화되었을 때 이미지당 최대 픽셀 수.
video_fpsnumber20.1 ~ 10초당 프레임으로 비디오 입력을 샘플링하는 것.
treat_images_as_videobooleanfalse-이미지 연속을 비디오 프레임으로 취급하세요.
tool_web_searchbooleanfalse-실시간 정보를 웹에서 검색하세요. 호출된 각 호출마다 요청 비용이 $0.015 추가됩니다.
tool_web_extractorbooleanfalse-URL에서 콘텐츠를 추출하고 읽으세요. 웹 검색과 사고가 필요합니다.
tool_code_interpreterbooleanfalse-샌드박스에서 파이썬 코드를 실행하세요. 생각이 필요해.
tool_web_search_imagebooleanfalse-텍스트 설명에서 이미지를 웹에서 검색하세요. 호출된 각 요청 비용에 $0.012 증가합니다.
tool_image_searchbooleanfalse-업로드된 이미지에서 유사한 이미지를 찾으세요. 호출된 각 호출마다 요청 비용이 $0.012 증가합니다.
문서에 파라미터 2개 더 있음

알아두면 좋은 점

256K 토큰 이상input/output 3배 요금이 적용됩니다. 내장 도구(웹 검색, 웹 추출기, 코드 해석기, 이미지 검색)는 호출 시에만 요금이 부과됩니다. 텍스트-이미지 검색 및 이미지 간 검색은 이미지 검색 가격 행을 사용합니다. 호출된 각 이미지 검색은 해당 통화당 요금으로 청구됩니다.

Per-tool billing (usage.tool_usage)

When this model invokes tools (web search, code interpreter, etc.) inside a single request, the response carries a normalized usage.tool_usage map alongside the token counts. The example below shows the shape, exact field names, units, and which tools appear can vary slightly per provider:

"usage": {
  "prompt_tokens": 123,
  "completion_tokens": 456,
  "cost_usd": 0.0042,
  "tool_usage": {"web_search": 3, "code_interpreter": 1}
}

The tool counts are already factored into cost_usd, they are surfaced for transparency so you can audit per-tool billing. The field is omitted when no tools were invoked.

:variant1

텍스트, 이미지, 비디오 입력을 지원합니다. 웹 검색은 tool_web_search을 통해 가능하며, 활성화되면 쿼리당 $0.01 추가됩니다. 생각하는 토큰은 출력 토큰으로 청구됩니다. 명시적 캐시 제어는 지원되지 않습니다.

Qwen3.5 Plus 변형

변형은 자체 모델 ID를 가진 Qwen3.5 Plus의 대체 버전입니다. 변형에 따라 서비스 리전, 요금, 지원 파라미터가 다를 수 있으며 그 외에는 동일하게 동작합니다.

Qwen3.5 Plus :variant1최대 69% 절약

모델 ID
qwen3-5-plus:variant1
리전
China
컨텍스트 창
1M 토큰
구조화된 출력
JSON 모드
Batch API
사용 가능, 정가 대비 35% 할인
유형
사양
요금
입력
1M 프롬프트 토큰당
$0.36<=128K $0.115$0.36128K-256K $0.287$1.08256K-1M $0.573
제품정보
생성된 토큰 1M 단위
$2.21<=128K $0.688$2.21128K-256K $1.72$6.62256K-1M $3.44
웹 검색
호출 시 통화당
$0.01
플레이그라운드에서 :variant1 사용해 보기

Qwen3.5 Plus API: 자주 묻는 질문

Qwen3.5 Plus API 비용은 얼마인가요?

EmpirioLabs에서 Qwen3.5 Plus은(는) 종량제로 청구됩니다. 이 페이지의 실시간 요금표는 항상 API 청구 금액과 일치합니다.

Qwen3.5 Plus의 컨텍스트 윈도우는 얼마인가요?

Qwen3.5 Plus은(는) 1M 토큰 컨텍스트 윈도우를 지원합니다 (응답당 최대 65,536 출력 토큰).

Qwen3.5 Plus API는 OpenAI와 호환되나요?

네. Qwen3.5 Plus은(는) OpenAI 호환 Chat Completions API를 제공하므로, 기존 OpenAI SDK에서 base_urlhttps://api.empiriolabs.ai/v1로 지정하고 모델 ID를 qwen3-5-plus로 설정하면 바로 동작합니다.

Qwen3.5 Plus의 어떤 변형을 사용할 수 있나요?

Qwen3.5 Plus은(는) 2개의 모델 ID로 제공됩니다: 기본 qwen3-5-plusqwen3-5-plus:variant1 (China). 변형은 서비스 리전, 요금, 지원 파라미터가 다를 수 있으며 각 요금표는 이 페이지에 있습니다.

통합하기 전에 브라우저에서 Qwen3.5 Plus을(를) 사용해 볼 수 있나요?

네. EmpirioLabs 플레이그라운드에서 API와 동일한 파라미터로 Qwen3.5 Plus을(를) 브라우저에서 실행하므로 코드를 작성하기 전에 프롬프트를 테스트할 수 있습니다.

Qwen3.5 Plus API 키는 어떻게 발급받나요?

EmpirioLabs 계정을 만든 다음 대시보드의 API Keys에서 키를 생성하세요. 요금은 종량제 크레딧이라 실행한 요청에 대해서만 결제합니다.

더 나은 엔드포인트를 사용할 준비가 되셨나요?

저희 가격을 확인하시거나 저희 스택에 자체 모델을 배포하고 싶으시면 연락해 주세요.