
Qwen3.5 35B-A3B는 sparse MoE routing, 깊은 생각 및 텍스트, 이미지 및 비디오 입력과 효율적인 네이티브 비전 언어 모델입니다.
Qwen3.5 35B-A3B는 sparse MoE routing, 깊은 생각 및 텍스트, 이미지 및 비디오 입력과 효율적인 네이티브 비전 언어 모델입니다.
텍스트, 이미지 및 비디오 입력, 생각 모드, 호출 기능, 구조 출력 및 tool_web_search 를 통해 웹 검색을 지원합니다. 웹 검색은 사용할 때 $0.01 를 추가합니다. Thinking 토큰은 출력 토큰으로 청구됩니다.
다른 이름 Alibaba Cloud Qwen3.5 35B-A3B, Qwen3.5-35B-A3B, qwen3-5-35b-a3b
qwen3-5-35b-a3b/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/qwen3-5-35b-a3b:generateContentqwen3.5-35b-a3bEmpirioLabs 카탈로그의 실시간 종량제 요금입니다. 사용한 만큼만 결제하며 월 최소 요금이 없습니다.
Qwen3.5 35B-A3B은(는) OpenAI 호환 Chat Completions API를 제공합니다. 아무 OpenAI SDK나 EmpirioLabs API 키와 함께 https://api.empiriolabs.ai/v1로 지정하고 모델 ID qwen3-5-35b-a3b를 사용하세요. EmpirioLabs 대시보드에서 API 키를 발급받으세요.
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3-5-35b-a3b",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="qwen3-5-35b-a3b",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)EmpirioLabs에서 Qwen3.5 35B-A3B API가 지원하는 요청 파라미터입니다. 필드를 생략하면 기본값이 적용됩니다.
| 파라미터 | 유형 | 기본값 | 범위 / 값 | 설명 |
|---|---|---|---|---|
| temperature | number | 0.7 | 0 ~ 2 | 샘플링 온도. 0은 결정론적이고 2는 최대 무작위성입니다. |
| top_p | number | 0.9 | 0 ~ 1 | 핵 샘플링 확률 질량. 값이 낮을수록 출력이 더 집중됩니다. |
| max_tokens | number | 4096 | 1 ~ 64000 | 최대 출력 토큰. |
| stop | string | - | - | 최대 4개의 문자열에서 모델이 더 이상 토큰 생성을 멈춥니다. |
| enable_thinking | boolean | true | - | 답변하기 전에 추론을 가능하게 하세요. |
| reasoning_effort | enum | medium | none, low, medium, high, max | 추론 노력 수준. 어떤 것도 사고를 막지 못한다. 로우, 미디엄, 하이, 최대는 선택한 모델에 맞춘 제한된 사고 예산을 설정합니다. OpenAI 스타일의 reasoning_effort 필드로 전송되었고, 모델 서비스에 대한 enable_thinking와 thinking_budget로 번역되었습니다. |
| thinking_budget | number | 32768 | 1 ~ 80000 | 사고할 때 추론용으로 예약된 최대 토큰이 활성화되어 있습니다. |
| vl_high_resolution_images | boolean | true | - | 이미지 입력에는 고해상도 처리를 사용하세요. |
| max_pixels | number | 2621440 | 4096 ~ 16777216 | 고해상도 처리가 비활성화되었을 때 이미지당 최대 픽셀 수. |
| video_fps | number | 2 | 0.1 ~ 10 | 초당 프레임으로 비디오 입력을 샘플링하는 것. |
| tool_web_search | boolean | false | - | 실시간 정보를 웹에서 검색하세요. 활성화 시 요청 비용이 $0.01 증가합니다. |
| response_format | enum | - | - | 출력을 유효한 JSON 객체(JSON 모드)로 반환합니다. 프롬프트에 원하는 필드를 설명하세요. |
텍스트, 이미지 및 비디오 입력을 지원합니다. 웹 검색은 tool_web_search 을 통해 사용할 수 있으며, 사용시 요청당 $0.01 를 추가합니다. Thinking 토큰은 출력 토큰으로 청구됩니다.
EmpirioLabs에서 Qwen3.5 35B-A3B은(는) 종량제로 청구됩니다. 이 페이지의 실시간 요금표는 항상 API 청구 금액과 일치합니다.
Qwen3.5 35B-A3B은(는) 256K 토큰 컨텍스트 윈도우를 지원합니다 (응답당 최대 64,000 출력 토큰).
네. Qwen3.5 35B-A3B은(는) OpenAI 호환 Chat Completions API를 제공하므로, 기존 OpenAI SDK에서 base_url을 https://api.empiriolabs.ai/v1로 지정하고 모델 ID를 qwen3-5-35b-a3b로 설정하면 바로 동작합니다.
네. EmpirioLabs 플레이그라운드에서 API와 동일한 파라미터로 Qwen3.5 35B-A3B을(를) 브라우저에서 실행하므로 코드를 작성하기 전에 프롬프트를 테스트할 수 있습니다.
EmpirioLabs 계정을 만든 다음 대시보드의 API Keys에서 키를 생성하세요. 요금은 종량제 크레딧이라 실행한 요청에 대해서만 결제합니다.