
스카이프 8.49.0.49 Max는 코딩, 생산성, 긴 실행 에이전트, 깊은 생각, 도구 및 1M-token 컨텍스트에 대한 주력 텍스트 모델입니다.
스카이프 8.49.0.49 Max는 코딩, 생산성, 긴 실행 에이전트, 깊은 생각, 도구 및 1M-token 컨텍스트에 대한 주력 텍스트 모델입니다.
enable thinking and thought budget, 함수 호출 및 세 개의 내장 도구와 함께 텍스트 입력, 생각 모드를 지원합니다. tool_web_search, tool_web_extractor 및 tool_code_interpreter. 각 내장 도구 호출은 $0.02 를 호출하면 됩니다. Thinking 토큰은 출력 토큰으로 청구됩니다.
다른 이름 Alibaba Cloud Qwen3.7 Max, Qwen3.7-Max, qwen3-7-max
qwen3-7-max/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/qwen3-7-max:generateContentqwen3.7-maxEmpirioLabs 카탈로그의 실시간 종량제 요금입니다. 사용한 만큼만 결제하며 월 최소 요금이 없습니다.
Qwen3.7 Max은(는) OpenAI 호환 Chat Completions API를 제공합니다. 아무 OpenAI SDK나 EmpirioLabs API 키와 함께 https://api.empiriolabs.ai/v1로 지정하고 모델 ID qwen3-7-max를 사용하세요. EmpirioLabs 대시보드에서 API 키를 발급받으세요.
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3-7-max",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="qwen3-7-max",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)EmpirioLabs에서 Qwen3.7 Max API가 지원하는 요청 파라미터입니다. 필드를 생략하면 기본값이 적용됩니다.
| 파라미터 | 유형 | 기본값 | 범위 / 값 | 설명 |
|---|---|---|---|---|
| temperature | number | 0.7 | 0 ~ 2 | 샘플링 온도. 0은 결정론적이고 2는 최대 무작위성입니다. |
| top_p | number | 0.9 | 0 ~ 1 | 핵 샘플링 확률 질량. 값이 낮을수록 출력이 더 집중됩니다. |
| max_tokens | number | 4096 | 1 ~ 65536 | 최대 출력 토큰. |
| stop | string | - | - | 최대 4개의 문자열에서 모델이 더 이상 토큰 생성을 멈춥니다. |
| enable_thinking | boolean | true | - | 답변하기 전에 추론을 가능하게 하세요. |
| reasoning_effort | enum | medium | none, low, medium, high, max | 추론 노력 수준. 어떤 것도 사고를 막지 못한다. 로우, 미디엄, 하이, 최대는 선택한 모델에 맞춘 제한된 사고 예산을 설정합니다. |
| thinking_budget | number | 32768 | 1 ~ 64000 | 사고할 때 추론용으로 예약된 최대 토큰이 활성화되어 있습니다. |
| tool_web_search | boolean | false | - | 실시간 정보를 웹에서 검색하세요. 호출된 웹 검색 호출마다 요청 비용이 $0.02 증가합니다. |
| tool_web_extractor | boolean | false | - | URL에서 콘텐츠를 추출하고 읽으세요. 웹 검색과 사고가 필요합니다. 각 호출된 웹 추출기 호출마다 요청 비용이 $0.02 증가합니다. |
| tool_code_interpreter | boolean | false | - | 샌드박스에서 파이썬 코드를 실행하세요. 생각이 필요해. 호출된 코드 인터프리터 호출마다 요청 비용이 $0.02 증가합니다. |
| disable_formatting | boolean | false | - | 지원되는 경우 EmpirioLabs 소스 포맷 없이 원시 제공자 스타일 출력을 반환할 수 있습니다. |
| response_format | enum | - | - | 출력을 유효한 JSON 객체(JSON 모드)로 반환합니다. 프롬프트에 원하는 필드를 설명하세요. |
텍스트 입력 만. 웹 검색, 웹 추출기 및 코드 해석기는 tool * 매개 변수를 통해 노출 된 옵션 내장 도구입니다. 각 내장 도구 호출은 $0.02 을 호출하면 됩니다. Thinking 토큰은 출력 토큰으로 청구됩니다.
When this model invokes built-in tools inside a single request, the response carries a normalized usage.tool_usage map alongside the token counts. Tool counts are already factored into cost_usd and are surfaced for transparency.
:variant1
텍스트 입력만 가능합니다. 웹 검색, 웹 추출기, 코드 인터프리터는 tool_* 매개변수를 통해 노출되는 선택 내장 도구입니다. 내장된 툴 호출은 호출 시 $0.01을 추가합니다. 생각하는 토큰은 출력 토큰으로 청구됩니다.
변형은 자체 모델 ID를 가진 Qwen3.7 Max의 대체 버전입니다. 변형에 따라 서비스 리전, 요금, 지원 파라미터가 다를 수 있으며 그 외에는 동일하게 동작합니다.
qwen3-7-max:variant1EmpirioLabs에서 Qwen3.7 Max은(는) 종량제로 청구됩니다: 이름 * $2.50 1M 신속한 토큰 당; 제품정보 $7.50 1M 생성 토큰; 웹 검색 $0.02 호출 할 때 invoked. 이 페이지의 실시간 요금표는 항상 API 청구 금액과 일치합니다.
Qwen3.7 Max은(는) 1M 토큰 컨텍스트 윈도우를 지원합니다 (응답당 최대 65,536 출력 토큰).
네. Qwen3.7 Max은(는) OpenAI 호환 Chat Completions API를 제공하므로, 기존 OpenAI SDK에서 base_url을 https://api.empiriolabs.ai/v1로 지정하고 모델 ID를 qwen3-7-max로 설정하면 바로 동작합니다.
Qwen3.7 Max은(는) 2개의 모델 ID로 제공됩니다: 기본 qwen3-7-max와 qwen3-7-max:variant1 (China). 변형은 서비스 리전, 요금, 지원 파라미터가 다를 수 있으며 각 요금표는 이 페이지에 있습니다.
네. EmpirioLabs 플레이그라운드에서 API와 동일한 파라미터로 Qwen3.7 Max을(를) 브라우저에서 실행하므로 코드를 작성하기 전에 프롬프트를 테스트할 수 있습니다.
EmpirioLabs 계정을 만든 다음 대시보드의 API Keys에서 키를 생성하세요. 요금은 종량제 크레딧이라 실행한 요청에 대해서만 결제합니다.