
무료 경량 GLM-4.7 텍스트 모델 코딩, reasoning, long-context 작성 및 일반 채팅.
무료 경량 GLM-4.7 텍스트 모델 코딩, reasoning, long-context 작성 및 일반 채팅.
Base 토큰 사용은 무료입니다. 내장 웹 검색은 tool_web_search 을 통해 선택되며 사용시 요청당 $0.033 를 추가합니다. 함수 도구, tool choice auto, JSON response format, 생각 제어, tool stream, 온도, top p, do sample, max tokens, 중지 및 스트리밍을 지원합니다.
다른 이름 GLM Flash, Z.ai GLM 4.7 Flash, GLM-4.7-Flash, glm-4-7-flash
glm-4-7-flash/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/glm-4-7-flash:generateContentglm-4.7-flashzai/glm-4.7-flashzhipu/glm-4.7-flashEmpirioLabs 카탈로그의 실시간 종량제 요금입니다. 사용한 만큼만 결제하며 월 최소 요금이 없습니다.
GLM 4.7 Flash은(는) OpenAI 호환 Chat Completions API를 제공합니다. 아무 OpenAI SDK나 EmpirioLabs API 키와 함께 https://api.empiriolabs.ai/v1로 지정하고 모델 ID glm-4-7-flash를 사용하세요. EmpirioLabs 대시보드에서 API 키를 발급받으세요.
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-4-7-flash",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="glm-4-7-flash",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)EmpirioLabs에서 GLM 4.7 Flash API가 지원하는 요청 파라미터입니다. 필드를 생략하면 기본값이 적용됩니다.
| 파라미터 | 유형 | 기본값 | 범위 / 값 | 설명 |
|---|---|---|---|---|
| temperature | number | 1 | 0 ~ 1 | 샘플링 온도. 낮은 값은 더 결정론적입니다. GLM-4.7-플래시와 GLM-4.6V-플래시는 기본값이 1.0입니다; GLM-4.5-플래시는 기본값이 0.6입니다. |
| top_p | number | 0.95 | 0.01 ~ 1 | 핵 샘플링 확률 질량. Z.AI GLM-4.7, GLM-4.6, GLM-4.5 시리즈에 대해 기본값이 0.95임을 문서화하고 있습니다. |
| max_tokens | number | 4096 | 1 ~ 131072 | GLM-4.7-플래시 최대 출력 토큰: 131072. |
| stop | array | - | - | 스톱 워드 리스트. Z.AI 현재 배열 형태의 단일 스톱 문자열을 지원합니다. |
| do_sample | boolean | true | - | 샘플링을 활성화하세요. 거짓일 경우 온도와 top_p은 생성에 영향을 미치지 않습니다. |
| enable_thinking | boolean | true | - | 조작 Z.AI 사고 모드. 기본 설정은 활성화되어 GLM-4.7-플래시를 생각하게 만듭니다; 간단한 저지연 턴에서는 비활성화하세요. |
| thinking | object | - | - | 고급 사고 대상. {"type":"enabled"} 또는 {"type":disabled"}를 사용하세요. GLM-4.7-플래시는 활성화되면 생각을 합니다. |
| tools | array | - | - | 기능 도구와 내장 web_search 도구가 지원됩니다. |
| tool_choice | enum | auto | auto | 모델이 도구를 사용할 수 있는지 통제합니다. Z.AI 문서 자동 도구 선택; 도구 사용을 비활성화하는 도구는 생략하세요. |
| tool_stream | boolean | false | - | 스트림이 참일 때 스트림 함수-호출 도구 출력. Z.AI GLM-4.6 및 이후 모델에 대한 tool_stream 문서를 제공합니다. |
| tool_web_search | boolean | false | - | 내장 웹 검색 기능을 활성화하세요. 활성화되면 요청당 $0.033 개를 추가합니다. |
| search_result | boolean | true | - | 웹 검색이 활성화되면 구조화된 웹 검색 결과 메타데이터를 반환합니다. |
| search_prompt | string | - | - | 검색 결과 요약을 위한 선택적 지침. |
| count | number | 10 | 1 ~ 50 | 검색 결과 수. |
Base 토큰 사용은 무료입니다. 내장 웹 검색은 tool_web_search 을 통해 선택되며 사용시 요청당 $0.033 를 추가합니다.
EmpirioLabs에서 GLM 4.7 Flash은(는) 종량제로 청구됩니다. 이 페이지의 실시간 요금표는 항상 API 청구 금액과 일치합니다.
GLM 4.7 Flash은(는) 200K 토큰 컨텍스트 윈도우를 지원합니다 (응답당 최대 131,072 출력 토큰).
네. GLM 4.7 Flash은(는) OpenAI 호환 Chat Completions API를 제공하므로, 기존 OpenAI SDK에서 base_url을 https://api.empiriolabs.ai/v1로 지정하고 모델 ID를 glm-4-7-flash로 설정하면 바로 동작합니다.
네. EmpirioLabs 플레이그라운드에서 API와 동일한 파라미터로 GLM 4.7 Flash을(를) 브라우저에서 실행하므로 코드를 작성하기 전에 프롬프트를 테스트할 수 있습니다.
EmpirioLabs 계정을 만든 다음 대시보드의 API Keys에서 키를 생성하세요. 요금은 종량제 크레딧이라 실행한 요청에 대해서만 결제합니다.