
Modelo de texto GLM-4.7 gratuito y ligero para codificación, razonamiento, escritura en contexto largo y chat general.
Modelo de texto GLM-4.7 gratuito y ligero para codificación, razonamiento, escritura en contexto largo y chat general.
El uso base de fichas es gratuito. La búsqueda web integrada es opcional a través de tool_web_search y añade $0.033 por solicitud cuando está activada. Soporta herramientas funcionales, tool_choice auto, JSON response_format, controles de pensamiento, tool_stream, temperatura, top_p, do_sample, max_tokens, stop y streaming.
También conocido como GLM Flash, Z.ai GLM 4.7 Flash, GLM-4.7-Flash, glm-4-7-flash
glm-4-7-flash/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/glm-4-7-flash:generateContentglm-4.7-flashzai/glm-4.7-flashzhipu/glm-4.7-flashTarifas de pago por uso en vivo del catálogo de EmpirioLabs. Solo pagas por lo que usas, sin mínimo mensual.
GLM 4.7 Flash sirve la API de Chat Completions compatible con OpenAI. Apunta cualquier SDK de OpenAI a https://api.empiriolabs.ai/v1 con tu clave de API de EmpirioLabs y usa el id de modelo glm-4-7-flash. Consigue una clave de API en el panel de EmpirioLabs.
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-4-7-flash",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="glm-4-7-flash",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)Parámetros de solicitud compatibles con la API de GLM 4.7 Flash en EmpirioLabs. Los valores por defecto se aplican cuando se omite un campo.
| Parámetro | Tipo | Predeterminado | Rango / valores | Descripción |
|---|---|---|---|---|
| temperature | number | 1 | 0 a 1 | Temperatura de muestreo. Los valores más bajos son más deterministas. GLM-4.7-Flash y GLM-4.6V-Flash por defecto en 1.0; GLM-4.5-Flash por defecto es 0.6. |
| top_p | number | 0.95 | 0.01 a 1 | Masa de probabilidad de muestreo del núcleo. Z.AI documenta un valor predeterminado de 0,95 para las series GLM-4.7, GLM-4.6 y GLM-4.5. |
| max_tokens | number | 4096 | 1 a 131072 | Tokens máximos de salida para GLM-4.7-Flash: 131072. |
| stop | array | - | - | Lista de palabras de parada. Z.AI actualmente soporta cadena de un solo paso en forma de array. |
| do_sample | boolean | true | - | Habilitar el muestreo. Cuando es falso, la temperatura y la top_p no afectan a la generación. |
| enable_thinking | boolean | true | - | Los controles Z.AI modo pensamiento. Activado es el valor predeterminado y hace que GLM-4.7-Flash piense; Desactivala para giros sencillos de baja latencia. |
| thinking | object | - | - | Objeto de pensamiento avanzado. Usa {"type":"enabled"} o {"type":"disabled"}. GLM-4.7-Flash piensa cuando está habilitado. |
| tools | array | - | - | Se soportan herramientas funcionales y la herramienta web_search integrada. |
| tool_choice | enum | auto | auto | Controla si el modelo puede usar herramientas. Z.AI documentos de selección automática de herramientas; Omite herramientas para desactivar el uso de herramientas. |
| tool_stream | boolean | false | - | Salida de la herramienta de llamada de función de flujo cuando el flujo es verdadero. Z.AI documentos tool_stream para GLM-4.6 y modelos más recientes. |
| tool_web_search | boolean | false | - | Activa la búsqueda web integrada. Añade $0.033 por petición cuando está activado. |
| search_result | boolean | true | - | Devuelve los metadatos estructurados de los resultados de búsqueda web cuando la búsqueda web esté habilitada. |
| search_prompt | string | - | - | Instrucción opcional para resumir los resultados de búsqueda web recuperados. |
| count | number | 10 | 1 a 50 | Número de resultados de búsqueda web por recuperar. |
El uso base de fichas es gratuito. La búsqueda web integrada es opcional a través de tool_web_search y añade $0.033 por solicitud cuando está activada.
En EmpirioLabs, GLM 4.7 Flash se factura por uso. La tabla de tarifas en vivo de esta página siempre coincide con lo que cobra la API.
GLM 4.7 Flash admite una ventana de contexto de 200K tokens con hasta 131.072 tokens de salida por respuesta.
Sí. GLM 4.7 Flash sirve la API de Chat Completions compatible con OpenAI, así que los SDKs de OpenAI existentes funcionan apuntando base_url a https://api.empiriolabs.ai/v1 y usando el id de modelo glm-4-7-flash.
Sí. El playground de EmpirioLabs ejecuta GLM 4.7 Flash en el navegador con los mismos parámetros que expone la API, para que pruebes prompts antes de escribir código.
Crea una cuenta de EmpirioLabs y genera una clave en API Keys en el panel. La facturación es con créditos de pago por uso, así que solo pagas por las solicitudes que haces.
Consulta nuestros precios o contacta con nosotros si quieres que tu propio modelo se implemente en nuestra pila.