
Modèle multimodal GLM-4.6V gratuit pour la compréhension d’images, vidéos, fichiers et texte avec appel de fonction natif.
Modèle multimodal GLM-4.6V gratuit pour la compréhension d’images, vidéos, fichiers et texte avec appel de fonction natif.
L’utilisation de base des jetons est gratuite. La recherche web intégrée est optionnelle via tool_web_search et ajoute $0.033 par requête lorsqu’elle est activée. Prend en charge les outils de saisie de texte, d’images, de vidéos et de fichiers ainsi que des outils fonctionnels, tool_choice auto, JSON response_format, contrôles de réflexion, tool_stream, température, top_p, do_sample, max_tokens, stop et streaming.
Aussi connu sous le nom Z.ai GLM 4.6V Flash, GLM-4.6V-Flash, glm-4-6v-flash
glm-4-6v-flash/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/glm-4-6v-flash:generateContentglm-4.6v-flashzai/glm-4.6v-flashzhipu/glm-4.6v-flashTarifs à l'usage en direct du catalogue EmpirioLabs. Vous ne payez que ce que vous utilisez, sans minimum mensuel.
GLM 4.6V Flash sert l'API Chat Completions compatible OpenAI. Pointez n'importe quel SDK OpenAI vers https://api.empiriolabs.ai/v1 avec votre clé API EmpirioLabs et utilisez l'id de modèle glm-4-6v-flash. Obtenez une clé API depuis le tableau de bord EmpirioLabs.
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-4-6v-flash",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="glm-4-6v-flash",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)Paramètres de requête pris en charge par l'API GLM 4.6V Flash sur EmpirioLabs. Les valeurs par défaut s'appliquent quand un champ est omis.
| Paramètre | Type | Par défaut | Plage / valeurs | Description |
|---|---|---|---|---|
| temperature | number | 1 | 0 à 1 | Température d’échantillonnage. Les valeurs plus basses sont plus déterministes. GLM-4.7-Flash et GLM-4.6V-Flash par défaut à 1.0; GLM-4.5-Flash est par défaut à 0,6. |
| top_p | number | 0.95 | 0.01 à 1 | Probabilité d’échantillonnage du noyau, masse. Z.AI documente un taux par défaut de 0,95 pour les séries GLM-4.7, GLM-4.6 et GLM-4.5. |
| max_tokens | number | 4096 | 1 à 32768 | Jetons de sortie maximaux pour GLM-4.6V-Flash: 32768. |
| stop | array | - | - | Liste de mots stop. Z.AI prend actuellement en charge une chaîne de stop sous forme de tableau. |
| do_sample | boolean | true | - | Activez l’échantillonnage. Lorsqu’ils sont faux, la température et top_p n’affectent pas la génération. |
| enable_thinking | boolean | true | - | Les contrôles Z.AI mode réflexion. Activé est la valeur par défaut; GLM-4.6V-Flash décide automatiquement s’il faut réfléchir lorsqu’il est activé. |
| thinking | object | - | - | Objet de pensée avancée. Utilisez {"type »:"enabled"} ou {"type »:"disabled"}. GLM-4.6V-Flash décide automatiquement s’il faut réfléchir lorsqu’il est activé. |
| tools | array | - | - | Les outils fonctionnels et l’outil de web_search intégré sont pris en charge. |
| tool_choice | enum | auto | auto | Contrôle si le modèle peut utiliser des outils. Z.AI documents la sélection automatique des outils; Omettez les outils pour désactiver l’utilisation des outils. |
| tool_stream | boolean | false | - | Sortie de l’outil d’appel de fonction du flux lorsque le flux est vrai. Z.AI documents tool_stream pour le GLM-4.6 et les modèles plus récents. |
| tool_web_search | boolean | false | - | Activez la recherche web intégrée. Ajoute $0.033 par requête lorsqu’il est activé. |
| search_result | boolean | true | - | Retournez les métadonnées structurées des résultats de recherche web lorsque la recherche web est activée. |
| search_prompt | string | - | - | Instruction optionnelle pour résumer les résultats de recherche web récupérés. |
| count | number | 10 | 1 à 50 | Nombre de résultats de recherche web à récupérer. |
L’utilisation de base des jetons est gratuite. La recherche web intégrée est optionnelle via tool_web_search et ajoute $0.033 par requête lorsqu’elle est activée.
Sur EmpirioLabs, GLM 4.6V Flash est facturé à l'usage. La grille tarifaire en direct de cette page correspond toujours à ce que l'API facture.
GLM 4.6V Flash prend en charge une fenêtre de contexte de 128K tokens avec jusqu'à 32 768 tokens de sortie par réponse.
Oui. GLM 4.6V Flash sert l'API Chat Completions compatible OpenAI : les SDKs OpenAI existants fonctionnent en pointant base_url vers https://api.empiriolabs.ai/v1 et en utilisant l'id de modèle glm-4-6v-flash.
Oui. Le playground EmpirioLabs exécute GLM 4.6V Flash dans le navigateur avec les mêmes paramètres que l'API expose, pour tester vos prompts avant d'écrire du code.
Créez un compte EmpirioLabs, puis générez une clé sous API Keys dans le tableau de bord. La facturation utilise des crédits à l'usage : vous ne payez que vos requêtes.
Consultez nos tarifs ou contactez-nous si vous souhaitez que votre propre modèle soit déployé sur notre stack.