Accueil Blog

Comment utiliser l’API Muse Glimmer 30B

Muse Glimmer 30B via la carte de couverture API

Aug 10, 2026

EmpirioLabs AI

Le Muse Glimmer 30B est disponible sur EmpirioLabs. Le modèle agent ouvert 30B de Meta fonctionne sur EmpirioLabs inférence native avec un contexte de 131 072 jetons, une entrée texte et image, des appels de fonctions, une sortie strictement structurée et une force de raisonnement ajustable. Il est conçu pour les échafaudages d’agents, le codage et le travail d’outils en plusieurs étapes.

Ce que prend en charge Muse Glimmer 30B

Muse Glimmer 30B accepte le texte et les images et écrit du texte. L’encodeur de perception lit les captures d’écran, les graphiques et les documents en même temps que la conversation, ce qui en fait un excellent choix pour les agents qui consultent de vraies interfaces. Les outils de fonction peuvent être appelés en parallèle, et une sortie structurée strictement JSON Schema restitue exactement la forme que vous demandez.

La force de raisonnement est ajustable. Utilisation raisonnement effort de aucune à travers max pour échanger vitesse contre profondeur; haut est le par défaut et max correspondant au réglage le plus fort du modèle. Flux de texte de raisonnement sur le raisonnement contenu Les jetons de canal et de raisonnement sont rapportés en utilisation.

Comment appeler Muse Glimmer 30B

Utilisez le point de terminaison de complétions de chat compatible OpenAI et définissez modèle à muse-glimmer-30b:

curl https://api.empiriolabs.ai/v1/chat/completions \ -H 'Autorisation: Porteur $EMPIRIOLABS_API_KEY' \ -H 'Type-de-contenu: application/json' \ -d '{ « modèle »: « muse-glimmer-30b », « reasoning_effort »: « haut », « messages »: [ { « rôle »: « utilisateur », « contenu »: « Planifiez un déploiement progressif pour un changement d’API de dernière minute. » } ] }'

Le même modèle est disponible via les points de terminaison Responses, Messages, complétions héritées et génération de contenu compatibles Google. Les réponses en streaming incluent les données d’utilisation finale, et les entrées en cache sont rapportées afin que les invites répétées se stabilisent au taux de cache réduit.

Vision, outils et production structurée

Attacher des images comme standard image_url Parties de contenu, incluant plusieurs images dans un seul message. Pour des résultats lisibles par machine, utilisez le mode JSON ou fournissez un schéma JSON strict. La recherche web optionnelle propulsée par Linkup permet de récupérer les sources récentes de votre dernier message et ajoute un petit frais par appel lors de l’invocation.

Prix

Muse Glimmer 30B utilise pay-as-you-go prix de jetons avec un tarif fortement réduit pour les entrées en cache et sans frais par siège. Les tarifs actuels sont sur le page modèle et Tarification.

Essaie

Ouvrir la aire de jeux, lire Docs API, ou parcourir Tous les modèles et Tarification.

Prêt à utiliser de meilleurs points de terminaison ?

Explorez nos modèles, ou contactez-nous pour toute demande d’entreprise, des déploiements personnalisés ou pour tout autre sujet.