Deployez un GPU cloud L40S dedie sur EmpirioLabs AI. Templates JupyterLab, ComfyUI, serving vLLM et terminal web en un clic, factures a la seconde uniquement quand l'instance tourne.
Chaque instance se lance à partir d’un modèle en un clic, sans création d’image ni configuration de pilote:
Par seconde au tarif horaire indiqué, uniquement pendant que l’instance est en cours. La vitesse est verrouillée lors du déploiement, et arrêter ou détruire l’instance arrête la charge.
Les modèles One-Click couvrent les notebooks JupyterLab, ComfyUI, le modèle vLLM avec n’importe quel identifiant de modèle Hugging Face, ainsi qu’un terminal web navigateur pour vos propres charges de travail.
Les faits ci-dessus montrent une disponibilité en temps réel du catalogue de déploiement. Lorsque ce GPU est en rupture de stock, d’autres GPU avec une VRAM similaire sont généralement disponibles sur la page GPU Cloud.
Oui. Une instance de modèle à un clic inclut une page de chat directement sur la vue de l’instance, et le point de terminaison servi est compatible OpenAI pour une utilisation à partir de votre code. Les instances Ollama exposent l’API standard d’Ollama.
Yes. Deploy, stop, and destroy instances under /v1/gpu on api.empiriolabs.ai, and reach the running workload through the authenticated EmpirioLabs connect endpoint. The full reference is in the Documentation GPU Cloud.
Consultez nos tarifs ou contactez-nous si vous souhaitez que votre propre modèle soit déployé sur notre stack.