Louez L40 a l'heure

Deployez un GPU cloud L40 dedie sur EmpirioLabs AI. Templates JupyterLab, ComfyUI, serving vLLM et terminal web en un clic, factures a la seconde uniquement quand l'instance tourne.

Spécifications et prix

VRAM
48 GB
Prix
$1.50/hr
Disponibilité (en direct)
64 disponibles
Configurations multi-GPU
1x, 2x, 4x, 8x
Deployer L40

Ce que tu peux faire fonctionner dessus

Chaque instance se lance à partir d’un modèle en un clic, sans création d’image ni configuration de pilote:

Servir un LLM (vLLM)
Déploie une carte modèle prête à l’emploi (gpt-oss, Qwen3.5 et 3.6, Qwen3 Coder) ou colle n’importe quel identifiant de modèle Hugging Face. Le lancement est automatiquement configuré pour le modèle et ce GPU, et il sert un point de terminaison compatible OpenAI avec une page de chat intégrée directement dans la vue d’instance.
Faire tourner des modèles avec Ollama
Extrais n’importe quel modèle ouvert, y compris les quantifications GGUF, et utilise-le via l’API Ollama. C’est bon pour les poids quantifiés et les outils Ollama que vous connaissez déjà.
JupyterLab
Un environnement notebook CUDA PyTorch, ouvert dans le navigateur en quelques minutes.
ComfyUI
L’interface de flux de travail basée sur les nœuds d’image et de vidéo, avec le panneau Manager pour installer des nœuds et modèles personnalisés.
Terminal web
Un shell de navigateur qui transforme l’instance dans l’instance pour vos propres charges de travail basées sur Docker et vos stacks de service.

Comment fonctionne le cloud GPU

1. Choisir une configuration
Choisissez le nombre de GPU et une cible de stockage à l’exécution dans le catalogue en direct.
2. Choisissez un modèle
JupyterLab, ComfyUI, un serveur modèle vLLM, ou un terminal web navigateur, prêt en quelques minutes.
3. Connexion
Ouvrez la charge de travail dans le navigateur ou appelez-la via le point de terminaison EmpirioLabs Connect authentifié.

Questions fréquentes

Comment est-ce facturé ?

Par seconde au tarif horaire indiqué, uniquement pendant que l’instance est en cours. La vitesse est verrouillée lors du déploiement, et arrêter ou détruire l’instance arrête la charge.

Que puis-je utiliser ?

Les modèles One-Click couvrent les notebooks JupyterLab, ComfyUI, le modèle vLLM avec n’importe quel identifiant de modèle Hugging Face, ainsi qu’un terminal web navigateur pour vos propres charges de travail.

Est-ce disponible en ce moment ?

Les faits ci-dessus montrent une disponibilité en temps réel du catalogue de déploiement. Lorsque ce GPU est en rupture de stock, d’autres GPU avec une VRAM similaire sont généralement disponibles sur la page GPU Cloud.

Puis-je discuter avec le modèle que je déploie ?

Oui. Une instance de modèle à un clic inclut une page de chat directement sur la vue de l’instance, et le point de terminaison servi est compatible OpenAI pour une utilisation à partir de votre code. Les instances Ollama exposent l’API standard d’Ollama.

Puis-je gérer des instances via l’API ?

Yes. Deploy, stop, and destroy instances under /v1/gpu on api.empiriolabs.ai, and reach the running workload through the authenticated EmpirioLabs connect endpoint. The full reference is in the Documentation GPU Cloud.

Prêt à utiliser de meilleurs points de terminaison ?

Consultez nos tarifs ou contactez-nous si vous souhaitez que votre propre modèle soit déployé sur notre stack.