Despliega una GPU A40 dedicada en la nube en EmpirioLabs AI. Plantillas de JupyterLab, ComfyUI, servicio vLLM y terminal web en un clic, facturadas por segundo solo mientras la instancia esta activa.
Cada instancia se inicia desde una plantilla de un solo clic, sin creación de imagen ni configuración de controladores:
Por segundo a la tarifa horaria indicada, solo mientras la instancia esté en funcionamiento. La tasa está fija cuando despliegas, y detener o destruir la instancia detiene la carga.
Las plantillas de un solo clic cubren cuadernos JupyterLab, ComfyUI, modelo vLLM que sirve con cualquier id de modelo Hugging Face, y un terminal web de navegador para tus propias cargas de trabajo.
Los datos anteriores muestran disponibilidad en tiempo real del catálogo de despliegues. Cuando esta GPU está agotada, normalmente hay otras GPUs con VRAM similar disponibles en la página GPU Cloud.
Sí. Una instancia de modelo de un solo clic incluye una página de chat directamente en la vista de la instancia, y el endpoint servido es compatible con OpenAI para su uso desde tu código. Las instancias de Ollama exponen la API estándar de Ollama.
Yes. Deploy, stop, and destroy instances under /v1/gpu on api.empiriolabs.ai, and reach the running workload through the authenticated EmpirioLabs connect endpoint. The full reference is in the Documentación de GPU Cloud.
Consulta nuestros precios o contacta con nosotros si quieres que tu propio modelo se implemente en nuestra pila.