Despliega una GPU RTX A6000 dedicada en la nube en EmpirioLabs AI. Plantillas de JupyterLab, ComfyUI, servicio vLLM y terminal web en un clic, facturadas por segundo solo mientras la instancia esta activa.
El almacenamiento en tiempo de ejecución está incluido en el precio por hora y se borra cuando la instancia se destruye. Para conservar archivos entre sesiones, adjunta un volumen persistente a $0.18 por GB-mes, facturado por segundo mientras el volumen exista, incluso mientras no haya GPU en funcionamiento.
Desplegar RTX A6000Cada instancia se inicia desde una plantilla de un solo clic, sin creación de imagen ni configuración de controladores:
Por segundo a la tarifa horaria indicada desde el momento en que se asigna la GPU, incluyendo el arranque, hasta que detienes o destruyes la instancia. La tasa se fija cuando despliegas, y detener o destruir la instancia detiene la carga.
Las plantillas de un solo clic cubren cuadernos JupyterLab, ComfyUI, modelo vLLM que sirve con cualquier id de modelo Hugging Face, y un terminal web de navegador para tus propias cargas de trabajo.
Los datos anteriores muestran disponibilidad en tiempo real del catálogo de despliegues. Cuando esta GPU está agotada, normalmente hay otras GPUs con VRAM similar disponibles en la página GPU Cloud.
Sí. Una instancia de modelo de un solo clic incluye una página de chat directamente en la vista de la instancia, y el endpoint servido es compatible con OpenAI para su uso desde tu código. Las instancias de Ollama exponen la API estándar de Ollama.
Yes. Deploy, stop, and destroy instances under /v1/gpu on api.empiriolabs.ai, and reach the running workload through the authenticated EmpirioLabs connect endpoint. The full reference is in the Documentación de GPU Cloud.
Consulta nuestros precios o contacta con nosotros si quieres que tu propio modelo se implemente en nuestra pila.