Alquila RTX 4090 por hora

Despliega una GPU RTX 4090 dedicada en la nube en EmpirioLabs AI. Plantillas de JupyterLab, ComfyUI, servicio vLLM y terminal web en un clic, facturadas por segundo solo mientras la instancia esta activa.

Especificaciones y precio

VRAM
24 GB
Precio
$0.65/hr
Disponibilidad (en vivo)
No disponible
Configuraciones multi-GPU
1x
Desplegar RTX 4090

Lo que puedes hacer funcionar con él

Cada instancia se inicia desde una plantilla de un solo clic, sin creación de imagen ni configuración de controladores:

Sirve a un LLM (vLLM)
Despliega una tarjeta modelo lista para usar (gpt-oss, Qwen3.5 y 3.6, Qwen3 Coder) o pega cualquier id de modelo de Hugging Face. El lanzamiento está configurado automáticamente para el modelo y esta GPU, y sirve a un endpoint compatible con OpenAI con una página de chat integrada directamente en la vista de instancia.
Ejecutar modelos con Ollama
Saca cualquier modelo abierto, incluidas cuantizaciones GGUF, y úsalo a través de la API de Ollama. Bueno para pesos cuantizados y las herramientas de Ollama que ya conoces.
JupyterLab
Un entorno de notebook CUDA PyTorch, abierto en el navegador en minutos.
ComfyUI
La interfaz de flujo de trabajo basada en nodos de imagen y vídeo, con el panel Manager para instalar nodos y modelos personalizados.
Terminal web
Un shell de navegador para integrar la instancia para tus propias cargas de trabajo basadas en Docker y stacks de servicio.

Cómo funciona la nube de la GPU

1. Elegir una configuración
Elige el recuento de GPU y un destino de almacenamiento en tiempo de ejecución del catálogo en vivo.
2. Elige una plantilla
JupyterLab, ComfyUI, un servidor modelo vLLM o un terminal web de navegador, listos en minutos.
3. Conectar
Abre la carga de trabajo en el navegador o llámala a través del endpoint autenticado de EmpirioLabs Connect.

Preguntas frecuentes

¿Cómo se factura?

Por segundo a la tarifa horaria indicada, solo mientras la instancia esté en funcionamiento. La tasa está fija cuando despliegas, y detener o destruir la instancia detiene la carga.

¿Qué puedo usar con él?

Las plantillas de un solo clic cubren cuadernos JupyterLab, ComfyUI, modelo vLLM que sirve con cualquier id de modelo Hugging Face, y un terminal web de navegador para tus propias cargas de trabajo.

¿Está disponible ahora mismo?

Los datos anteriores muestran disponibilidad en tiempo real del catálogo de despliegues. Cuando esta GPU está agotada, normalmente hay otras GPUs con VRAM similar disponibles en la página GPU Cloud.

¿Puedo hablar con el modelo que despliegue?

Sí. Una instancia de modelo de un solo clic incluye una página de chat directamente en la vista de la instancia, y el endpoint servido es compatible con OpenAI para su uso desde tu código. Las instancias de Ollama exponen la API estándar de Ollama.

¿Puedo gestionar instancias a través de la API?

Yes. Deploy, stop, and destroy instances under /v1/gpu on api.empiriolabs.ai, and reach the running workload through the authenticated EmpirioLabs connect endpoint. The full reference is in the Documentación de GPU Cloud.

¿Listo para usar mejores endpoints?

Consulta nuestros precios o contacta con nosotros si quieres que tu propio modelo se implemente en nuestra pila.