Alugue RTX A6000 por hora

Implante uma GPU RTX A6000 dedicada na nuvem na EmpirioLabs AI. Templates de JupyterLab, ComfyUI, serving vLLM e terminal web em um clique, cobrados por segundo apenas enquanto a instancia roda.

Especificações e preço

VRAM
48 GB
Preço
$0.65/hr
Disponibilidade (ao vivo)
3 disponíveis
Configurações multi-GPU
1x
Implantar RTX A6000

O que você pode rodar nele

Cada instância é iniciada a partir de um modelo de um clique, sem construção de imagem ou configuração de driver:

Cumpra um LLM (vLLM)
Implante uma placa modelo pronta (gpt-oss, Qwen3.5 e 3.6, Qwen3 Coder) ou cole qualquer ID de modelo Hugging Face. O lançamento é configurado automaticamente para o modelo e para essa GPU, e serve a um endpoint compatível com OpenAI com uma página de chat embutida diretamente na visualização da instância.
Corria modelos com Ollama
Extraia qualquer modelo aberto, incluindo quantizações GGUF, e use-o pela API do Ollama. Bom para pesos quantizados e para as ferramentas Ollama que você já conhece.
JupyterLab
Um ambiente de notebook CUDA PyTorch, aberto no navegador em minutos.
ComfyUI
A interface de fluxo de trabalho baseada em nós e vídeos, com o painel Gerenciador para instalar nós e modelos personalizados.
Terminal web
Um shell de navegador para aplicar bash na instância para suas próprias cargas de trabalho baseadas em Docker e stacks de serviço.

Como funciona a Nuvem da GPU

1. Escolha uma configuração
Escolha a contagem da GPU e um alvo de armazenamento em tempo de execução do catálogo ao vivo.
2. Escolha um modelo
JupyterLab, ComfyUI, um servidor modelo vLLM ou um terminal web de navegador, prontos em minutos.
3. Conectar
Abra a carga de trabalho no navegador ou ligue-a pelo endpoint autenticado EmpirioLabs Connect.

Perguntas comuns

Como é faturado?

Por segundo na taxa horária listada, somente enquanto a instância estiver em execução. A taxa fica fixa quando você se posiciona, e parar ou destruir a instância para a carga.

O que posso usar nele?

Os modelos de um clique cobrem notebooks JupyterLab, ComfyUI, modelo vLLM que serve com qualquer ID de modelo Hugging Face, e um terminal web de navegador para suas próprias cargas de trabalho.

Está disponível agora?

Os fatos acima mostram disponibilidade ao vivo do catálogo de implantação. Quando essa GPU está esgotada, outras GPUs com VRAM semelhante geralmente estão disponíveis na página GPU Cloud.

Posso conversar com o modelo que eu implemento?

Sim. Uma instância de modelo com um clique inclui uma página de chat logo na visualização da instância, e o endpoint servido é compatível com OpenAI para uso a partir do seu código. Instâncias Ollama expõem a API padrão Ollama.

Posso gerenciar instâncias pela API?

Yes. Deploy, stop, and destroy instances under /v1/gpu on api.empiriolabs.ai, and reach the running workload through the authenticated EmpirioLabs connect endpoint. The full reference is in the Documentação da GPU Cloud.

Pronto para usar endpoints melhores?

Confira nossos preços ou entre em contato se quiser que seu próprio modelo seja implementado em nossa pilha.