Implante uma GPU A100 40GB dedicada na nuvem na EmpirioLabs AI. Templates de JupyterLab, ComfyUI, serving vLLM e terminal web em um clique, cobrados por segundo apenas enquanto a instancia roda.
Cada instância é iniciada a partir de um modelo de um clique, sem construção de imagem ou configuração de driver:
Por segundo na taxa horária listada, somente enquanto a instância estiver em execução. A taxa fica fixa quando você se posiciona, e parar ou destruir a instância para a carga.
Os modelos de um clique cobrem notebooks JupyterLab, ComfyUI, modelo vLLM que serve com qualquer ID de modelo Hugging Face, e um terminal web de navegador para suas próprias cargas de trabalho.
Os fatos acima mostram disponibilidade ao vivo do catálogo de implantação. Quando essa GPU está esgotada, outras GPUs com VRAM semelhante geralmente estão disponíveis na página GPU Cloud.
Sim. Uma instância de modelo com um clique inclui uma página de chat logo na visualização da instância, e o endpoint servido é compatível com OpenAI para uso a partir do seu código. Instâncias Ollama expõem a API padrão Ollama.
Yes. Deploy, stop, and destroy instances under /v1/gpu on api.empiriolabs.ai, and reach the running workload through the authenticated EmpirioLabs connect endpoint. The full reference is in the Documentação da GPU Cloud.
Confira nossos preços ou entre em contato se quiser que seu próprio modelo seja implementado em nossa pilha.