按小时租用 L40

在 EmpirioLabs AI 部署专用 L40 云GPU。一键启动 JupyterLab、ComfyUI、vLLM 推理服务和网页终端模板,仅在实例运行时按秒计费。

规格与价格

VRAM
48 GB
价格
$1.50/hr
可用情况(实时)
64 个可用
多GPU配置
1x, 2x, 4x, 8x
部署 L40

你可以在上面运行什么

每个实例都从一键模板启动,无需构建图像或驱动设置:

提供LLM(vLLM)
部署现成的模型卡(gpt-oss,Qwen3.5 和 3.6,Qwen3 Coder),或粘贴任何 Hugging Face 型号 ID。发布时会自动配置该型号和该显卡,并且它为一个兼容OpenAI的终端提供服务,实时查看中内置了聊天页面。
带 Ollama 的运行模型
拉取任何开放模型,包括GGUF量化,并通过Ollama API使用。适合量化权重和你已经熟悉的Ollama工具。
JupyterLab
一个CUDA PyTorch笔记本环境,几分钟内即可在浏览器中打开。
ComfyUI
基于节点的图像和视频工作流程界面,配有用于安装自定义节点和模型的管理器面板。
网页终端
在实例中用浏览器 bash shell 构建,支持你自己的基于 Docker 的工作负载和服务栈。

GPU 云的工作原理

1. 选择配置
从实时目录中选择GPU数量和运行时存储目标。
2. 选择一个模板
JupyterLab、ComfyUI、vLLM模型服务器,或浏览器网页终端,几分钟内即可完成。
3. 连接
在浏览器中打开工作负载,或者通过认证的EmpirioLabs connect端点调用它。

常见问题

它是如何宣传的?

按每秒按标示的小时费率计算,仅在实例运行期间。部署时速率锁定,停止或摧毁实例会停止冲锋。

我能在上面运行什么?

一键模板涵盖 JupyterLab 笔记本、ComfyUI、vLLM 模型,支持任何 Hugging Face 模型 ID,以及用于你自身工作负载的浏览器网页终端。

现在有得买吗?

上述事实显示部署目录中的实时可用性。当这款显卡缺货时,通常会在GPU Cloud页面上找到其他配备类似显存的显卡。

我可以和我部署的模型聊天吗?

是的。一键模型实例在实例视图中直接包含聊天页面,且服务端点兼容OpenAI以便使用你的代码。Ollama 实例暴露了标准的 Ollama API。

我可以通过API管理实例吗?

Yes. Deploy, stop, and destroy instances under /v1/gpu on api.empiriolabs.ai, and reach the running workload through the authenticated EmpirioLabs connect endpoint. The full reference is in the GPU 云文档。 。 。.

准备好使用更好的终端了吗?

查看我们的定价,或者如果你想将自己的模型部署到我们的堆栈中,请联系我们。