L40S 시간 단위 대여

EmpirioLabs AI에서 전용 L40S 클라우드 GPU를 배포하세요. JupyterLab, ComfyUI, vLLM 서빙, 웹 터미널 원클릭 템플릿. 인스턴스가 실행되는 동안에만 초 단위로 과금됩니다.

사양 및 가격

VRAM
48 GB
가격
$1.60/hr
재고 (실시간)
41개 사용 가능
멀티 GPU 구성
1x, 2x, 4x
L40S 배포

이 위에서 실행할 수 있는 것들

모든 인스턴스는 이미지 빌드나 드라이버 설정 없이 원클릭 템플릿에서 실행됩니다:

LLM (vLLM) 제공
기성품 모델 카드(gpt-oss, Qwen3.5 및 3.6, Qwen3 Coder)를 배포하거나 Hugging Face 모델 ID를 붙여넣으세요. 출시는 모델과 GPU에 맞게 자동 설정되며, 인스턴스 뷰에 내장된 채팅 페이지가 포함된 OpenAI 호환 엔드포인트를 제공합니다.
Ollama 사용된 런 모델
GGUF 양자화 포함 어떤 오픈 모델이든 가져와서 Ollama API를 통해 사용할 수 있습니다. 양자화 가중치와 이미 알고 있는 올라마 공구에 좋습니다.
주피터랩
CUDA PyTorch 노트북 환경으로, 브라우저에서 몇 분 만에 열릴 수 있습니다.
편안한 UI
노드 기반 이미지 및 비디오 워크플로우 UI, 그리고 사용자 지정 노드와 모델을 설치할 수 있는 관리자 패널이 있습니다.
웹 터미널
자신의 도커 기반 워크로드와 서빙 스택을 위해 인스턴스에 브라우저 배시 셸을 넣는 것입니다.

GPU 클라우드 작동 원리

1. 구성 선택
라이브 카탈로그에서 GPU 수와 런타임 스토리지 목표를 선택하세요.
2. 템플릿 선택
JupyterLab, ComfyUI, vLLM 모델 서버, 또는 브라우저 웹 터미널 모두 몇 분 만에 준비됩니다.
3. 연결
브라우저에서 워크로드를 열거나 인증된 EmpirioLabs Connect 엔드포인트를 통해 호출하세요.

자주 묻는 질문

어떻게 청구되나요?

인스턴스가 실행 중일 때만 시간당 시간당 초당 요금입니다. 배치 시 속도가 고정되고, 인스턴스를 멈추거나 파괴하면 충전이 멈춥니다.

이 위에서 무엇을 실행할 수 있나요?

원클릭 템플릿은 JupyterLab 노트북, ComfyUI, Hugging Face 모델 ID와 함께 제공되는 vLLM 모델, 그리고 자체 작업용 브라우저 웹 터미널을 포함합니다.

지금 당장 이용 가능한가요?

위 사실들은 배포 카탈로그에서 실시간 가용성을 보여줍니다. 이 GPU가 품절될 때는 보통 GPU Cloud 페이지에서 비슷한 VRAM을 가진 다른 GPU를 구할 수 있습니다.

배포하는 모델과 채팅할 수 있나요?

네. 원클릭 모델 인스턴스는 인스턴스 뷰에 채팅 페이지가 있고, 제공된 엔드포인트는 코드에서 사용할 수 있도록 OpenAI 호환입니다. Ollama 인스턴스는 표준 Ollama API를 노출합니다.

API를 통해 인스턴스를 관리할 수 있나요?

Yes. Deploy, stop, and destroy instances under /v1/gpu on api.empiriolabs.ai, and reach the running workload through the authenticated EmpirioLabs connect endpoint. The full reference is in the GPU 클라우드 문서·.

더 나은 엔드포인트를 사용할 준비가 되셨나요?

저희 가격을 확인하시거나 저희 스택에 자체 모델을 배포하고 싶으시면 연락해 주세요.