RTX 4090 stundenweise mieten

Stelle eine dedizierte RTX 4090 Cloud-GPU auf EmpirioLabs AI bereit. JupyterLab, ComfyUI, vLLM-Serving und Web-Terminal-Templates mit einem Klick, sekundengenau abgerechnet, nur solange die Instanz laeuft.

Technische Daten und Preis

VRAM
24 GB
Preis
$0.65/hr
Verfügbarkeit (Live)
Nicht verfügbar
Multi-GPU-Konfigurationen
1x
RTX 4090 bereitstellen

Was du damit laufen kannst

Jede Instanz startet mit einer Ein-Klick-Vorlage, ohne Image-Erstellung oder Treiber-Setup:

Dienen Sie ein LLM (vLLM)
Stellen Sie eine fertige Modellkarte (gpt-oss, Qwen3.5 und 3.6, Qwen3 Coder) bereit oder fügen Sie eine beliebige Hugging Face Modell-ID ein. Der Start ist für das Modell und diese GPU automatisch konfiguriert und bedient einen OpenAI-kompatiblen Endpunkt mit einer Chatseite, die direkt in die Instanzansicht integriert ist.
Modelle mit Ollama ausführen
Ziehen Sie jedes offene Modell, einschließlich GGUF-Quantisierungen, und verwenden Sie es über die Ollama API. Gut für quantisierte Gewichte und das Ollama-Tooling, das du schon kennst.
JupyterLab
Eine CUDA PyTorch Notizbuch-Umgebung, die in wenigen Minuten im Browser geöffnet wird.
ComfyUI
Die node-basierte Bild- und Video-Workflow-Benutzeroberfläche mit dem Manager-Panel zur Installation benutzerdefinierter Knoten und Modelle.
Webterminal
Ein Browser-Bash-Shell in die Instanz für deine eigenen Docker-basierten Workloads und Serving-Stacks.

Wie GPU Cloud funktioniert

1. Wähle eine Konfiguration
Wählen Sie die GPU-Anzahl und ein Laufzeitspeicherziel aus dem Live-Katalog.
2. Wähle eine Vorlage aus
JupyterLab, ComfyUI, ein vLLM-Modellserver oder ein Browser-Webterminal, bereit in wenigen Minuten.
3. Verbinden Sie sich
Öffnen Sie die Arbeitslast im Browser oder rufen Sie sie über den authentifizierten EmpirioLabs Connect Endpunkt auf.

Häufige Fragen

Wie wird es abgerechnet?

Pro Sekunde zum angegebenen Stundensatz, nur solange die Instanz läuft. Die Rate ist beim Deployieren festgelegt, und das Stoppen oder Zerstören der Instanz stoppt die Ladung.

Was kann ich darauf verwenden?

Ein-Klick-Vorlagen umfassen JupyterLab-Notizbücher, ComfyUI, vLLM-Modelle, die mit jeder Hugging Face-Modell-ID bereitgestellt werden, sowie ein Browser-Webterminal für Ihre eigenen Arbeitslasten.

Ist es gerade verfügbar?

Die obigen Fakten zeigen die Live-Verfügbarkeit aus dem Einsatzkatalog. Wenn diese GPU ausverkauft ist, sind auf der GPU Cloud Seite meist andere GPUs mit ähnlichem VRAM verfügbar.

Kann ich mit dem Modell sprechen, das ich einsetze?

Ja. Eine One-Click-Modellinstanz enthält direkt in der Instanzansicht eine Chatseite, und der bereitgestellte Endpunkt ist OpenAI-kompatibel für die Nutzung aus Ihrem Code. Ollama-Instanzen stellen die Standard-Ollama-API offen.

Kann ich Instanzen über die API verwalten?

Yes. Deploy, stop, and destroy instances under /v1/gpu on api.empiriolabs.ai, and reach the running workload through the authenticated EmpirioLabs connect endpoint. The full reference is in the GPU Cloud Dokumente.

Bereit, bessere Endpunkte zu nutzen?

Schauen Sie sich unsere Preise an oder kontaktieren Sie uns, wenn Sie Ihr eigenes Modell auf unserem Stack implementieren möchten.