Kurze Antwort: Wan 3.0 ist Alibabas all-in-one Videomodell, verfügbar auf EmpirioLabs über einen OpenAI-ähnlichen Endpunkt. Es erzeugt Clips von 2 bis 30 Sekunden mit synchronisiertem Ton, und eine Anfrage kann bis zu 10 Referenzbilder, 5 Referenzvideos, 5 Audioclips und ein Dokument oder eine Webseite verwenden. Nennen wir es mit Modell: "wan-3-0" auf POST /v1/videos/generations, und wähle die Servierstufe mit model_tier: standard für die Basisrate oder Primzahl Für deutlich schnellere end-to-end Generation.
Was ist neu gegenüber Wan 2.7
| Leistungsfähigkeit | Wan 2.7 | Wan 3.0 |
|---|---|---|
| Ausgangslänge | 2 bis 15 Sekunden | 2 bis 30 Sekunden, oder das Modell wählen lassen |
| Referenzvermögen | 5 kombiniert | 10 Bilder, 5 Videos und 5 Audioclips |
| Dokument- und Webseitenreferenzen | Nicht unterstützt | 1 Datei oder 1 öffentlicher Link pro Anfrage |
| Resolutionen | 720p, 1080p | 480p, 720p, 1080p |
| Seitenverhältnis | Feste Voreinstellungen | Standardmäßig adaptiv, plus fünf Presets |
| Servier-Ebenen | Eins | Standard und Prime (schnellere End-to-End) |
Quickstart
Die Videoerzeugung erfolgt asynchron. Reiche den Job ein und frage ihn dann aus.
curl -X POST https://api.empiriolabs.ai/v1/videos/generations \ -H "Autorisierung: Träger $EMPIRIOLABS_API_KEY" \ -H "Inhaltstyp: application/json" \ -d '{ "model": "wan-3-0", "model_tier": "prime", "prompt": "Ein Kolibri, der im goldenen Stundenlicht über einer roten Blume schwebt, Zeitlupe", "Auflösung": "1080p", "Duration": 6 }' # -> {"job_id": "...", "status": "Processing", "poll_url": "/v1/jobs/..."} curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \ -H "Autorisierung: Träger $EMPIRIOLABS_API_KEY"
Drei Arten, ihn zu fahren
- Text zu Video: ein Prompt allein, bis zu 20.000 Zeichen. Die Ausgabe enthält standardmäßig einen generierten Soundtrack; Set
Audio: FalseFür einen lautlosen Clip zum gleichen Preis. - Erster und letzter Frame: Fügen Sie ein Bild an, um es zu animieren, oder genau zwei Bilder, und das Modell interpoliert die Reise zwischen ihnen.
- Omni-Referenz: Fügen Sie eine beliebige Mischung aus Referenzbildern, Videos und Audiodateien sowie optional ein Dokument oder einen öffentlichen Weblink hinzu und adressieren Sie diese dann im Prompt als
Bild 1,Video 1,Audio 1. Das Modell bringt Motive, Bewegung und Stimmen in die neue Szene.
Die Modus Parameter ist optional: Auto Liest deine Anhänge und Empfehlungen für dich.
Betriebshinweise
- Erst- und Lastframe-Eingaben können nicht mit Referenzeingaben in einer einzigen Anfrage kombiniert werden. Das Hinzufügen von Audio, einem Dokument oder einem Weblink zu einer Bildanfrage versetzt sie in den Referenzmodus, also einen expliziten
Modus: "i2V"zusammen mit Audio gibt ein Validierungsfehler zurück; Verlassen SieModusauf Auto und die Anfrage routet sich selbst. - Jedes Eingabebild muss mindestens 240 Pixel pro Seite und höchstens 8.000 Pixel umfassen. Kleinere Bilder werden vor Beginn der Erzeugung abgelehnt.
- Bei Videoreferenzen teilen sich Ein- und Ausgabesekunden ein 30-Sekunden-Budget, und die berechneten Sekunden decken Ein- und Ausgang zusammen. Das Jobergebnis gibt die genaue berechnete Dauer an.
Dauer: -1lässt das Modell die Cliplänge aus deinem Prompt und den Referenzen auswählen; Die Abrechnung folgt dem tatsächlichen Ergebnis der Sekunden im Job.
Preisgestaltung
Wan 3.0 ist Pay-as-you-go, berechnet pro Sekunde Video zu einem Satz, der von der Auflösung und der Servierung festgelegt wird. Prime kostet mehr pro Sekunde als Standard und liefert deutlich schneller Ergebnisse. Die aktuellen Sekundenraten für alle sechs Kombinationen sind auf dem modellblatt und die preisseite.
Probier es mal
Lass es in der spielplatz ohne Code oder ohne Lesefehler API-Referenz für die vollständige Parameterliste. Wan 3.0 versorgt außerdem die kreativen Effekte im Reiter playground Effekte. Die vorherige Generation, Wan 2.7bleibt mit seinem Videoschnittmodus verfügbar.



