Wan 3.0 API

Generación de vídeo todo en uno de hasta 30 segundos con audio nativo, referencias omnimodales (imágenes, vídeo, audio, archivos, enlaces web) y un rápido nivel Prime.

Alibaba CloudGeneracion de videoLanzado 6 ago 2026SingaporeEndpoint propietarioNuevo

Acerca de Wan 3.0

Generación de vídeo todo en uno de hasta 30 segundos con audio nativo, referencias omnimodales (imágenes, vídeo, audio, archivos, enlaces web) y un rápido nivel Prime.

También conocido como Alibaba Cloud Wan 3.0

text to videoimage to videoreference to videoaudio synccharacter consistency

Especificaciones de Wan 3.0

ID del modelo
wan-3-0
Proveedor
Alibaba Cloud
Categoría
Generacion de video
Lanzado
6 ago 2026
Entrada
TextoImagenVideoAudio
Salida
Video
Región
Singapore
Endpoints
POST/v1/videos/generations
IDs de modelo alternativos
alibaba/wan-3.0wan-3.0wan3.0wan3.0-videowan3.0-video-prime

Precios de la API de Wan 3.0

Tarifas de pago por uso en vivo del catálogo de EmpirioLabs. Solo pagas por lo que usas, sin mínimo mensual.

Tipo
Especificación
Tarifa
480P estándar
por segundo
$0.07
720P estándar
por segundo
$0.14
1080P estándar
por segundo
$0.28
Prime 480P
por segundo
$0.136
Prime 720P
por segundo
$0.28
Prime 1080P
por segundo
$0.56
Comparar en la página completa de precios

Cómo llamar a la API de Wan 3.0

Wan 3.0 funciona a través de POST /v1/videos/generations. La solicitud devuelve un job_id de inmediato; consulta GET /v1/jobs/{job_id} hasta que el trabajo termine y lee las URLs de salida del resultado. Consigue una clave de API en el panel de EmpirioLabs.

cURL: enviar el trabajo
curl https://api.empiriolabs.ai/v1/videos/generations \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "wan-3-0",
    "prompt": "Describe what you want Wan 3.0 to generate."
  }'
cURL: consultar el resultado
curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY"
Python
import requests

response = requests.post(
    "https://api.empiriolabs.ai/v1/videos/generations",
    headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
    json={
        "model": "wan-3-0",
        "prompt": "Describe what you want Wan 3.0 to generate.",
    },
)
job = response.json()

# Generation runs as an async job. Poll until it completes.
import time
while True:
    status = requests.get(
        f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
        headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
    ).json()
    if status.get("status") in ("completed", "failed"):
        print(status)
        break
    time.sleep(5)
Referencia completa de la API de Wan 3.0

Parámetros de la API de Wan 3.0

Parámetros de solicitud compatibles con la API de Wan 3.0 en EmpirioLabs. Los valores por defecto se aplican cuando se omite un campo.

ParámetroTipoPredeterminadoRango / valoresDescripción
promptstring--Descripción de la escena, hasta 20.000 caracteres. En modo de referencia, dirige las entradas en tu prompt como Imagen 1, Vídeo 1, Audio 1.
model_tierenumstandardstandard, primeEstándar: Calidad completa al precio base. Prime: generación de end-to-end significativamente más rápida a una tasa por segundo mayor. Cada nivel se factura a su...
modeenumautoauto, t2v, i2v, r2vDetecta automáticamente de los archivos adjuntos. T2V: text-to-video. i2v: animar una imagen o interpolar entre dos (primer y último fotograma). R2V: Referencia Omni...
resolutionenum1080p480p, 720p, 1080pResolución de salida. Cada resolución factura a su propio ritmo por segundo.
durationnumber52 a 30Duración del clip en segundos. Pasar -1 a través de la API para que el modelo elija la longitud. Con las referencias de vídeo, la entrada más salida se mantiene...
aspect_ratioenumadaptiveadaptive, 16:9, 9:16, 1:1, 4:3, 3:4Adaptive recomienda una relación de aspecto a partir de tus entradas y el prompt.
imagestring--URL de la imagen. i2v utiliza una o dos imágenes (primer y último fotograma); R2V acepta hasta 10 referencias.
videostring--URL de vídeo de referencia (r2v). Hasta 5 clips, 15 segundos en total.
seednumber-0 a 2147483647Semilla de reproducibilidad.
audiobooleantrue-Genera la banda sonora con el vídeo. Apagarlo no cambia el precio.
watermarkbooleanfalse-Añade una marca de agua de procedencia a la salida.
prompt_extendbooleantrue-Deja que el servicio reescriba el enunciado para obtener mejores resultados.
linkstring--URL de página web pública utilizada como referencia (r2v). Proporciona un enlace o un file_url, no ambos.
file_urlstring--URL de documento usada como referencia (r2v): PDF, Office o archivos de texto de hasta 100 MB y 50 páginas. Proporciona un file_url o un enlace, no ambos.

Información útil

La generación puede durar varios minutos en el nivel estándar; El nivel prime es significativamente más rápido de principio a fin. Los modos se detectan automáticamente en los archivos adjuntos o anulan con el parámetro mode. El parámetro model_tier elige estándar o primo; Cada nivel factura a su propio ritmo por segundo. Modos - T2V: sin archivos adjuntos - I2V: 1 imagen (primer fotograma), o exactamente 2 imágenes (primer + último fotograma) - R2V (referencia omni): hasta 10 imágenes, 5 vídeos (15 segundos combinados) y 5 clips de audio (15 segundos combinados), más 1 archivo de documento o 1 enlace web público; los direccionas en tu prompt como Image 1, Video 1, Audio 1 - Los fotogramas I2V y referencias R2V no pueden combinarse en una sola solicitud Entradas - Imágenes: JPEG, PNG, BMP o WEBP, 240 a 8.000 px por cara, hasta 20 MB - Vídeos: MP4 o MOV, 1-15 segundos por clip, hasta 100 MB - Audio: WAV o MP3, 1-15 segundos por clip, hasta 15 MB Duración y facturación - Los clips duran entre 2 y 30 segundos; pasa duration: -1 para dejar que el modelo elija la duración - Con referencias de vídeo, entrada y salida comparten el presupuesto de 30 segundos, y los segundos facturados cubren la entrada + salida combinadas - La salida es MP4 a 30 fps con audio nativo; audio: false desactiva el sonido sin cambiar el precio Preprocesamiento de medios subidos - Los vídeos de referencia se normalizan a MP4 compatibles con el proveedor cuando es necesario.

API de Wan 3.0: preguntas frecuentes

¿Cuánto cuesta la API de Wan 3.0?

En EmpirioLabs, Wan 3.0 se factura por uso: 480P estándar $0.07 por segundo; 720P estándar $0.14 por segundo; 1080P estándar $0.28 por segundo. La tabla de tarifas en vivo de esta página siempre coincide con lo que cobra la API.

¿Qué endpoint usa Wan 3.0?

Wan 3.0 se sirve a través de POST /v1/videos/generations en api.empiriolabs.ai con autenticación estándar de token Bearer.

¿Puedo probar Wan 3.0 en el navegador antes de integrar?

Sí. El playground de EmpirioLabs ejecuta Wan 3.0 en el navegador con los mismos parámetros que expone la API, para que pruebes prompts antes de escribir código.

¿Cómo consigo una clave de API de Wan 3.0?

Crea una cuenta de EmpirioLabs y genera una clave en API Keys en el panel. La facturación es con créditos de pago por uso, así que solo pagas por las solicitudes que haces.

¿Listo para usar mejores endpoints?

Consulta nuestros precios o contacta con nosotros si quieres que tu propio modelo se implemente en nuestra pila.