
Geração de vídeo tudo-em-um de até 30 segundos com áudio nativo, referências omni-modais (imagens, vídeo, áudio, arquivos, links web) e um nível Prime rápido.
Geração de vídeo tudo-em-um de até 30 segundos com áudio nativo, referências omni-modais (imagens, vídeo, áudio, arquivos, links web) e um nível Prime rápido.
Também conhecido como Alibaba Cloud Wan 3.0
wan-3-0/v1/videos/generationsalibaba/wan-3.0wan-3.0wan3.0wan3.0-videowan3.0-video-primeTarifas pay-as-you-go ao vivo do catálogo EmpirioLabs. Você paga só pelo que usa, sem mínimo mensal.
Wan 3.0 roda por POST /v1/videos/generations. A requisição retorna um job_id na hora; consulte GET /v1/jobs/{job_id} até o job terminar e leia as URLs de saída do resultado. Obtenha uma chave de API no painel EmpirioLabs.
curl https://api.empiriolabs.ai/v1/videos/generations \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "wan-3-0",
"prompt": "Describe what you want Wan 3.0 to generate."
}'curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY"import requests
response = requests.post(
"https://api.empiriolabs.ai/v1/videos/generations",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
json={
"model": "wan-3-0",
"prompt": "Describe what you want Wan 3.0 to generate.",
},
)
job = response.json()
# Generation runs as an async job. Poll until it completes.
import time
while True:
status = requests.get(
f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
).json()
if status.get("status") in ("completed", "failed"):
print(status)
break
time.sleep(5)Parâmetros de requisição suportados pela API Wan 3.0 na EmpirioLabs. Os padrões valem quando um campo é omitido.
| Parâmetro | Tipo | Padrão | Intervalo / valores | Descrição |
|---|---|---|---|---|
| prompt | string | - | - | Descrição da cena, até 20.000 caracteres. No modo de referência, enderece as entradas no seu prompt como Imagem 1, Vídeo 1, Áudio 1. |
| model_tier | enum | standard | standard, prime | Padrão: Qualidade total no preço base. Prime: Geração de end-to-end significativamente mais rápida a uma taxa por segundo maior. Cada nível é cobrado em sua própria... |
| mode | enum | auto | auto, t2v, i2v, r2v | Detecta automaticamente a partir de anexos. T2V: text-to-video. i2v: animar uma imagem ou interpolar entre duas (primeiro e último quadro). R2V: Referência Omni a... |
| resolution | enum | 1080p | 480p, 720p, 1080p | Resolução de saída. Cada resolução fatura à sua própria taxa por segundo. |
| duration | number | 5 | 2 a 30 | Duração do clipe em segundos. Passe -1 via API para deixar o modelo escolher o comprimento. Com referências de vídeo, entrada e saída permanecem dentro de 30 segundos. |
| aspect_ratio | enum | adaptive | adaptive, 16:9, 9:16, 1:1, 4:3, 3:4 | Adaptive recomenda uma proporção de aspecto dos seus inputs e do prompt. |
| image | string | - | - | URL da imagem. o i2v usa uma ou duas imagens (primeiro e último quadro); R2V aceita até 10 referências. |
| video | string | - | - | Referência à URL do vídeo (r2v). Até 5 clipes, 15 segundos combinados. |
| seed | number | - | 0 a 2147483647 | Semente de reprodutibilidade. |
| audio | boolean | true | - | Gere a trilha sonora com o vídeo. Desligar não muda o preço. |
| watermark | boolean | false | - | Adicione uma marca d'água de proveniência ao resultado. |
| prompt_extend | boolean | true | - | Deixe o serviço reescrever o prompt para melhores resultados. |
| link | string | - | - | URL da página pública usada como referência (r2v). Forneça um link ou um file_url, não ambos. |
| file_url | string | - | - | URL do documento usado como referência (r2v): PDF, Office ou arquivos de texto de até 100 MB e 50 páginas. Forneça um file_url ou um link, não ambos. |
A geração pode levar vários minutos no nível padrão; O nível Prime é significativamente mais rápido de ponta a ponta. Os modos são detectados automaticamente a partir de anexos, ou sobrescritos pelo parâmetro mode. O parâmetro model_tier escolhe padrão ou primo; Cada nível fatura à sua própria taxa por segundo. Modos - T2V: sem anexos - I2V: 1 imagem (primeiro quadro), ou exatamente 2 imagens (primeiro + último quadro) - R2V (referência omni): até 10 imagens, 5 vídeos (15s combinados) e 5 clipes de áudio (15s combinados), além de 1 arquivo de documento ou 1 link público da web; endereçá-los no seu prompt como Image 1, Video 1, Audio 1 - Quadros I2V e referências R2V não podem ser combinados em uma única solicitação Entradas - Imagens: JPEG, PNG, BMP ou WEBP, 240 a 8.000 px por lado, até 20 MB - Vídeos: MP4 ou MOV, 1-15s por clipe, até 100 MB - Áudio: WAV ou MP3, 1-15s por clipe, até 15 MB Duração e faturamento - Clipes duram de 2 a 30 segundos; passe duration: -1 para deixar o modelo escolher o comprimento - Com referências de vídeo, entrada e saída compartilham o orçamento de 30 segundos, e os segundos cobridos cobrem entrada + saída combinados - Saída é MP4 a 30 fps com áudio nativo; audio: false desativa o som sem alterar o preço Pré-processamento de mídia enviada - Vídeos de referência são normalizados para MP4 compatível com provedores quando necessário.
Na EmpirioLabs, Wan 3.0 é cobrado por uso: 480P padrão $0.07 por segundo; 720P padrão $0.14 por segundo; 1080P padrão $0.28 por segundo. A tabela de tarifas ao vivo desta página sempre corresponde ao que a API cobra.
Wan 3.0 é servido por POST /v1/videos/generations em api.empiriolabs.ai com autenticação padrão por token Bearer.
Sim. O playground da EmpirioLabs executa Wan 3.0 no navegador com os mesmos parâmetros que a API expõe, para você testar prompts antes de escrever código.
Crie uma conta EmpirioLabs e gere uma chave em API Keys no painel. A cobrança usa créditos pay-as-you-go, então você paga apenas pelas requisições que faz.
Confira nossos preços ou entre em contato se quiser que seu próprio modelo seja implementado em nossa pilha.