
Open-source 32B MoE modèle de fondation qui génère la vidéo et l'audio synchronisés dans une étape de inférence avec dual-tower lip-sync précise.
Open-source 32B MoE modèle de fondation qui génère la vidéo et l'audio synchronisés dans une étape de inférence avec dual-tower lip-sync précise.
Aussi connu sous le nom OpenMOSS MOSS Video and Audio, MOSS-Video-and-Audio
moss-video-and-audio/v1/videos/generationsmoss-video-audioopenmoss/video-audioTarifs à l'usage en direct du catalogue EmpirioLabs. Vous ne payez que ce que vous utilisez, sans minimum mensuel.
MOSS Video and Audio fonctionne via POST /v1/videos/generations. La requête renvoie immédiatement un job_id ; interrogez GET /v1/jobs/{job_id} jusqu'à la fin du job et lisez les URLs de sortie dans le résultat. Obtenez une clé API depuis le tableau de bord EmpirioLabs.
curl https://api.empiriolabs.ai/v1/videos/generations \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "moss-video-and-audio",
"prompt": "Describe what you want MOSS Video and Audio to generate."
}'curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY"import requests
response = requests.post(
"https://api.empiriolabs.ai/v1/videos/generations",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
json={
"model": "moss-video-and-audio",
"prompt": "Describe what you want MOSS Video and Audio to generate.",
},
)
job = response.json()
# Generation runs as an async job. Poll until it completes.
import time
while True:
status = requests.get(
f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
).json()
if status.get("status") in ("completed", "failed"):
print(status)
break
time.sleep(5)Paramètres de requête pris en charge par l'API MOSS Video and Audio sur EmpirioLabs. Les valeurs par défaut s'appliquent quand un champ est omis.
| Paramètre | Type | Par défaut | Plage / valeurs | Description |
|---|---|---|---|---|
| prompt | string | - | - | Description de la scène. Avec l’image jointe, ça devient un image-to-video prompt. |
| mode | enum | t2v | t2v, i2v | T2V: Pure text-to-video. i2v: animez l’image jointe. |
| resolution | enum | 720p | 360p, 720p | Le 720p utilise un point de terminaison séparé à haute VRAM. |
| aspect_ratio | enum | landscape | landscape, portrait | MOSS ne prend en charge que le paysage (16:9) et le portrait (9:16). |
| duration | number | 8 | 2 à 8 | Longueur du clip en secondes. Le modèle en amont est limité strictement à 8 secondes. |
| t2v_quality | enum | quality | fast, quality | Texte en vidéo uniquement. Fast échange la fidélité contre ~2× vitesse. |
| num_inference_steps | number | 25 | 10 à 50 | Étapes de diffusion. Plus = plus haute fidélité, plus lentement. |
| cfg_scale | number | 5 | 1 à 10 | Guidance sans classificateurs. Plus haut = suit l’invite de façon plus stricte. |
| sigma_shift | number | 5 | 1 à 10 | Planning shift. Valable seulement lorsque la résolution = 360p. |
| image | string | - | - | URL d’image de référence pour le mode i2v. |
| negative_prompt | string | - | - | Quoi éviter. |
| seed | number | - | - | Graine de reproductibilité. |
MoE 32B avec vidéo lip-sync synchronisée + audio en une seule inférence. Constraints - La génération peut prendre 20+ minutes - Image-to-Video donne généralement des résultats supérieurs à text-to-video Seulement 1 image supportée (utilisée comme première image) - Entrées vidéo NON supportées Formats d'image - jpg, jpeg, png, webp, heic, heif, bmp, tiff, tif, gif
Sur EmpirioLabs, MOSS Video and Audio est facturé à l'usage : Vidéo 360p $0.17 par vidéo; Vidéo 720p $2.82 par vidéo; T2V rapide $0.065 taxe supplémentaire. La grille tarifaire en direct de cette page correspond toujours à ce que l'API facture.
MOSS Video and Audio est servi via POST /v1/videos/generations sur api.empiriolabs.ai avec une authentification standard par token Bearer.
Oui. Le playground EmpirioLabs exécute MOSS Video and Audio dans le navigateur avec les mêmes paramètres que l'API expose, pour tester vos prompts avant d'écrire du code.
Créez un compte EmpirioLabs, puis générez une clé sous API Keys dans le tableau de bord. La facturation utilise des crédits à l'usage : vous ne payez que vos requêtes.
Consultez nos tarifs ou contactez-nous si vous souhaitez que votre propre modèle soit déployé sur notre stack.