संक्षिप्त उत्तर: सीडेंस 2.5 ByteDance का अगली पीढ़ी का वीडियो मॉडल है, जो एक OpenAI-style समापन बिंदु के माध्यम से EmpirioLabs पर उपलब्ध है। यह एक अनुरोध में 30 सेकंड तक का एक सुसंगत क्लिप उत्पन्न करता है, एक बार में 50 संदर्भ परिसंपत्तियों को लेता है, और पहले से ही आपके पास वीडियो को संपादित या विस्तारित कर सकता है। इसे कॉल करें मॉडल: " seedance-2-5 " पर POST /v1/videos/generations।.
2.5 में नया क्या है
| क्षमता | बीजाणु 2.0 श्रृंखला | सीडेंस 2.5 |
|---|---|---|
| उत्पादन की लंबाई | 4 से 15 सेकंड | 4 से 30 सेकंड, एक अनुरोध में |
| संदर्भ संपत्ति | 15 (9 चित्र, 3 वीडियो, 3 ऑडियो) | 50 (30 चित्र, 10 वीडियो, 10 ऑडियो) |
| ऑडियो-केवल इनपुट | समर्थित नहीं | अपने आप में समर्थित |
| आउटपुट स्वरूप | MP4 | MP4 या उच्च रंग परिशुद्धता MOV |
| संकल्प | टीयर के आधार पर 480p से 4K | 480p और 720p |
| भाषाएँ | अंग्रेजी प्लस 3 | अरबी, थाई, कोरियाई और वियतनामी सहित अंग्रेजी प्लस 9 |
क्विकस्टार्ट
वीडियो पीढ़ी अतुल्यकालिक है। नौकरी जमा करें, फिर इसे मतदान करें।
कर्ल-X POST https://api.empiriolabs.ai/v1/videos/generations "रिज़ॉल्यूशन": "720p", "अवधि": 10, "aspect ratio": "16: 9" }' # -> {"job id": "...", "status": "प्रोसेसिंग", "poll url": " /v1/jobs/... \"} कर्ल https://api.empiriolabs.ai/v1/jobs/JOB_ID \ -H "Authorization: Bearer $EMPIRIOLABS API KEY"
इसे चलाने के पांच तरीके
मॉडल आपके द्वारा भेजे गए अनुलग्नकों से अपना कार्य प्रकार चुनता है, साथ ही आपके प्रॉम्प्ट का इरादा भी है। आप भी सेट कर सकते हैं मोड समूह स्पष्ट रूप से
- पाठ से वीडियो अपने आप पर एक संकेत।
- प्रथम फ्रेम या प्रथम और अंतिम फ्रेम। भेजें
छविवैकल्पिक रूप सेImage end, एक अभी भी से या दो के बीच यात्रा करने के लिए। - मल्टीमॉडल संदर्भ। भेजें
छवियां,वीडियो, औरऑडियोसाथ में। यह वह जगह है जहां 50-asset छत मामले, और ऑडियो सभी पर कोई दृश्य इनपुट के साथ काम करता है। - वीडियो संपादन एक क्लिप संलग्न करें और कहते हैं कि क्या बदलना है: फुटेज में कुछ जोड़ें, निकालें या बदलें।
- वीडियो एक्सटेंशन। एक क्लिप संलग्न करें और इसे जारी रखने के लिए मॉडल से पूछें, आगे या पीछे।
संकेत में विशिष्ट संदर्भों को संबोधित करना
कई परिसंपत्तियों के साथ जुड़े, सादे गद्य तेजी से अस्पष्ट हो जाता है। सीडेंस 2.5 सूचकांक द्वारा एक व्यक्तिगत लगाव पर संकेत बिंदु देता है, इसलिए आप कह सकते हैं कि कौन सा संदर्भ शॉट के किस हिस्से को नियंत्रित करता है।
{"model": " seedance-2-5 ", "prompt": " @Image1 में बोतल के लिए एक उत्पाद फिल्म। @Video1 से कैमरे के कदम पर खुला, फिर एक धीमी कक्षा को @Image2 की तरह जला दिया। "images": [" https://.../bottle.png", " https://.../lighting-ref.png"], "वीडियो": [" https://.../camera-move.mp4"], "resolution": "720p" }
संलग्नक क्रम में गिने जाते हैं जिसे आप उन्हें भेजते हैं, प्रति प्रकार: Emojiguru -, Emojiguru -, @BJP1, @Audio1।.
संपादन और विस्तार
दोनों एक मौजूदा क्लिप लेते हैं। क्या आप पूछते हैं?
# संपादित करें: स्रोत क्लिप की लंबाई और पहलू अनुपात {"मॉडल रखता है: " seedance-2-5 ", "मोड": "edit", "prompt": " सड़क से पार्क की गई कारों को हटा दें"। "वीडियो": " https://.../street.mp4"} # विस्तार: आप नई लंबाई चुनते हैं, या मॉडल को "मॉडल" चुनने दें: " seedance-2-5 ", "मोड": "exend", "duration": 8, "prompt": "कैमरा के रूप में शॉट जारी रखें सड़क को बहाना रहता है।
इससे पहले कि आप उनके आसपास के निर्माण के बारे में दो बाधाएं जानने लायक हैं। संपादन हमेशा अपने स्रोत के समान लंबाई एक क्लिप लौटाता है, इसलिए अवधि आपका सेट नहीं है। संपादन, विस्तार और पहली या आखिरी फ्रेम नौकरियों में सभी इनपुट से अपने पहलू अनुपात को प्राप्त करते हैं, इसलिए aspect_ratio उन लोगों के लिए अनुकूल रहता है।
परिचालन नोट्स
- मूल ऑडियो डिफ़ॉल्ट रूप से है। मॉडल फुटेज से मेल खाने के लिए आवाज, प्रभाव और संगीत लिखते हैं। शीघ्र में डबल उद्धरणों में बोली जाने वाली लाइनों को रखो। सेट
generate_audio: असत्यएक चुप क्लिप के लिए। - MOV पोस्ट के लिए है, वेब के लिए नहीं।
आउटपुट format: "mov"ग्रेडिंग, कीइंग और compositing के लिए उच्च रंग की परिशुद्धता देता है, और कुछ खिलाड़ी इसे नहीं खोल सकते हैं। MP4 एक कारण के लिए डिफ़ॉल्ट है। - वास्तविक मानव चेहरे वाले संदर्भ अपलोड को मॉडल द्वारा अस्वीकार कर दिया जाता है। यह एक अपस्ट्रीम सुरक्षा व्यवहार है, नहीं एक EmpirioLabs सीमा। अपने शुरुआती फ्रेम को पहले जेनरेट करना इसके आसपास का सामान्य तरीका है।
- संदर्भ वीडियो सेकंड बिलेबल हैं। जब कोई अनुरोध एक संदर्भ वीडियो रखता है, तो मॉडल की कीमतें उत्पन्न अवधि के साथ संदर्भ क्लिप की अवधि कम वीडियो-इनपुट दर पर होती हैं। एक लंबी क्लिप का एक लघु संपादन इसलिए इसकी उत्पादन लंबाई से अधिक खर्च होता है।
- पाठ के लिए वीडियो के लिए एक पहलू अनुपात सेट करें। लेफ्ट एडेप्टिव, मॉडल एक प्रॉम्प्ट से चुनता है, जो अन्वेषण के लिए सुविधाजनक है और जब आपको निश्चित प्रसव की आवश्यकता होती है तो असहाय है।
मूल्य निर्धारण
सीडेंस 2.5 आपको जाने के रूप में भुगतान किया जाता है, एक दर पर वीडियो के प्रति सेकंड बिल दिया जाता है जो आउटपुट रिज़ॉल्यूशन पर निर्भर करता है, जिसमें कोई pay-as-you-go न्यूनतम नहीं है। उन अनुरोधों में शामिल हैं जिनमें एक कम प्रति सेकंड की दर पर एक संदर्भ वीडियो बिल शामिल है जो संदर्भ क्लिप के सेकंड को भी कवर करता है। वर्तमान दरें चालू हैं मॉडल पेज और मूल्य निर्धारण, और दोनों लाइव सूची से पढ़ा।
इसे अजमाएं
इसे अंदर चलाएं खेल कोई कोड के साथ, या पढ़ा एपीआई संदर्भ पूर्ण पैरामीटर सूची के लिए। परिवार में अन्य tiers, सीडांस 2.0 प्रो, फास्ट, और मिनी, उपलब्ध रहते हैं और अभी भी 1080p और 4K आउटपुट को कवर करते हैं।



