AI Video Generator: दुनिया में Alibaba ने नया दांव खेला है। कंपनी ने अपना उन्नत वीडियो मॉडल Wan 3.0 पेश किया है, जो एक बार में 30 सेकेंड तक का वीडियो तैयार कर सकता है। इसकी खासियत केवल वीडियो की लंबाई नहीं, बल्कि टेक्स्ट, फोटो, ऑडियो, मौजूदा वीडियो, डॉक्यूमेंट और वेबपेज जैसे अलग-अलग इनपुट को समझने की क्षमता भी है। Alibaba का यह मॉडल फिलहाल Cloud Model Studio पर प्रीव्यू के रूप में उपलब्ध है। कंपनी का दावा है कि इसे खास तौर पर लंबे, जटिल और कहानी आधारित वीडियो तैयार करने के लिए विकसित किया गया है।
एक बार में तैयार होगा 30 सेकेंड का वीडियो
Wan 3.0 की मदद से यूजर एक ही जेनरेशन में अधिकतम 30 सेकेंड का वीडियो बना सकते हैं। पिछले मॉडल Wan 2.7 में यह सीमा 15 सेकेंड थी। वीडियो की अवधि बढ़ने से क्रिएटर्स को अलग-अलग छोटी क्लिप तैयार करके उन्हें जोड़ने की जरूरत कम पड़ सकती है। मॉडल को इस तरह विकसित किया गया है कि वह एक ही इनपुट के आधार पर किरदार, दृश्य, कैमरा मूवमेंट, संवाद और ऑडियो जैसे कई हिस्सों को संभाल सके। इससे वीडियो में कहानी का प्रवाह बनाए रखना आसान होगा।
PDF और PPT से भी बना सकेगा वीडियो
Wan 3.0 का प्रमुख फीचर इसका मल्टीमॉडल इनपुट सपोर्ट है। यूजर टेक्स्ट प्रॉम्प्ट के अलावा इमेज, वीडियो और ऑडियो को संदर्भ के रूप में दे सकते हैं। इसके साथ ही PDF, PowerPoint, Word और Excel फाइलों का भी इस्तेमाल किया जा सकता है। मॉडल DOC, DOCX, XLS, XLSX, PPT, PPTX, PDF और TXT समेत कई फाइल फॉर्मेट को सपोर्ट करता है। सार्वजनिक रूप से उपलब्ध वेबपेज का लिंक देकर भी उसके कंटेंट के आधार पर वीडियो तैयार कराया जा सकता है। उदाहरण के तौर पर किसी प्रोडक्ट की प्रेजेंटेशन या कारोबारी योजना से सीधे प्रमोशनल वीडियो बनाया जा सकता है। यह सुविधा मार्केटिंग, प्रोडक्ट डेमो, प्रशिक्षण और सोशल मीडिया कंटेंट तैयार करने वालों के लिए उपयोगी साबित हो सकती है।इसे भी पढ़ें:-Tesla Cybercab: दो सीटों वाला अनूठा डिजाइन और AI4 तकनीक
वीडियो के साथ ऑडियो भी होगा जनरेट
Wan 3.0 केवल विजुअल तैयार करने तक सीमित नहीं है। इसमें वीडियो के साथ ऑडियो जनरेट करने की सुविधा भी दी गई है। मॉडल संवाद, बैकग्राउंड साउंड और दूसरे ऑडियो एलिमेंट को वीडियो का हिस्सा बना सकता है। यूजर चाहें तो ऑडियो वाले या बिना ऑडियो के वीडियो का विकल्प चुन सकते हैं। किसी मौजूदा ऑडियो फाइल को संदर्भ के रूप में देकर उसके मुताबिक दृश्य तैयार कराना भी संभव है। AI से बनाए गए वीडियो में अक्सर अलग-अलग फ्रेम के बीच किरदार का चेहरा, पहनावा या किसी प्रोडक्ट का डिजाइन बदल जाता है। Alibaba ने Wan 3.0 में इस समस्या को कम करने के लिए कैरेक्टर और ऑब्जेक्ट कंसिस्टेंसी पर खास ध्यान दिया है। कंपनी के अनुसार, मॉडल संदर्भ के रूप में दी गई तस्वीरों और दूसरी सामग्री की बारीकियों को पूरे वीडियो में अधिक स्थिर रखने का प्रयास करता है। इससे ब्रांड वीडियो, विज्ञापन और किरदार आधारित कंटेंट की गुणवत्ता बेहतर हो सकती है।
और भी पढ़ें:-Realme P4s 5G: भारत में लॉन्च, 8000mAh बैटरी और 50MP कैमरे से लैस, जाने कीमत
1080p तक मिलेगा वीडियो आउटपुट
Wan 3.0 में 480p, 720p और 1080p रिजॉल्यूशन के विकल्प दिए गए हैं। यह 16:9, 9:16, 1:1, 4:3 और 3:4 जैसे अलग-अलग आस्पेक्ट रेशियो को भी सपोर्ट करता है। इसके अलावा एडैप्टिव मोड इनपुट और वीडियो की जरूरत के अनुसार उपयुक्त अनुपात चुन सकता है। मॉडल का इस्तेमाल API के माध्यम से किया जा सकता है। वीडियो जेनरेशन की कीमत उसकी अवधि, रिजॉल्यूशन और उपलब्ध क्षेत्र के आधार पर अलग हो सकती है। इसलिए इस्तेमाल से पहले Alibaba Cloud के आधिकारिक प्राइसिंग पेज पर मौजूदा दरों की जांच करना जरूरी होगा। Wan 3.0 ऐसे समय पेश किया गया है, जब टेक कंपनियों के बीच AI वीडियो जेनरेशन को लेकर मुकाबला लगातार तेज हो रहा है। Alibaba ने इस मॉडल में लंबी वीडियो अवधि, अलग-अलग इनपुट फॉर्मेट, नेटिव ऑडियो और विजुअल कंसिस्टेंसी को एक ही प्लेटफॉर्म पर जोड़ने की कोशिश की है।