Google Gemini Omni 1.1 उत्तम 4K AI व्हिडिओ टूल्सचे अनावरण करते
गुगलने सादर केले आहे मिथुन ओम्नी 1.1 फ्लॅशएआय-व्युत्पन्न व्हिडिओवर निर्मात्यांना अधिक नियंत्रण देण्यावर लक्ष केंद्रित केलेले एक अद्ययावत मल्टीमॉडल मॉडेल. प्रत्येक क्लिप सुरवातीपासून तयार करण्याऐवजी विद्यमान व्हिडिओ दृश्य वाढवण्याची क्षमता ही त्यातील सर्वात मोठी जोड आहे.
Google च्या मते, मॉडेल दृश्याचा विस्तार करताना आधीच्या फुटेजचे 10 सेकंदांपर्यंत विश्लेषण करू शकते. पूर्वीच्या दृष्टिकोनापेक्षा ही लक्षणीय सुधारणा, जी व्हिडिओच्या फक्त शेवटच्या सेकंदावर अवलंबून होती. वर्ण, प्रकाशयोजना, हालचाल आणि व्हिडिओ चालू असताना एकंदर कथा यासारखे घटक राखण्यात मदत करण्यासाठी अतिरिक्त संदर्भ डिझाइन केले आहे.
याचा अर्थ निर्माते क्लिप व्युत्पन्न करू शकतात आणि नंतर जेमिनीला पूर्वीचे दृश्य जिथे संपले होते तेथून पुढे सुरू ठेवण्यास सांगू शकतात, दीर्घ AI-जनरेट केलेल्या अनुक्रमांसाठी अधिक शक्यता उघडतात.
AI व्हिडिओ 40 सेकंदांपर्यंत वाढवता येतात
जेमिनी ओम्नी 1.1 फ्लॅश 40 सेकंदांपर्यंत एकत्रित विस्तारासह 10-सेकंद वाढीमध्ये व्हिडिओ वाढवू शकतो. एकाच पासमध्ये 40-सेकंदाचा व्हिडिओ तयार करण्याऐवजी, विद्यमान क्लिप वारंवार चालू ठेवून दीर्घ क्रम तयार केला जातो.
हे वैशिष्ट्य विशेषतः चित्रपट निर्माते, सामग्री निर्माते आणि AI कथाकथनाचा प्रयोग करणाऱ्या विकासकांसाठी उपयुक्त ठरू शकते. एक लहान व्युत्पन्न दृश्य दीर्घ क्रमाने विकसित केले जाऊ शकते, तर निर्माते वेगवेगळ्या सर्जनशील दिशानिर्देशांमध्ये देखील कथा घेऊ शकतात.
Google ची घोषणा हे वैशिष्ट्य दाखवते की भविष्यातील कार आकाशातील प्रतिबिंबित रस्त्यावरून प्रवास करते, जे व्युत्पन्न केलेले दृश्य त्याच्या मूळ टोकाच्या पलीकडे कसे चालू राहू शकते हे दर्शवते.
प्रथम आणि शेवटच्या फ्रेमसह अधिक नियंत्रण
व्हिडिओ कसा सुरू होतो आणि कसा संपतो यावरही अपडेट निर्मात्यांना अधिक नियंत्रण देते. डेव्हलपर प्रथम फ्रेम आणि अंतिम फ्रेम प्रदान करू शकतात, जेमिनी ओम्नी 1.1 फ्लॅशला दोन प्रतिमांना जोडणारे फुटेज तयार करण्यास अनुमती देतात.
कॅमेरा हालचाली, संक्रमण, झूम आणि लूपिंग अनुक्रम तयार करण्यासाठी हे उपयुक्त ठरू शकते. शॉट कसा विकसित होतो हे निर्धारित करण्यासाठी मजकूर प्रॉम्प्टवर पूर्णपणे विसंबून राहण्याऐवजी, निर्माते महत्त्वाचे दृश्य बिंदू परिभाषित करू शकतात आणि मॉडेलला त्यांच्या दरम्यान हालचाल निर्माण करू देतात.
हा दृष्टिकोन AI व्हिडिओ निर्मिती प्रकल्पांसाठी अधिक उपयुक्त बनवू शकतो ज्यांना अधिक दृश्य नियंत्रण आणि सातत्य आवश्यक आहे.
360p मसुदे प्रयोग जलद करतात
जेमिनी ओम्नी 1.1 फ्लॅश उच्च-रिझोल्यूशन फुटेज तयार करण्यापूर्वी कल्पना तपासू इच्छिणाऱ्या निर्मात्यांसाठी 360p मसुदा मोड देखील सादर करते. Google चे म्हणणे आहे की 360p मसुदे 720p आवृत्त्यांपेक्षा 60% वेगाने व्युत्पन्न केले जाऊ शकतात आणि त्याची किंमत सुमारे एक तृतीयांश इतकी आहे.
वैशिष्ट्य जलद प्रयोग उद्देश आहे. उच्च-गुणवत्तेच्या पिढीसाठी त्यांच्या पसंतीचे परिणाम निवडण्यापूर्वी निर्माते कमी रिझोल्यूशनमध्ये भिन्न प्रॉम्प्ट, कॅमेरा हालचाली आणि कथा कल्पना वापरून पाहू शकतात.
हे AI व्हिडिओ विकसित करण्याची प्रक्रिया अधिक कार्यक्षम बनवू शकते, विशेषतः जेव्हा एकाधिक आवृत्त्यांची चाचणी करणे आवश्यक असते.
जेमिनी ओम्नी 1.1 फ्लॅश 4K अपस्केलिंग पर्यंत सपोर्ट करते
एकदा व्हिडिओ फायनल झाल्यानंतर, जेमिनी ओम्नी 1.1 फ्लॅश 1080p आणि 4K सह उच्च-रिझोल्यूशन आउटपुट तयार करू शकते. Google अधिक पॉलिश आणि उत्पादन-देणारं व्हिडिओ वर्कफ्लोसाठी क्षमता ठेवते.

मॉडेल तीन सेकंदांपर्यंतचे व्हिडिओ संदर्भ देखील स्वीकारते, नवीन फुटेज तयार करताना निर्मात्यांना अतिरिक्त व्हिज्युअल माहिती प्रदान करण्यास अनुमती देते. हे व्युत्पन्न दृश्यामध्ये देखावा, हालचाली आणि व्हिज्युअल शैली यासारखे घटक घेऊन जाण्यास मदत करू शकते.
Gemini Omni 1.1 Flash ची उपलब्धता
Gemini Omni 1.1 Flash Google AI स्टुडिओमधील Gemini API द्वारे विकसकांसाठी उपलब्ध आहे, तर एंटरप्राइझ वापरकर्ते जेमिनी एंटरप्राइझ एजंट प्लॅटफॉर्मद्वारे त्यात प्रवेश करू शकतात. गुगलने एआय प्लस, प्रो आणि अल्ट्रा सबस्क्राइबर्सना जेमिनी ॲपद्वारे सीन एक्स्टेंशन देखील उपलब्ध करून दिले आहे, मॉडेल गुगल फ्लोद्वारे देखील रोल आउट केले जात आहे.
निष्कर्ष
जेमिनी ओम्नी 1.1 फ्लॅश अधिक लवचिक AI व्हिडिओ निर्मितीच्या दिशेने आणखी एक पाऊल चिन्हांकित करते. दृश्य विस्तार, फ्रेम-टू-फ्रेम जनरेशन, जलद 360p मसुदे आणि 4K पर्यंत अपस्केलिंगसह, Google निर्मात्यांना सर्जनशील आणि उत्पादन प्रक्रियेवर अधिक नियंत्रण देत आहे. विद्यमान दृश्य चालू ठेवण्याची क्षमता दीर्घ आणि अधिक सुसंगत AI-व्युत्पन्न कथा तयार करण्यासाठी विशेषतः मौल्यवान असू शकते.
Comments are closed.