⚡ BREAKING
Google DeepMind ने पेश किया Gemini Omni: वीडियो निर्माण और संपादन के लिए मल्टीमॉडल मॉडल
Google/DeepMind
DeepMind
Google DeepMind ने Gemini Omni का अनावरण किया है, जो एक मल्टीमॉडल AI मॉडल है जो छवियों, ऑडियो, वीडियो और टेक्स्ट के किसी भी संयोजन से वीडियो बनाने और संपादित करने में सक्षम है। इस परिवार का पहला मॉडल, Gemini Omni Flash, Gemini ऐप और Google Flow के माध्यम से Google AI Plus, Pro और Ultra सब्सक्राइबर्स को रोल आउट किया जा रहा है, और YouTube Shorts उपयोगकर्ताओं के लिए मुफ्त उपलब्ध होगा।
गूगल डीपमाइंड ने जेमिनी ओमनी की घोषणा की, यह एक मल्टीमॉडल मॉडल है जो जेमिनी के तर्क को रचनात्मक क्षमताओं के साथ जोड़ता है ताकि किसी भी इनपुट मोडैलिटी, जैसे इमेज, ऑडियो, वीडियो और टेक्स्ट से वीडियो उत्पन्न और संपादित किया जा सके। यह मॉडल प्राकृतिक भाषा वीडियो संपादन का समर्थन करता है, संपादनों में पात्रों की संगति और भौतिकी बनाए रखता है, और जेमिनी के भौतिकी, इतिहास, विज्ञान और संस्कृति के वास्तविक दुनिया के ज्ञान पर आधारित वीडियो उत्पन्न कर सकता है। यह वार्तालाप के माध्यम से संपादन, दृश्यों को बदलने, वस्तुओं को जोड़ने और कई चरणों में परिष्कृत करने जैसी सुविधाएँ प्रदान करता है। पहला मॉडल, जेमिनी ओमनी फ्लैश, वैश्विक रूप से गूगल एआई प्लस, प्रो और अल्ट्रा सब्सक्राइबर्स को जेमिनी ऐप और गूगल फ्लो के माध्यम से रोल आउट किया जा रहा है, और यूट्यूब शॉर्ट्स तथा यूट्यूब क्रिएट ऐप उपयोगकर्ताओं को बिना किसी लागत पर उपलब्ध है। सभी उत्पन्न वीडियो में पारदर्शिता के लिए सिंथआईडी डिजिटल वॉटरमार्किंग शामिल है। डेवलपर और एंटरप्राइज एपीआई (एप्लिकेशन प्रोग्रामिंग इंटरफेस) की पहुँच अगले कुछ हफ्तों में योजनाबद्ध है।
स्रोत: Google DeepMind —
मूल
