مصنوعی ذہانت سے چند سیکنڈ کی شاندار ویڈیو بنانا اب نسبتاً آسان ہو چکا ہے، مگر اصل مشکل تب سامنے آتی ہے جب اسی منظر کو آگے بڑھانا ہو۔ اگلے شاٹ میں کردار کا چہرہ بدل سکتا ہے، ماحول مختلف ہو سکتا ہے یا کیمرے کی حرکت پہلے منظر سے میل نہیں کھاتی۔ گوگل کا نیا Gemini Omni 1.1 Flash بنیادی طور پر اسی مسئلے کو حل کرنے کی کوشش ہے۔
نئے ماڈل کی اہم تبدیلی یہ ہے کہ ویڈیو کو آگے بڑھاتے وقت یہ پچھلی فوٹیج کے 10 سیکنڈ تک کو بطور تناظر دیکھ سکتا ہے۔ اس کا فائدہ یہ ہے کہ اے آئی صرف آخری فریم دیکھ کر اگلے منظر کا اندازہ نہیں لگاتی بلکہ اسے یاد رہتا ہے کہ کردار کہاں تھا، ماحول کیسا تھا اور حرکت کس سمت جا رہی تھی۔ اسی تسلسل کے ساتھ ویڈیو کو 10 سیکنڈ کے حصوں میں بڑھاتے ہوئے مجموعی طور پر 40 سیکنڈ تک لے جایا جا سکتا ہے۔
تخلیق کار کو مزید کنٹرول دینے کے لیے ابتدا اور اختتام کا فریم بھی خود منتخب کیا جا سکتا ہے۔ آپ طے کریں کہ شاٹ کہاں سے شروع ہوگا اور کہاں ختم ہونا چاہیے، جبکہ درمیان کی حرکت اے آئی تیار کرے گی۔ اس سے کیمرہ موومنٹ، زوم، ٹرانزیشن اور ہموار لوپ جیسے شاٹس بنانا زیادہ آسان ہو سکتا ہے۔ اس کے ساتھ تین سیکنڈ تک کی ریفرنس ویڈیو دے کر کردار یا حرکت کا بصری انداز برقرار رکھنے میں بھی مدد لی جا سکتی ہے۔
اس پورے ورک فلو کا ایک عملی فائدہ کم قیمت پر تجربہ کرنا ہے۔ ہر آئیڈیا کو فوراً ہائی ریزولوشن میں بنانے کے بجائے 360p پری ویو سے پہلے شاٹ، پرامپٹ اور کمپوزیشن آزمائی جا سکتی ہے۔ گوگل کے مطابق یہ 720p آؤٹ پٹ کے مقابلے میں 60 فیصد تک تیز اور تقریباً ایک تہائی لاگت میں تیار ہو سکتا ہے۔ مطلوبہ نتیجہ ملنے کے بعد ویڈیو کو 1080p میں تیار اور 4K تک اپ اسکیل کیا جا سکتا ہے۔
یہ تمام فیچرز دراصل ایک ہی مسئلے کے مختلف حصے حل کرتے ہیں، یعنی اے آئی ویڈیو کو الگ الگ خوبصورت کلپس سے نکال کر ایک مسلسل سین میں تبدیل کرنا۔ اگر کردار، ماحول اور حرکت کئی شاٹس تک برقرار رہیں اور تخلیق کار کو آغاز، اختتام اور ریفرنس پر زیادہ کنٹرول ملے، تو اے آئی ویڈیو مختصر کلپس سے آگے بڑھ کر حقیقی اسٹوری ٹیلنگ کے زیادہ قریب پہنچ سکتی ہے۔
یہ تحریر اے آئی کی دنیا کے فیس بک پیج پر پوسٹ کی گئی ہے
#AiKiDuniya, #GeminiOmni, #GoogleAI, #AIVideo, #GenerativeAI, #GoogleFlow, #AIFilmmaking