تقنية صينية تُسرّع إنتاج فيديوهات الذكاء الاصطناعي في ثواني
أعلن باحثون صينيون عن إنجاز تقني لافت قد يُحدث نقلة نوعية في عالم توليد الفيديو باستخدام الذكاء الاصطناعي، عبر تقنية جديدة قادرة على إنتاج مقاطع فيديو خلال ثوانٍ قليلة بدلًا من الانتظار لدقائق أو حتى ساعات، وهو ما يقرّب هذه التكنولوجيا من مفهوم "الزمن الحقيقي".
تطويرالذكاء الاصطناعي لصناعة الفيديوهات في ثواني
وبحسب ورقة بحثية نُشرت مؤخرًا، تحمل تقنية الذكاء الاصطناعي الجديدة اسم TurboDiffusion، وتستطيع تسريع عملية توليد فيديوهات الذكاء الاصطناعي بما يصل إلى 200 ضعف، من دون أي تراجع ملحوظ في جودة الصورة أو التفاصيل البصرية، ما يفتح الباب أمام استخدامات تجارية وإبداعية واسعة النطاق.

طُوّرت التقنية على يد فريق بحثي مشترك من جامعة تسينغهوا في بكين، وشركة Shengshu المتخصصة في تطوير نماذج الذكاء الاصطناعي، بالتعاون مع جامعة كاليفورنيا بيركلي.
وأظهرت الاختبارات أن TurboDiffusion نجحت في تقليص زمن إنشاء مقطع فيديو مدته خمس ثوانٍ وبدقة عادية من أكثر من ثلاث دقائق إلى نحو 1.9 ثانية فقط، عند تشغيلها على جهاز استهلاكي مزود ببطاقة الرسوميات Nvidia RTX 5090.
وفي حالة الفيديوهات عالية الدقة، فقد كان الفارق أكثر إثارة؛ إذ انخفض زمن التوليد على الجهاز نفسه من قرابة 80 دقيقة إلى 24 ثانية فقط، أي تسريع يقترب من 200 مرة، وفقًا لنتائج وردت في الدراسة، نقلًا عن تقرير نشره موقع "SCMP".
هذا التطور يأتي في وقت لا تزال فيه منصات عالمية كبرى تعاني من بطء نسبي في إنتاج الفيديوهات بالذكاء الاصطناعي.
على سبيل المثال، يستغرق إنشاء فيديو مدته خمس ثوانٍ على منصة Vidu التابعة لشركة Shengshu ما بين ثلاث إلى خمس دقائق، بينما أشارت شركة OpenAI سابقًا إلى أن نموذجها الشهير Sora يحتاج عدة دقائق لإنتاج مقاطع قصيرة.

يؤكد مراقبون أن TurboDiffusion يعكس التسارع اللافت الذي حققه الباحثون الصينيون في مجال توليد الفيديو بالذكاء الاصطناعي منذ إعلان OpenAI عن Sora في فبراير 2024، في سباق تقني يتزايد زخمًا على المستوى العالمي.
ويوضح محلل الصناعة كيون شو أن تسريع إنتاج الفيديو يمثل نقطة تحول حقيقية، لأنه يزيل أحد أكبر العوائق أمام دمج هذه النماذج في سلاسل الإنتاج الإبداعي والتجاري.
وأرجع الباحثون هذا التقدم إلى ابتكارات في أساليب تدريب النماذج، أبرزها استخدام تقنية "الانتباه الخطي المتناثر"، التي تسمح للنموذج بالتركيز على الأجزاء الأكثر أهمية من البيانات بدل معالجتها بالكامل، ما يقلل زمن المعالجة وكلفة الحوسبة بشكل كبير.

وقالت مؤسسة AI Native Foundation إن TurboDiffusion تنقل الذكاء الاصطناعي من مرحلة 'القدرة على التوليد" إلى مرحلة “التنفيذ"، ما يفتح آفاقًا واسعة لتطبيقات آنية في الإعلام، والإعلان، والألعاب، والتعليم، وغيرها من القطاعات.
تقنية TurboDiffusion متاحة بالكامل كمشروع مفتوح المصدر عبر منصة GitHub، وهو ما يعزز فرص انتشارها السريع واعتمادها من قبل الباحثين والمطورين حول العالم، ويجعلها مرشحة لتكون معيارًا جديدًا في مستقبل صناعة الفيديو بالذكاء الاصطناعي.

