فهرست مطالب
شرکت گوگل قابلیت جدیدی به نام درک ویدیویی عاملمحور معرفی کرده است که به مدلهای جمنای اجازه میدهد بخشهای مختلف یک ویدیو را به شکل هوشمند بررسی کنند.
به گزارش سرویس هوش مصنوعی تکناک، در روش جدید، هوش مصنوعی مجبور نیست تمام لحظات ویدیو را با سرعت ثابت پردازش کند. در عوض، جمنای تصمیم میگیرد کدام بخشها به بررسی دقیقتر نیاز دارند.
گوگل این قابلیت را در اول سپتامبر ۲۰۲۶ معرفی کرد. هدف اصلی آن، افزایش دقت و کاهش هزینه تحلیل ویدیوهای طولانی است.
بیشتر بخوانید: Gemini Omni 1.1 Flash معرفی شد؛ قابلیت پردازش ویدیوی 4K به خانواده جمینای اضافه شد
قابلیت درک ویدیویی عاملمحور جمنای چگونه کار میکند؟
در روشهای سنتی، مدلهای هوش مصنوعی معمولا ویدیو را با نرخ مشخصی از فریمها بررسی میکنند. این روش برای ویدیوهای طولانی میتواند به پردازش حجم زیادی از اطلاعات نیاز داشته باشد.
اما در روش جدید، جمنای کنترل بیشتری روی فرایند تحلیل دارد. این مدل میتواند تشخیص دهد کدام قسمت ویدیو مهمتر است.
همچنین جمنای میتواند از فریمهای ویدیو، صدا و متن پیادهسازیشده استفاده کند. به همین دلیل، مدل میتواند در خط زمانی ویدیو جابهجا شود و فقط بخشهای مورد نیاز را بررسی کند.
گوگل بیان کرد که این روش مصرف توکن را تا ۸۸ درصد کاهش میدهد. هزینه تحلیل نیز میتواند تا ۶۶ درصد کمتر شود. در آزمایشهای انجامشده، دقت نیز تا ۷ درصد افزایش یافته است.

جمنای ۳.۷ فلش بهترین عملکرد را دارد
گوگل اعلام کرده است که جمنای ۳.۷ فلش در کنار درک ویدیویی عاملمحور، بهترین عملکرد کلی را میان مدلهای آزمایششده ارائه میدهد.
این ترکیب علاوه بر کیفیت بالا، تعادل مناسبی میان کیفیت و هزینه دارد. چنین قابلیتی میتواند برای تحلیل ویدیوهای طولانی اهمیت زیادی داشته باشد.
برای مثال، جمنای میتواند یک لحظه مشخص را در ویدیو پیدا کند. همچنین میتواند اتفاقات غیرعادی را تشخیص دهد یا درباره رویدادهای داخل ویدیو به پرسشهای کاربر پاسخ دهد.

تأثیر درک ویدیویی عاملمحور جمنای بر سئو
در حال حاضر، گوگل درک ویدیویی عاملمحور جمنای را به عنوان یک عامل جدید رتبهبندی معرفی نکرده است. بنابراین نباید آن را مستقیما یک فاکتور سئو در نظر گرفت.
هرچند، این فناوری میتواند در آینده روی سئوی ویدیو تأثیر بگذارد. دلیل آن هم ساده است. سیستمهای هوش مصنوعی حالا میتوانند محتوای واقعی داخل ویدیو را بهتر درک کنند.
این موضوع میتواند برای جستوجوی هوش مصنوعی، دیده شدن ویدیوها و جستوجوی چندوجهی مهم باشد.
عنوان، توضیحات و متن پیادهسازیشده ویدیو همچنان اهمیت دارند. اما در آینده ممکن است کیفیت محتوای واقعی ویدیو نیز نقش پررنگتری داشته باشد.
بیشتر بخوانید: راهنمای کامل استفاده از هوش مصنوعی جمینای گوگل
آیا جستوجوی یوتیوب تغییر میکند؟
یکی از مهمترین کاربردهای این فناوری، جستوجوی یوتیوب است.
گوگل اعلام کرده است که درک ویدیویی عاملمحور جمنای در ماههای آینده برای قابلیت پرسش از یوتیوب استفاده خواهد شد. این قابلیت میتواند پاسخهای دقیقتری را بر اساس محتوای واقعی ویدیو ارائه دهد.
این تغییر برای تولیدکنندگان محتوا نیز اهمیت دارد. محتوای ویدیویی ممکن است بیش از گذشته مستقیما توسط سیستمهای هوش مصنوعی تحلیل شود.
به همین دلیل، توجه به محتوای واقعی ویدیو اهمیت بیشتری پیدا میکند. البته این موضوع به معنی بیاهمیت شدن عنوان، توضیحات یا متن ویدیو نیست.
حرکت جمنای به سمت جستوجوی چندوجهی
قابلیت جدید جمنای بخشی از یک تغییر بزرگتر در دنیای هوش مصنوعی است. سیستمهای جدید فقط متن را بررسی نمیکنند، آنها میتوانند تصویر، صدا و ویدیو را نیز درک کنند.
درک ویدیویی عاملمحور به جمنای اجازه میدهد منابع مختلف اطلاعات را با دقت بیشتری بررسی کند. این روند میتواند جستوجوی هوش مصنوعی را به سمت درک مستقیم محتوا ببرد.
در نتیجه، موتورهای هوش مصنوعی در آینده کمتر به متن اطراف یک محتوا وابسته خواهند بود. آنها میتوانند خود محتوای اصلی را بررسی کنند و پاسخ مناسبتری ارائه دهند.

















