Google DeepMind mengumumkan penambahan fitur agentic video understanding pada model Gemini. Fitur ini dirancang untuk memproses dan memahami konten video berdurasi panjang melalui pendekatan berbasis agen, sehingga pengguna dapat mengajukan pertanyaan spesifik terkait isi video dan menerima jawaban yang kontekstual.
Secara teknis, kemampuan ini memungkinkan Gemini memecah video menjadi segmen-segmen yang relevan dan melakukan penalaran lintas bagian secara bertahap. Pendekatan agentic mengizinkan model menentukan sendiri bagian video mana yang perlu dianalisis lebih lanjut berdasarkan kueri pengguna, sehingga mengurangi kebutuhan pemrosesan keseluruhan file dari awal hingga akhir.
Fitur ini mulai digulirkan melalui aplikasi Gemini dan dapat diakses oleh pengguna yang ingin menggali informasi dari materi video seperti ceramah, tutorial, atau rekaman rapat panjang. Google menyebutkan bahwa pembaruan ini akan membantu pengguna menghemat waktu dalam menyerap informasi dari konten audiovisual tanpa harus menontonnya secara manual.