HeadlinesBriefing favicon HeadlinesBriefing.com

Google DeepMind Meluncurkan Pemahaman Video Agen untuk Gemini

Google DeepMind Blog •
×

Google DeepMind telah meluncurkan pemahaman video agen di seluruh model Gemini 3.7 Flash, 3.6 Flash, dan 3.5 Flash-Lite, mengurangi konsumsi token hingga 88%, mengurangi biaya hingga 66%, dan meningkatkan akurasi hingga 7%. Berbeda dengan pemrosesan statis pada laju frame tetap, fitur ini memungkinkan Gemini untuk secara dinamis mencari, memindai, dan memeriksa segmen video di seluruh frame visual, audio, dan transkrip melalui loop agen.

Benchmark menunjukkan bahwa peningkatan efisiensi paling terasa pada konten berformat panjang — dari panduan 10 menit hingga rekaman multi-jam — tempat pengembang sebelumnya menghadapi trade-off antara biaya token tinggi dan hilangnya detail. Gemini 3.7 Flash dengan pemahaman video agen kini berada di fronteir Pareto akurasi-biaya untuk analisis video.

Kemampuan utamanya meliputi: pengambilan momen dalam sub-detik untuk editing yang tepat; pencarian jarum dalam tumpukan jerami di video berjam-jam; deteksi anomali melalui resampling FPS tinggi; dan penghitungan akurat tindakan dan objek. Mitra akses dini melaporkan hasil yang kuat. Fitur ini tersedia hari ini melalui API Gemini di Google AI Studio dan Platform Agen Perusahaan Gemini untuk unggahan video dan video YouTube.

Entitas Utama: Perusahaan: Google DeepMind, Google AI Studio, Platform Agen Perusahaan Gemini | Orang: Mario Lučić