Kısaca

Google; Gemini 3.7 Flash, 3.6 Flash ve 3.5 Flash-Lite modellerine sabit kare hızı yerine doğrudan ilgili video kesitlerine odaklanan otonom analiz yeteneği getirdi.

Google, Gemini yapay zekâ ailesinin Gemini 3.7 Flash, Gemini 3.6 Flash ve Gemini 3.5 Flash-Lite modellerine otonom video analizi yeteneği ekledi. Yeni mimaride modeller, yüklenen videoları sabit bir kare hızında baştan sona taramak yerine içeriğin hangi bölümlerini, hangi çözünürlükte ve hangi veri türüyle (görsel kareler, ses kaydı veya metin transkripti) inceleyeceğine kendi akıl yürütme süreçleriyle karar veriyor. Şirketin paylaştığı verilere göre bu yaklaşım, özellikle uzun süreli kayıtlarda token kullanımını ve maliyetleri yüzde 88'e varan oranlarda azaltıyor.

Sistem, yerel video analizinin kullanıma sunulduğu 2025 yılından bu yana varsayılan olarak uygulanan saniyede bir karelik sabit işleme yönteminin sınırlarını aşıyor. Yeni yapı sayesinde modeller, bir saniyenin altındaki anlık durum değişikliklerini, sahne kesintilerini ve hızlı hareketleri kaçırmadan yakalayabiliyor. Ayrıca şüpheli görülen zaman aralıklarında kare hızını otomatik olarak artırarak anormallikleri tespit edebiliyor, tekrarlanan hareketleri ve tekil nesneleri saatler süren görüntüler boyunca yüksek doğrulukla sayabiliyor.

Bu altyapı, Google'ın ocak ayında Gemini 3 Flash modeli için sunduğu ve görseller üzerinde Python kodu çalıştırarak yakınlaştırma, kırpma ve işaretleme yapabilen vizyon mimarisine dayanıyor. Aralık ayında duyurulan görsel ve uzamsal akıl yürütme vizyonunun devamı niteliğindeki bu özellik, 10 dakikalık eğitim videolarından 90 dakikalık ders anlatımlarına ve çok saatlik güvenlik kayıtlarına kadar geniş bir yelpazede verimlilik sağlıyor. Şirketin paylaştığı LongVideoBench test sonuçlarında, otonom analiz kullanan Gemini 3.7 Flash modelinin en yüksek genel kalite puanına ve maliyet dengesine ulaştığı belirtiliyor.

Yeni işleme modu, Google AI Studio ve Gemini Enterprise Agent Platform üzerindeki Gemini API üzerinden video yüklemeleri ve YouTube videoları için devreye alındı. Geliştiriciler, API yapılandırmasında modu otonom olarak belirleyerek ek bir ücret ödemeden standart token tarifesiyle bu yetenekten faydalanabiliyor. Google, özelliğin yakında Flash ve Flash Lite tabanlı cihazlardaki Gemini uygulaması kullanıcılarına sunulacağını, ilerleyen aylarda ise YouTube oynatma sayfasındaki video içi soru yanıtlama özelliğine güç vereceğini bildirdi.

Neden önemli?Uzun video kayıtlarını işlerken token tüketimini yüzde 88'e kadar azaltan bu yöntem, geliştiricilerin maliyetlerini düşürürken saniye altındaki görsel değişimlerin yakalanmasını sağlıyor.

Şu ana kadar bildiklerimiz

  • Yeni analiz yaklaşımı Gemini 3.7 Flash, Gemini 3.6 Flash ve Gemini 3.5 Flash-Lite modellerine eklendi.
  • Sistem sabit kare hızında tarama yerine ilgili zaman aralıklarını, ses kaydını veya transkripti seçerek token kullanımını yüzde 88'e kadar düşürüyor.
  • Özellik, Google AI Studio ve Gemini Enterprise Agent Platform üzerinden standart API tarifesiyle geliştiricilerin erişimine açıldı.

Cevabı beklenen sorular

  • Özelliğin ilerleyen aylarda YouTube üzerindeki video içi soru-cevap deneyimine nasıl entegre edileceği ve son kullanıcılara ne zaman tam olarak yansıyacağı.