Google, video üretimine odaklanan Gemini Omni Flash 1.1 modelini kullanıma sundu

Google’ın yeni modeli, 10 saniyelik geriye dönük analiz, daha hızlı taslak üretimi ve sahne kurgulama araçlarıyla öne çıkıyor.

12punto

Google, çok modlu yapay zeka ailesi Gemini Omni’nin yeni sürümü Flash 1.1’i kullanıma sundu. Metin, görsel, ses ve video verilerini birlikte işleyebilen model, özellikle video üretimi ve düzenleme süreçlerinde daha tutarlı sonuçlar vermeyi hedefliyor.

Şirketin duyurusuna göre Gemini Omni Flash 1.1, AI Studio üzerinden geliştiricilerin erişimine açıldı. Yeni sürümde en dikkat çeken değişikliklerden biri, videoların yalnızca son kareye bakılarak değil, 10 saniyelik geriye dönük analizle uzatılması oldu.

Bu yöntemle modelin sahne bütünlüğünü daha iyi takip etmesi, kamera hareketlerini daha doğal sürdürmesi ve özellikle hareketli sahnelerde geçiş hatalarını azaltması amaçlanıyor. Önceki yaklaşımlarda yalnızca son kareye dayalı uzatma işlemleri, süreklilik sorunlarına yol açabiliyordu.

HIZ VE KURGU ARAÇLARI ÖNE ÇIKIYOR

Gemini Omni Flash 1.1, videoları 10 saniyelik parçalar halinde toplamda 40 saniyeye kadar uzatabiliyor. Kullanıcılar ayrıca üç saniyelik kısa video kesitlerini referans alarak sahnelerin başlangıç ve bitiş noktalarını belirleyebiliyor.

Google, taslak üretim aşamasında çözünürlüğü 720p’den 360p’ye çekerek sistemin hızını yüzde 60’a kadar artırdığını belirtiyor. Buna karşın tamamlanan içeriklerin 1080p veya 4K çözünürlükte dışa aktarılabilmesi, hızlı ön izleme ile yüksek kaliteli çıktı arasında bir denge kurulmasını sağlıyor.

Yeni sahne kurgulama araçları, özellikle reklam, sosyal medya ve dijital içerik üretiminde yapay zeka destekli iş akışlarını hızlandırabilecek özellikler arasında gösteriliyor. Modelin sunduğu referans video kullanımı, istenen kompozisyonun daha kısa sürede oluşturulmasına yardımcı olmayı amaçlıyor.