Google, Gemini Omni 1.1 Flash video modelini kullanıma sundu

Google’ın yeni Gemini Omni 1.1 Flash modeli; sahne genişletme, başlangıç ve bitiş karesi belirleme, 360p hızlı önizleme, 1080p ve 4K yükseltme ile video referansı gibi yeni özellikler sunuyor. Model, geliştiricilerin yanı sıra Google AI abonelerinin kullanımına açılmaya başladı.
Google, Gemini Omni 1.1 Flash video modelini kullanıma sundu

Google, üretken video tarafındaki yeni modeli Gemini Omni 1.1 Flash’ı resmen kullanıma sundu. Yeni sürüm, yalnızca sıfırdan video üretmekle kalmıyor; mevcut videoları devam ettirebiliyor, başlangıç ve bitiş kareleri üzerinde daha fazla kontrol sağlıyor ve düşük çözünürlükte hazırlanan içerikleri 4K’ya kadar yükseltebiliyor.

Gemini Omni 1.1 Flash’ın dikkat çeken yeniliklerinden biri de kısa videoları referans olarak kullanabilmesi. Model bu sayede karakterlerin görünümünü, ortamı ve genel görsel tarzı analiz ederek yeni sahnelerde daha tutarlı sonuçlar üretmeyi hedefliyor.

Videolar 40 saniyeye kadar uzatılabiliyor

Gemini Omni 1.1 Flash ile mevcut bir videoyu kaldığı yerden devam ettirmek mümkün. Önceki modeller videonun yalnızca son bir saniyesini dikkate alırken yeni sürüm, önceki içeriğin 10 saniyeye kadar olan bölümünü analiz edebiliyor.

Daha geniş bağlam penceresi özellikle karakterlerin konumu, kamera hareketleri, sahne kompozisyonu ve hikâyenin devamlılığı açısından önem taşıyor. Model, önceki sahnede neler olduğunu daha uzun süre boyunca görebildiği için devam videosunun orijinal görüntüyle daha uyumlu olması amaçlanıyor.

Videolar 10 saniyelik parçalar halinde genişletilebiliyor ve toplam uzunluk 40 saniyeye kadar çıkarılabiliyor. Böylece kullanıcılar bir kamera hareketini sürdürebiliyor, mevcut sahneyi farklı bir ortama taşıyabiliyor veya kısa bir sekansı daha uzun bir anlatıya dönüştürebiliyor.

İlk ve son kare kullanıcı tarafından belirlenebiliyor

Yeni model, videonun başlangıç ve bitiş karelerinin önceden tanımlanmasına da izin veriyor. Kullanıcı iki anahtar kareyi belirledikten sonra Gemini Omni 1.1 Flash, bu görüntüler arasındaki hareketleri hesaplayarak aradaki video sekansını oluşturuyor.

Özellik özellikle kontrollü kamera hareketleri, yakınlaştırma efektleri ve döngüsel videolar hazırlamak için kullanılabiliyor. İki sabit görüntü arasında farklı kamera hareketleri oluşturulabilmesi de içerik üreticilerine videonun kompozisyonu üzerinde daha fazla kontrol sağlıyor.

Bu yöntem, yapay zekâ video araçlarında sık karşılaşılan “başlangıç doğru ama sonuç tahmin edilenden farklı” problemini azaltmaya yardımcı olabilir. Kullanıcı videonun nereye ulaşacağını baştan belirleyebildiği için modelin hareketi bu iki nokta arasında oluşturması sağlanıyor.

360p modu video üretimini yüzde 60’a kadar hızlandırıyor

Her denemeyi yüksek çözünürlükte oluşturmak hem zaman hem de işlem maliyeti açısından verimli olmayabiliyor. Google bu nedenle Gemini Omni 1.1 Flash’a 360p hızlı üretim modu ekledi.

Şirketin verdiği bilgilere göre 360p video üretimi, standart 720p seçeneğine kıyasla yüzde 60’a kadar daha hızlı çalışıyor. Maliyetin ise yaklaşık üçte bir oranında daha düşük olduğu belirtiliyor.

Bu mod doğrudan nihai video hazırlamaktan çok hızlı prototipleme için tasarlanmış durumda. Kullanıcılar farklı istemleri, kamera açılarını veya sahne fikirlerini önce 360p çözünürlükte deneyebiliyor. Beğenilen sonuç daha sonra yüksek çözünürlüğe yükseltilebiliyor.

Özellikle çok sayıda deneme yapan geliştiriciler ve içerik üreticileri için bu yöntem üretim sürecini hızlandırabilir. Hikâye panosu oluşturma ve farklı fikirleri karşılaştırma gibi aşamalarda da her denemeyi yüksek çözünürlükte işlemek gerekmiyor.

Oluşturulan videolar 4K çözünürlüğe yükseltilebiliyor

Gemini Omni 1.1 Flash, üretilen videoları 1080p veya 4K çözünürlüğe yükseltme seçeneği de sunuyor. Böylece kullanıcılar önce 360p ya da 720p çözünürlükte hızlı denemeler yapıp yalnızca kullanmaya karar verdikleri videoları daha yüksek çözünürlüğe dönüştürebiliyor.

Bu yaklaşım, üretim süresini ve maliyeti azaltırken nihai içeriğin yüksek çözünürlükte alınabilmesini sağlıyor. Özellik özellikle reklam, sosyal medya içerikleri, sunumlar ve profesyonel video projeleri hazırlayan kullanıcıları hedefliyor.

Üç saniyelik videolar referans olarak kullanılabiliyor

Yeni modelin bir diğer önemli özelliği, üç saniyeye kadar video kliplerini referans olarak kabul etmesi. Kullanıcılar kısa bir videoyu modele vererek oluşturulacak yeni sahnenin hareketi, karakterleri, ortamı veya görsel tarzı için referans sağlayabiliyor.

Buradaki temel amaç görsel tutarlılığı artırmak. Örneğin aynı karakteri farklı sahnelerde kullanmak isteyen bir içerik üreticisi, karakterin yer aldığı kısa bir klibi referans olarak gösterebiliyor. Gemini Omni 1.1 Flash da karakterin görünümünü ve videonun görsel dilini analiz ederek yeni sahnede benzer bir sonuç üretmeye çalışıyor.

Video referanslarının kullanılması, özellikle birden fazla sahneden oluşan yapay zekâ videolarında karakterlerin veya ortamların çekimler arasında belirgin biçimde değişmesi sorununu azaltabilir.

Gemini Omni 1.1 Flash nasıl kullanılabilir?

Gemini Omni 1.1 Flash, geliştiricilere Google AI Studio üzerinden Gemini API aracılığıyla sunuluyor. Kurumsal kullanıcılar ise modele Gemini Kurumsal Ajan Platformu API’si üzerinden erişebiliyor.

Google, yeni modelle birlikte geliştirici dokümantasyonunu ve örnek uygulamaları da yayımlıyor. Hazırlanan kılavuzlarda sahne genişletme, video referansı ve çözünürlük yükseltme gibi özelliklerin nasıl kullanılacağına yönelik örnekler bulunuyor.

Bireysel kullanıcılar tarafında ise Gemini Omni 1.1 Flash, Google Flow üzerinden Google AI Plus, Pro ve Ultra abonelerine dünya genelinde sunulmaya başladı. Sahne genişletme özelliği de aynı abonelik paketlerindeki kullanıcılar için Gemini uygulamasında küresel olarak erişime açılıyor.

Yorum Yaz
Yorum yapabilmek için giriş yap veya üye ol.
Yorumlar