

Google, yapay zeka alanındaki iddiasını bir adım öteye taşıyarak çok modlu model ailesinin yeni üyesi Gemini Omni Flash 1.1'i dün gece düzenlediği özel etkinlikte tanıttı. Metin, görsel, ses ve video verilerini eş zamanlı işleyebilme kapasitesiyle öne çıkan yeni model, özellikle video üretimi ve kurgu süreçlerinde köklü iyileştirmeler sunuyor. Google'ın açıklamasına göre, geliştirilmiş yapay zeka mimarisi sayesinde videoların uzatılması ve sahne geçişlerinin yönetilmesi artık çok daha profesyonel bir seviyede gerçekleşiyor. Model, bugün itibarıyla AI Studio platformu üzerinden geliştiricilerin erişimine açıldı ve sektördeki video üretim standartlarını yeniden tanımlamayı hedefliyor.
Önceki sürümlerde video uzatma işlemleri yalnızca son kare baz alınarak yapılıyordu. Bu yöntem, özellikle karmaşık hareketler içeren sahnelerde süreklilik kopukluklarına ve görsel hatalara yol açabiliyordu. Gemini Omni Flash 1.1 ile birlikte Google, sistemi 10 saniyelik bir geriye dönük analiz gerçekleştirecek şekilde güncelledi. Bu kritik değişiklik, yapay zekanın sahne bütünlüğünü daha iyi kavramasını ve kamera hareketlerini doğal bir biçimde devam ettirmesini sağlıyor. Özellikle aksiyon sahneleri veya hızlı geçişler içeren içeriklerde, geçişlerin çok daha yumuşak ve gerçekçi tamamlandığı gözlemleniyor.
Performans odaklı bir yaklaşım benimseyen Google, yeni modelde taslak oluşturma çözünürlüğünü 720p'den 360p seviyesine çekti. Bu teknik karar, sistem üzerindeki işlem yükünü hafifleterek üretim hızında yüzde 60'a varan bir artış sağladı. Kullanıcılar, taslak aşamasında hızlı sonuçlar alırken, nihai içerikleri 1080p veya 4K çözünürlükte dışa aktarma seçeneğine sahip oluyor. Bu hibrit yapı, hem hızlı bir ön izleme deneyimi sunuyor hem de yüksek kaliteli çıktıların üretilmesine olanak tanıyor.
Gemini Omni Flash 1.1'in en dikkat çekici özelliklerinden biri, kullanıcıların referans olarak üç saniyelik video kesitlerini kullanarak sahne kurgularını yönetebilmesi. Bu sayede içerik üreticileri, istedikleri sahneyi belirleyip yapay zekanın bu sahneyi temel alarak videoyu genişletmesini sağlayabiliyor. Özellikle reklam prodüksiyonu, sosyal medya içerikleri ve kısa film çalışmaları için bu özellik büyük bir esneklik sunuyor. Ayrıca model, 10 saniyelik parçalar halinde videoları toplamda 40 saniyeye kadar uzatabiliyor; bu da daha uzun ve tutarlı anlatılar oluşturma imkanı tanıyor.
Aşağıdaki tablo, yeni modelin öne çıkan teknik özelliklerini özetliyor:
Google, Gemini Omni Flash 1.1'in küresel lansmanına bugün başladı. Model, ilk etapta AI Studio üzerinden geliştiricilere açıldı. Türkiye'deki kullanıcıların modele erişimi konusunda henüz resmi bir açıklama yapılmadı; ancak Google'ın geçmişteki lansman politikaları göz önüne alındığında, ülkemizdeki erişimin kademeli olarak sağlanması bekleniyor. Yerel geliştiriciler ve içerik üreticileri, modelin sunduğu yenilikleri yakından takip ediyor.
Gemini Omni Flash 1.1, yalnızca hız ve çözünürlük iyileştirmeleriyle sınırlı kalmıyor. Modelin çok modlu yapısı, metin, görsel, ses ve video verilerini eş zamanlı işleyebilme yeteneği sayesinde, kullanıcıların yalnızca video değil, aynı zamanda bu videolarla senkronize ses ve metin içerikleri de üretebilmesine olanak tanıyor. Bu özellik, özellikle otomatik altyazı oluşturma, sesli anlatım ekleme ve çok dilli içerik üretimi gibi alanlarda büyük kolaylık sağlıyor. Google'ın bu hamlesi, yapay zeka destekli video üretiminde rekabeti kızıştıracak gibi görünüyor.
Bill Gates, yapay zeka risklerini görüşmek üzere Kasım ayında Çin Devlet Başkanı Xi Jinping ile bir araya gelmeyi planlıyor.
Henüz yorum yapılmamış. İlk yorumu sen yap!
E-posta adresiniz yayımlanmayacaktır. Gerekli alanlar (*) ile işaretlenmiştir.




| Özellik | Detay |
|---|
| Geriye dönük analiz | 10 saniye |
| Maksimum video uzatma | 40 saniye (10 saniyelik parçalar halinde) |
| Taslak çözünürlüğü | 360p |
| Dışa aktarma çözünürlüğü | 1080p / 4K |
| Referans video kesiti | 3 saniye |
| Hız artışı | Yüzde 60 |
| Erişim platformu | AI Studio |