
Google Gemini Omni 1.1 Flash duyuruldu: Yapay zekâ ile video üretimi ucuzladı
Google, yapay zekâ destekli video üretimi ve düzenleme tarafındaki yeni modeli Gemini Omni 1.1 Flash sürümünü duyurdu. Yeni model; daha uzun ve tutarlı sahneler oluşturma, başlangıç ve bitiş karelerini belirleyerek kamera hareketleri üretme, video referanslarından yararlanma ve 4K çözünürlüğe kadar yükseltme gibi önemli yenilikler getiriyor.
Gemini Omni 1.1 Flash’ın dikkat çeken taraflarından biri ise maliyetleri düşürmek için eklenen 360p taslak video modu. Google’a göre bu mod, standart 720p üretime kıyasla yüzde 60’a kadar daha hızlı çalışabiliyor ve yaklaşık üçte bir maliyetle video taslakları oluşturabiliyor.
Gemini Omni 1.1 Flash ile sahneler 40 saniyeye kadar uzatılabiliyor
Önceki Gemini Omni Flash sürümünün önemli sınırlamalarından biri uzun sahnelerde tutarlılığın korunmasıydı. Google’ın açıkladığı bilgilere göre Gemini Omni 1.1 Flash, sahne genişletme sırasında önceki videonun 10 saniyeye kadar olan bölümünü analiz edebiliyor.
Önceki yaklaşım yalnızca videonun son bir saniyesini referans alırken yeni sistemin daha geniş bir bağlamı inceleyebilmesi; karakterlerin görünümü, ışıklandırma, ortam ve hikâyenin devamlılığı açısından daha tutarlı sonuçların ortaya çıkmasını sağlayabilir.
Videolar 10 saniyelik parçalar hâlinde genişletilebiliyor ve toplam uzunluk 40 saniyeye kadar çıkarılabiliyor. Bu özellikle kısa film, reklam, sosyal medya videosu ve hikâye tabanlı yapay zekâ içerikleri hazırlayan kullanıcılar açısından önemli bir gelişme.
Başlangıç ve bitiş kareleri kullanıcı tarafından belirlenebiliyor
Gemini Omni 1.1 Flash ile gelen bir diğer önemli özellik, videonun ilk ve son karesini belirleyebilme yeteneği.
Kullanıcı veya geliştirici iki farklı anahtar kare belirlediğinde yapay zekâ, bu iki görüntü arasındaki hareketi oluşturarak kesintisiz bir video meydana getirebiliyor.
Google bu özelliğin özellikle;
- kamera yörünge hareketleri,
- yakınlaştırma ve uzaklaştırma geçişleri,
- farklı sahneler arasındaki kamera hareketleri,
- döngü şeklinde oynatılabilecek videolar
gibi üretimlerde kullanılabileceğini belirtiyor. Böylece yalnızca metin komutuyla video oluşturmanın ötesine geçilerek, kullanıcının kamera hareketleri üzerinde daha fazla kontrol sahibi olması hedefleniyor.
Üç saniyeye kadar video referansı kullanılabiliyor
Yeni sürüm, video üretirken harici görüntülerin referans olarak kullanılmasını da geliştiriyor.
Gemini Omni 1.1 Flash’a üç saniyeye kadar referans video verilebiliyor. Model bu görüntülerdeki hareket biçimini, görsel bağlamı ve karakter özelliklerini yeni üretilecek sahneye aktarabiliyor.
Örneğin belirli bir dans hareketinin bulunduğu kısa bir video modele verilip aynı hareketin farklı bir karakter tarafından gerçekleştirilmesi istenebiliyor. Bu yaklaşım özellikle aynı karakterin farklı üretimlerde korunması veya belirli hareketlerin yeniden oluşturulması açısından yapay zekâ video araçlarının kullanım alanını genişletebilir.
360p taslak modu video üretim maliyetini düşürüyor
Yapay zekâ ile video oluştururken en önemli sorunlardan biri, doğru sonucu bulabilmek için aynı sahnenin defalarca oluşturulmasının gerekmesi. Yüksek çözünürlüklü her deneme ise hem oluşturma süresini hem de API maliyetini artırıyor.
Google bu soruna karşı 360p Draft Mode, yani taslak modu sunuyor.
Şirketin verdiği bilgilere göre 360p üretim, sistem verimine bağlı olarak 720p çözünürlüğe kıyasla yüzde 60’a kadar daha hızlı gerçekleştirilebiliyor. Ayrıca üretim maliyeti de 720p seçeneğinin yaklaşık üçte biri seviyesine düşüyor.
Böylece geliştiriciler önce düşük çözünürlükte birkaç farklı sahne oluşturup beğendikleri sonucu daha yüksek çözünürlüğe taşıyabilecek.
Özellikle API üzerinden yüzlerce veya binlerce video üretimi yapan uygulamalar açısından bu seçenek ciddi bir maliyet avantajı sağlayabilir.
Gemini Omni 1.1 Flash fiyatları ne kadar?
Gemini Omni 1.1 Flash’ın çözünürlüğe göre saniye başına fiyatlandırması şu şekilde:
| Çözünürlük | Gemini Omni 1.1 Flash | Gemini Omni Flash | Veo 3.1 Lite | Veo 3.1 Fast |
|---|---|---|---|---|
| 360p | 0,03 dolar/sn | — | — | — |
| 720p | 0,10 dolar/sn | 0,10 dolar/sn | 0,05 dolar/sn | 0,10 dolar/sn |
| 1080p | 0,15 dolar/sn | — | 0,08 dolar/sn | 0,12 dolar/sn |
| 4K | 0,30 dolar/sn | — | — | 0,30 dolar/sn |
Google’ın güncel fiyatlandırmasında Veo 3.1 Lite için 720p video saniye başına 0,05 dolar, 1080p video ise 0,08 dolar olarak listeleniyor. Veo 3.1 Fast tarafında fiyatlar sırasıyla 720p için 0,10 dolar, 1080p için 0,12 dolar ve 4K için 0,30 dolar seviyesinde.
Bu açıdan Gemini Omni 1.1 Flash’ın en dikkat çekici seçeneği saniyesi 0,03 dolar olan 360p taslak modu oluyor.
Örneğin 10 saniyelik bir taslak videonun ham üretim maliyeti yaklaşık 0,30 dolar seviyesinde olurken aynı uzunluktaki 720p video yaklaşık 1 dolar, 1080p video 1,50 dolar, 4K video ise 3 dolar seviyesine ulaşıyor.
Gerçek kullanım maliyetinin aynı videonun kaç kez yeniden oluşturulduğuna bağlı olarak daha yüksek olabileceğini de belirtmek gerekiyor.
Videolar 1080p ve 4K çözünürlüğe yükseltilebiliyor
Gemini Omni Flash’ın önceki sürümünde geliştirici tarafındaki temel video üretim çözünürlüğü 720p seviyesindeydi. Yeni Gemini Omni 1.1 Flash ise üretim sürecinin sonunda videoları 1080p veya 4K çözünürlüğe yükseltebiliyor.
Google bu özelliği özellikle profesyonel video üretim süreçleri için konumlandırıyor.
Böylece geliştiriciler önce düşük maliyetli 360p taslaklar hazırlayabilir, doğru sahneyi seçtikten sonra yalnızca nihai videoyu yüksek çözünürlüğe taşıyabilir. Bu iş akışı, yapay zekâ video üretiminin en pahalı bölümlerinden biri olan tekrar üretim maliyetini azaltabilir.
Gemini Omni 1.1 Flash nereden kullanılabilir?
Google’ın 27 Ağustos 2026 tarihli duyurusuna göre Gemini Omni 1.1 Flash, geliştiriciler için Google AI Studio ve Gemini geliştirici ekosisteminde kullanıma sunuluyor. Modelin API tarafındaki kimliği de gemini-omni-1.1-flash olarak gösteriliyor.
Google ayrıca modeli Gemini Enterprise Agent Platform üzerinden kurumsal geliştiricilere sunuyor. Omni 1.1, Google AI Plus, Pro ve Ultra aboneleri için Google Flow’a da dağıtılmaya başladı. Sahne genişletme özelliği ise aynı abonelik seviyelerindeki kullanıcılara Gemini uygulaması üzerinden küresel olarak sunuluyor.
Gemini Omni ailesinin temel sürümü daha önce gemini-omni-flash-preview adıyla geliştiricilere açılmış ve metin, görüntü, ses ve videoyu birlikte işleyebilen çok modlu yapısıyla konumlandırılmıştı.
Yapay zekâ video yarışında maliyet ve kontrol öne çıkıyor
Gemini Omni 1.1 Flash güncellemesi, yapay zekâ video üretimindeki rekabetin yalnızca görüntü kalitesi üzerinden ilerlemediğini gösteriyor.
Üretim hızı, sahne tutarlılığı, kamera kontrolü ve maliyet artık en az görsel kalite kadar önemli hâle geliyor.
Özellikle 360p taslak oluşturup yalnızca seçilen videoları 1080p veya 4K çözünürlüğe yükseltebilmek, profesyonel içerik üreticileri ve yapay zekâ video uygulaması geliştiren şirketler için daha verimli bir çalışma yöntemi sunabilir.
Sahne genişletmede artık son bir saniye yerine önceki 10 saniyenin analiz edilmesi de karakter ve ortam sürekliliğinin korunmasında önemli bir gelişme olabilir.
Google DeepMind, Gemini Omni 1.1 Flash’ı “daha fazla yaratıcı kontrol ve prodüksiyona hazır çıktılar” sunan yeni nesil Omni modeli olarak konumlandırıyor.
Video üretim modellerinde rekabet hızlanırken Google’ın yeni yaklaşımı, tek seferde en yüksek kalitede çıktı üretmek yerine ucuz taslak oluşturma, hızlı deneme ve ardından yüksek çözünürlüklü final çıktı alma şeklinde daha profesyonel bir üretim akışını öne çıkarıyor.




