Google DeepMind

Gemini Omni

Google'ın çok modlu oluşturma modeli — Gemini'nin akıl yürütme yeteneği ile yaratma gücünün buluştuğu nokta. Doğal dil ile metin, görsel, video veya sesten video oluşturun ve düzenleyin. Her düzenleme bir öncekinin üzerine inşa edilir. GPT Image 2.5 AI video generator ile ücretsiz deneyin.

Gemini Omni

En fazla 7 görsel. JPG, PNG, WEBP, görsel başına en fazla 10 MB.

0/2000
About

Gemini Omni Hakkında

Gemini Omni, Google I/O 2025'te duyurulan Google DeepMind'ın çok modlu oluşturma modelidir. Gemini'nin akıl yürütme yeteneğini üretken medya sistemleriyle bir araya getirerek, basit istemden videoya çıktının ötesine geçen video oluşturma ve düzenleme imkanı sunar. Model sahneleri, eylemleri, ortamları, fiziksel davranışları ve gerçek dünya bağlamını anlayarak rastgele değil, bilinçli hissettiren sonuçlar üretir. Gemini Omni Flash, Omni ailesinin ilk modeli olup kullanıcıların görüntüleri dönüştürebildiği, referanslarla sonuçları yönlendirebildiği ve doğal dil konuşmasıyla sahneleri iyileştirebildiği pratik video oluşturma ve düzenleme iş akışları için tasarlanmıştır.

Gemini Omni Hakkında

Temel Yetenekler

Çok modlu girdi, konuşma tabanlı düzenleme, stil dönüşümü ve gerçek dünya bilgisi — hepsi tek bir modelde

Temel Özellikler

Çok Turlu Konuşma Tabanlı Düzenleme

Gemini Omni, video düzenlemeye temelden farklı bir yaklaşım sunar. Her nesilde sıfırdan başlamak yerine, bir dizi doğal dil talimatıyla videonuzu iyileştirebilirsiniz. Arka planı değiştirin, eylemi ayarlayın, nesneleri değiştirin, kamera açısını kaydırın veya görsel efektler ekleyin — tüm bunları videonun geri kalanını sabit tutarak yapın. Bu konuşma tabanlı iş akışı, tıpkı değişiklik takipli bir belge düzenler gibi vizyonunuza adım adım yaklaşabileceğiniz anlamına gelir.

Prompt
Çıktı (Örnek)

Birden fazla turda düzenleme yapın: önce sahneyi oluşturun, sonra kamera açısını değiştirin, ardından atmosferik efektler ekleyin — boyunca tutarlılığı koruyun

Çok turlu düzenleme, ardışık değişiklikler boyunca sahne tutarlılığını korur

Önce bir odada bir kişiyle sahneyi kurun, sonra aydınlatmayı altın saate değiştirin, sonra pencereye yağmur ekleyin — her düzenleme bir öncekine dayanır

Sıralı ortam değişiklikleri konuşma yoluyla iyileştirmeyi gösterir

Gerçek Zamanlı Stil Dönüşümü

Gemini Omni, altta yatan hareketi, yapıyı ve sahne kompozisyonunu koruyarak herhangi bir giriş videosunun görsel stilini dönüştürebilir. Hedef estetiği tanımlayın — metalik yüzeyler, el çizimi eskizler, keçe kuklalar, holografik projeksiyonlar, voxel sanatı — ve model dönüşümü her karede tutarlı şekilde uygular. Orijinal kamera hareketi, karakter eylemleri ve mekansal ilişkiler bozulmadan kalır, basit filtrelerin çok ötesine geçen kusursuz bir stil transferi oluşturur.

Prompt
Çıktı (Örnek)

Kişi aynaya dokunduğunda, aynanın sıvı gibi güzelce dalgalanmasını sağla ve kişinin kolu yansıtıcı ayna malzemesine dönüşsün

Stil dönüşümü, görsel estetiği tamamen değiştirirken hareketi korur

Kişi aynaya dokunduğunda, tüm ortam bloklu geometrik şekillerle 3D voksel sanatına dönüşür

Mekansal yapıyı koruyarak voksel sanatına tam ortam dönüşümü

Gerçek Çok Modlu Girdi

Yalnızca metin veya tek bir görsel kabul eden modellerin aksine, Gemini Omni birden fazla girdi türünü aynı anda işleyebilir. Yönlendirme için metin, görsel referans için görseller, hareket rehberliği için video ve konuşma veya ses senkronizasyonu için ses sağlayın. Model tüm girdileri tek bir bütünlüklü video çıktısında sentezler. Bu, ilhamın birden fazla kaynaktan geldiği gerçek yaratıcı iş akışları için pratik hale getirir — bir storyboard çizimi, referans klip, ses kaydı ve yazılı açıklama hepsi nihai sonuca katkıda bulunabilir.

Prompt
Çıktı (Örnek)

Her eğreltiotu yaprağına dokunduğumda senkronize arp sesleri ekle. Yaprak yapısını etrafında ateş böcekleri uçan biyolüminesan bitki yaşamına dönüştür

Senkronize çıktı için video girdisini metin talimatları ve ses referansıyla birleştirme

Gerçek dünya bilimsel bilgisini kullanarak protein katlanma sürecini görselleştirin, doğru moleküler davranışla claymation tarzında render edin

Gerçek dünya bilgisi yaratıcı tarzla bilimsel görselleştirmeye uygulandı

Sıkça Sorulan Sorular

Gemini Omni FAQ

Gemini Omni, Gemini'nin akıl yürütme yeteneğini video oluşturmayla birleştiren Google DeepMind'ın çok modlu oluşturma modelidir. Geleneksel metinden videoya modellerinin aksine, Gemini Omni çok turlu konuşma tabanlı düzenlemeyi (her düzenleme bir öncekinin üzerine inşa edilir), aynı anda birden fazla girdi türünü (metin, görsel, video, ses) kabul etmeyi ve bağlamsal olarak anlamlı sonuçlar üretmek için gerçek dünya bilgisini uygulamayı destekler.

İçerik Üreticileri Gemini Omni Hakkında Ne Diyor

2,000+ Happy Users

"Gemini Omni'yi farklı kılan çok turlu düzenleme. Her seferinde sıfırdan yeniden oluşturmak yerine bir sahneyi adım adım iyileştirebiliyorum. Gerçekten istem yazmak yerine yönetmenlik yapmak gibi hissettiriyor."

E

Elena Vasquez

Kreatif Direktör

"Gemini Omni'yi farklı kılan çok turlu düzenleme. Her seferinde sıfırdan yeniden oluşturmak yerine bir sahneyi adım adım iyileştirebiliyorum. Gerçekten istem yazmak yerine yönetmenlik yapmak gibi hissettiriyor."

E

Elena Vasquez

Kreatif Direktör

Daha Fazla AI Video Modeli Keşfet

Gemini Omni ile Oluşturmaya Başlayın

Gemini Omni gücünü deneyimleyin — çevrimiçi ve ücretsiz
GPT Image user 1GPT Image user 2GPT Image user 3GPT Image user 4GPT Image user 5+1k