İçerik Haritası
Yeni yapay zeka görüntü oluşturucu Google Veo 3.1 neler sunuyor?
Google, yapay zekâ takviyeli görüntü üretim aracı Flow için yeni kuşak görüntü modeli Veo 3.1’i tanıttı. Mevcut Veo 3’ün üzerine inşa edilen bu sürüm, sadece imaj oluşturmakla kalmıyor. Karakter tutarlılığı, sahne uzatma, gelişmiş düzenleme seçenekleri ve yerleşik ses üretimi üzere özelliklerle içerik yaratımında çıtayı yükseltiyor. Sizin için bu yeni modelin sunduğu yenilikleri detaylı halde ele adık.

Karakter tutarlılığı ve çoklu görsel desteği
Veo 3.1’in en dikkat cazip özelliklerinden biri, kullandığınız referans görsellerine ve sahne öğelerine sıkı sıkıya bağlı kalabilmesi. Google, modelin “Ingredients to Video” ismini verdiği bu teknikte, üç adet referans görsel ile karakter, nesne ve tarz seçimini daha aktif biçimde yönlendirebileceğini söylüyor. Bu sayede, sahne sahne geçişlerde karakter özellikleri (örneğin yüz tabiri, görünüş) daha dengeli biçimde korunabiliyor. Ayrıyeten “First and Last Frame” özelliği ile bir sahnenin başlangıç ve bitiş imgelerini vererek ortadaki geçiş görüntüsünü oluşturma imkanı tanınıyor.

Sahne uzatma ve gelişmiş düzenleme seçenekleri
Veo 3.1 ile görüntü mühleti artık sabit kalmıyor. “Scene extension” ismi verilen fonksiyon sayesinde, mevcut bir görüntünün son saniyesinden devam eden sahneler üretmek mümkün hâle geliyor. Bu, görüntüleri doğal bir formda uzatarak sahne bütünlüğünü koruyor ve art plan sesleriyle ahengi da gözetiyor. Ayrıyeten Flow arayüzünde daha parlak düzenleme araçları da sunuluyor:
Insert (Ekleme): Sahnelere yeni karakterler, objeler yahut ayrıntılar eklemek artık mümkün. Google, gölgeler, ışıklandırma ve ortam bütünlüğü üzere karmaşık görsel ögeleri otomatik olarak dengeleyebileceğini belirtiyor.
Remove (Kaldırma): İstenmeyen obje ya da karakterleri sahneden çıkarmak ve art planı tekrar yapılandırmak da planlar ortasında. Böylelikle sahne, güya o öğe hiç var olmamış üzere görünmesini sağlayacak.

Entegre ses takviyesi ve ortam uyumu
Veo 3.1, sırf görselle değil, tıpkı vakitte sesle de daha uyumlu bir tecrübe sunuyor. Flow’daki “Ingredients to Video”, “Frames to Video” ve “Extend” üzere özellikler artık yerleşik ses üretebiliyor, böylelikle ses efektleri, çevresel sesler ve konuşmalar senkronize biçimde model tarafından işlenebiliyor.
Bu modelin hem Gemini API hem de Vertex AI üzerinden erişilebilir ve ayrıyeten Flow ile direkt kullanıma açılmış durumda. Google’ın yayımladığı teknik ayrıntılar ve geliştirici blogları, bu sürümün sadece kreatif görüntü üretimini değil, birebir vakitte yapay zekâ takviyeli içerik yaratma süreçlerini de bir adım ileri taşıma niyetinde olduğunu gösteriyor.
Chip Alıntıdır…


