Novel View Synthesis (NVS)
2D görüntülerden 3D perspektifler üretmek için yeni bakış açısı sentezini keşfet. Sağlam AI için Ultralytics YOLO26 modellerini sentezlenmiş verilerle nasıl geliştireceğini öğren.
Sınırlı sayıda 2D görüntüden 3D bir sahnenin yeni ve daha önce görülmemiş perspektiflerini oluşturma süreci, computer vision (CV) içinde gelişmiş bir görevdir. Bu teknik, temel geometriyi, aydınlatmayı, dokuları ve tıkanmaları doğru bir şekilde mantıksal olarak ele almak için büyük ölçüde deep learning (DL) yöntemine dayanır. Nesnelerin ve ortamların kaydedilmemiş açılardan nasıl görünmesi gerektiğini tahmin ederek bu teknoloji, 2D görüntüleme ile sürükleyici 3D scene representation arasındaki boşluğu kapatır.
Evrim ve Son Gelişmeler#
Tarihsel olarak, yeni bakış açıları oluşturmak, karmaşık aydınlatma ve yansıtıcı yüzeylerle sıklıkla zorlanan klasik multi-view stereo ve geleneksel photogrammetry techniques yöntemlerine dayanıyordu. Günümüzde manzara sinirsel oluşturma (neural rendering) tarafından domine edilmektedir. Bu geniş kavramı, Neural Radiance Fields (NeRF) ve Gaussian Splatting gibi belirli mimari uygulamalardan ayırmak önemlidir. Bu terimler sahneleri oluşturmak için belirli matematiksel ve yapısal yöntemleri ifade ederken, her ikisinin de çözdüğü kapsayıcı hedef yeni görünümler oluşturmaktır.
2024 ve 2025 yıllarındaki son atılımlar, generative diffusion models doğrudan sentez boru hattına entegre etmiştir. Bu yeni mimariler, modellerin açık bir 3D kafes yeniden oluşturulması gerektirmeden eksik olabilecek mantıksal detayları doğrudan piksel uzayında hayal etmesini sağlayarak zero-shot learning capabilities sunar. Bu, geleneksel olarak computer graphics rendering ile ilişkilendirilen hesaplama yükünü azaltır ve fotogerçekçi çıktılar oluşturulmasını hızlandırır.
Gerçek Dünya Uygulamaları#
Görülmemiş açıları sentezleme yeteneği, birçok sektörde derin etkilere sahiptir:
- Sürükleyici Medya: Modern spatial computing alanında bu teknoloji, yalnızca birkaç sıradan akıllı telefon fotoğrafından keşfedilebilir virtual reality environments ve interaktif augmented reality applications oluşturmak için temeldir.
- E-Ticaret: Perakendeciler, az sayıda 2D görüntüden kapsamlı 3D ürün vitrinleri oluşturabilir, böylece müşterilerin öğeleri dijital olarak her açıdan incelemesine olanak tanır.
- Simülasyon ve Eğitim: autonomous vehicles ve robotics için gerçek dünyadaki uç durumları toplamak tehlikeli ve pahalıdır. Mühendisler, mevcut sokak veya depo verilerinin yeni bakış açılarını sentezleyerek bir sahnenin sonsuz varyasyonlarını oluşturabilirler. Bu, güçlü bir data augmentation görevi görerek aşağı yönlü artificial intelligence (AI) navigasyon modellerinin dayanıklılığını artırır.
Ultralytics İş Akışlarıyla Entegrasyon#
Yeni görünümler sentezlendikten sonra genellikle yapısal analiz gerektirirler. Ultralytics Platform kullanarak, geliştiriciler bu yapay olarak oluşturulmuş veri kümeleri için data collection and annotation işlemlerini sorunsuz bir şekilde yönetebilirler.
Ultralytics YOLO26 gibi son teknoloji modelleri bu çeşitli perspektifler üzerinde eğiterek object detection, image segmentation ve pose estimation görevlerinin doğruluğunu büyük ölçüde artırabilirsin. Model, nesneleri daha önce yakalanmamış açılardan tanımayı öğrendiği için ortaya çıkan model deployment gerçek dünya senaryolarında çok daha dayanıklı hale gelir.
Sentezlenmiş bir görünümü hızlıca analiz etmek için, oluşturulan görüntüyü doğrudan önceden eğitilmiş bir modele aktarabilirsin:
import cv2
from ultralytics import YOLO
# Load the highly recommended Ultralytics YOLO26 model
model = YOLO("yolo26n.pt")
# Load a synthesized novel view using the OpenCV library
synthesized_view = cv2.imread("novel_view_render.jpg")
# Perform real-time object detection on the newly generated perspective
results = model(synthesized_view)
# Display the detection results
results[0].show()İster PyTorch3D library kullanarak ortamlar oluşturuyor ol ister tensor processing units (TPUs) gibi donanımlarda çıkarımı hızlandırıyor ol, yeni görünümleri sentezlemek ve ardından bunları analiz etmek, recent academic preprints ve devasa cloud-based machine learning kümeleri tarafından sürekli olarak desteklenen yapay zeka araştırmalarının ön saflarında yer almaya devam eder.






