Latent Space
Makine öğrenmesinde gizil uzayı keşfet. Sinir ağlarının verileri gömmelere nasıl sıkıştırdığını ve Ultralytics YOLO26 kullanarak özellikleri nasıl çıkaracağını öğren.
Yapay zekâ alanında gizil uzay, karmaşık verilerin sıkıştırılmış ve daha düşük boyutlu matematiksel bir gösterimidir. Bir sinir ağı, bir görüntünün ham piksel değerleri veya metnin sıralı belirteçleri gibi yüksek boyutlu girdileri işlediğinde bu bilgileri kompakt bir çok boyutlu vektörde toplar. Bu gizli geometrik uzayda anlamsal benzerlikleri paylaşan veri noktaları koordinat sisteminde birbirine yakın konumlanır. Örneğin "araba"nın matematiksel gösterimi "kamyon"unkine yakın, "elma"nınkine ise uzak olur. Verileri sürekli bir matematiksel manifold üzerine eşleyerek makine öğrenimi modelleri, gereksiz arka plan gürültüsüyle uğraşmadan anlamlı örüntüleri kolayca karşılaştırabilir, ara değerlerini hesaplayabilir ve çıkarabilir.
İlgili Kavramları Ayırt Etme#
Bu gizli gösterimlerin nasıl çalıştığını anlamak için onları yakından ilişkili bilgisayarlı görü kavramlarından ayırt etmek gerekir:
- Gömme vektörleri: Gömme vektörü, tek bir veri parçasını temsil eden gerçek matematiksel vektördür (koordinatlardır). Gizil uzay, tüm bu ayrı gömme vektörlerinin yer aldığı genel matematiksel ortamdır.
- Boyut indirgeme: Boyut indirgeme, verileri sıkıştırmak için kullanılan algoritmik süreci (ör. Temel Bileşenler Analizi) ifade eder. Gizil uzay, bu sürecin ortaya çıkardığı ortamdır.
Gerçek Dünyadaki Yapay Zekâ Uygulamaları#
Verileri sıkıştırıp anlamsal olarak düzenleyebilme özelliği, bu kavramı modern görü sistemlerinin temel taşlarından biri hâline getirir ve sektörde çeşitli pratik kullanım alanlarının önünü açar:
- Üretken Yapay Zekâ: Gelişmiş üretken mimariler, özellikle Gizil Difüzyon Modelleri (LDM), görüntüleri piksel piksel oluşturmaz. Temel akademik araştırmalarda açıklandığı gibi bu modeller, bunun yerine gürültüyü yalnızca sıkıştırılmış uzayda yinelemeli olarak ekleyip kaldırır. Bu işlem hesaplama maliyetlerini büyük ölçüde azaltarak araştırma kuruluşlarının yüksek verimli modeller eğitmesini sağlar.
- Görüntü Sınıflandırma: CLIP gibi mimariler, görsel verileri ve metin açıklamalarını ortak bir gizil uzaya eşler. Model, bir görüntü vektörü ile metin vektörü arasındaki mesafeyi hesaplayarak açıkça hiç eğitilmediği nesneleri belirleyebilir ve kurumsal ekiplerin otomatik veri etiketleme iş akışlarına yaklaşımını dönüştürebilir.
- Anomali Tespiti: Bir otomatik kodlayıcı, normal ve kusursuz ürünlerin görüntüleriyle eğitildiğinde ağ belirli bir temel gösterimi öğrenir. Kusurlu bir ürün işlendiğinde bu ürünün eşlemesi beklenen bölgenin dışına düşer ve ürün derhâl incelenmek üzere işaretlenir.
Gizil Özellikleri Çıkarma#
Uygulamada bu gizli gösterimlere, sınıflandırma veya nesne tespiti başlığından önce görü modelinin son katmanlarındaki özellik haritalarını çıkararak erişebilirsin. Aşağıda, görüntü gömme vektörleri oluşturmak için Ultralytics YOLO26 kullanan kısa bir örnek yer alıyor.
from ultralytics import YOLO
# Load a pretrained YOLO26 Nano model
model = YOLO("yolo26n.pt")
# Pass an image through the model to extract its latent embedding vector
results = model.embed("https://ultralytics.com/images/bus.jpg")
# The result is a high-dimensional tensor representing the image in the latent space
print(f"Embedding shape: {results[0].shape}")Gizil Gösterimlerle Geliştirme#
Sektör, yüksek verimli uç bilişime ve kompakt temel modellere yöneldikçe gizil uzay üzerinde işlem yapma becerisi önem kazanıyor. Bu yoğun vektör uzaylarından yararlanan geliştiriciler sağlam öneri sistemleri ve anlamsal arama motorları oluşturabilir. Özel görü uygulamalarını ölçeklendirmek isteyen ekipler için Ultralytics Platform, veri kümesi yönetimi, otomatik açıklama ve sorunsuz model dağıtımı için düzenli bir bulut ortamı sunarak ham görsel verileri eyleme dönüştürülebilir bilgilere çevirmeni sağlar.









