Dimensionality Reduction
Boyut indirgeme yönteminin ML iş akışlarını nasıl optimize ettiğini öğren. Ultralytics YOLO26 performansını ve veri görselleştirmeyi iyileştirmek için PCA ve t-SNE gibi teknikleri keşfet.
Boyut indirgeme, makine öğrenimi (ML) ve veri biliminde, bir veri kümesindeki giriş değişkenlerinin (genellikle özellikler veya boyutlar olarak adlandırılır) sayısını azaltırken en kritik bilgileri korumak için kullanılan dönüştürücü bir tekniktir. Büyük veri çağında veri kümeleri genellikle binlerce değişken içerir ve bu da boyutluluk laneti olarak bilinen bir olguya yol açar. Bu olgu, model eğitiminin hesaplama açısından maliyetli, aşırı öğrenmeye yatkın ve yorumlanması zor hâle gelmesine neden olabilir. Uygulayıcılar, yüksek boyutlu verileri daha düşük boyutlu bir uzaya yansıtarak verimliliği, görselleştirmeyi ve tahmin performansını iyileştirebilir.
Yapay Zekâ Geliştirmede Temel Faydalar#
Verilerin karmaşıklığını azaltmak, veri ön işleme işlem hatlarında temel bir adımdır. Sağlam yapay zekâ (AI) sistemleri oluşturmak için çeşitli somut avantajlar sunar:
- Geliştirilmiş Hesaplama Verimliliği: Daha az özellik, işlenecek daha az veri anlamına gelir. Bu, YOLO26 gibi algoritmaların eğitim sürelerini kısaltarak onları gerçek zamanlı çıkarım ve kaynakları kısıtlı uç yapay zekâ cihazlarında dağıtım için daha uygun hâle getirir.
- Geliştirilmiş Veri Görselleştirme: İnsan sezgisi, üç boyutun ötesindeki verileri kavramakta zorlanır. Boyut indirgeme, karmaşık veri kümelerini 2B veya 3B uzaylara sıkıştırarak TensorFlow Embedding Projector gibi araçlarla kümeleri, örüntüleri ve aykırı değerleri tespit etmeye yönelik etkili veri görselleştirmeyi mümkün kılar.
- Gürültü Azaltma: Bu teknik, verilerdeki en ilgili varyansa odaklanarak gürültüyü ve gereksiz özellikleri filtreler. Bunun sonucunda daha temiz eğitim verileri elde edilir ve modellerin görülmemiş örneklere daha iyi genelleme yapmasına yardımcı olunur.
- Depolama Optimizasyonu: Ultralytics Platform üzerinden yönetilenler gibi büyük veri kümelerini bulutta depolamak maliyetli olabilir. Özellik uzayını sıkıştırmak, temel veri bütünlüğünden ödün vermeden depolama gereksinimlerini önemli ölçüde azaltır.
Temel Teknikler: Doğrusal ve Doğrusal Olmayan Yöntemler#
Boyutları azaltma yöntemleri genellikle verilerin küresel doğrusal yapısını mı yoksa yerel doğrusal olmayan manifoldunu mu koruduklarına göre sınıflandırılır.
Doğrusal Yöntemler#
En yerleşik doğrusal teknik, Temel Bileşen Analizi (PCA) yöntemidir. PCA, verilerdeki maksimum varyansı yakalayan ortogonal eksenler olan "temel bileşenleri" belirleyerek çalışır. Orijinal verileri bu yeni eksenlere yansıtır ve böylece az miktarda bilgi sağlayan boyutları etkili bir şekilde eler. Bu yöntem, denetimsiz öğrenme iş akışlarının temel unsurlarındandır.
Doğrusal Olmayan Yöntemler#
Görüntüler veya metin embedding'leri gibi karmaşık veri yapıları için genellikle doğrusal olmayan yöntemler gerekir. t-Dağılımlı Stokastik Komşu Gömme (t-SNE) ve UMAP (Tekdüze Manifold Yaklaştırma ve İzdüşüm) gibi teknikler yerel komşulukları korumada başarılıdır ve bu nedenle yüksek boyutlu kümeleri görselleştirmek için idealdir. Ayrıca otomatik kodlayıcılar, girdileri bir gizli uzay temsiline sıkıştırmak ve yeniden oluşturmak üzere eğitilen sinir ağlarıdır; böylece verilerin kompakt bir kodlamasını etkili bir şekilde öğrenirler.
Gerçek Dünya Uygulamaları#
Boyut indirgeme, derin öğrenmenin (DL) çeşitli alanlarında kritik öneme sahiptir:
-
Bilgisayarlı Görü: YOLO26 gibi modern nesne algılayıcıları binlerce piksel içeren görüntüleri işler. Dahili katmanlar, özellik haritalarının uzamsal boyutlarını kademeli olarak azaltmak için havuzlama ve adımlı evrişimler gibi teknikleri kullanır ve ham pikselleri üst düzey anlamsal kavramlara (ör. "kenar", "göz", "araba") dönüştürür.
-
Genom Bilimi ve Sağlık: Tıbbi görüntü analizinde ve biyoinformatikte araştırmacılar, on binlerce değişken içeren gen ifadesi verilerini analiz eder. Boyut indirgeme, kanser genom bilimi çalışmalarında görüldüğü üzere hastalık sınıflandırması için temel biyobelirteçlerin belirlenmesine yardımcı olur.
-
Öneri Sistemleri: Netflix veya Spotify gibi platformlar, kullanıcı tercihlerini tahmin etmek için bir indirgeme tekniği olan matris çarpanlarına ayırmayı kullanır. Kullanıcı-öğe etkileşimlerinden oluşan seyrek matrisi azaltarak, gizli özelliklere dayalı içerikleri verimli bir şekilde önerebilirler.
Boyut İndirgeme ve Özellik Seçimi Karşılaştırması#
Benzer hedeflere farklı mekanizmalarla ulaştıkları için bu kavramı özellik seçiminden ayırt etmek önemlidir:
- Özellik Seçimi, orijinal özelliklerin bir alt kümesini seçmeyi içerir (ör. "Yaş" özelliğini tutup "Ad" özelliğini kaldırmak). Seçilen özelliklerin değerlerini değiştirmez.
- Boyut İndirgeme (özellikle özellik çıkarma), orijinal özelliklerin birleşimlerinden oluşan yeni özellikler oluşturur. Örneğin PCA, "Boyut"u temsil eden tek bir yeni bileşen oluşturmak için "Boy" ve "Kilo"yu birleştirebilir.
Python Örneği: Görüntü Embedding'lerini Azaltma#
Aşağıdaki örnek, yüksek boyutlu bir çıktının (bir görüntü embedding vektörünü simüle eder) nasıl alınıp PCA kullanılarak azaltılacağını gösterir. Bu, YOLO26 gibi bir modelin benzer sınıfları nasıl gruplandırdığını görselleştirirken kullanılan yaygın bir iş akışıdır.
import numpy as np
from sklearn.decomposition import PCA
# Simulate high-dimensional embeddings (e.g., 10 images, 512 features each)
# In a real workflow, these would come from a model like YOLO26n
embeddings = np.random.rand(10, 512)
# Initialize PCA to reduce from 512 dimensions to 2
pca = PCA(n_components=2)
reduced_data = pca.fit_transform(embeddings)
# Output shape is now (10, 2), ready for 2D plotting
print(f"Original shape: {embeddings.shape}") # (10, 512)
print(f"Reduced shape: {reduced_data.shape}") # (10, 2)








