Data Augmentation
Veri artırmanın model dayanıklılığını nasıl artırdığını ve aşırı uyumu nasıl azalttığını keşfet. Bilgisayarlı görü için Ultralytics YOLO26 performansını artıracak temel teknikleri öğren.
Veri artırımı (data augmentation), mevcut verilerin değiştirilmiş versiyonlarını oluşturarak bir eğitim veri setinin boyutunu ve çeşitliliğini yapay olarak artırmak için kullanılan, machine learning ve computer vision alanında kritik bir tekniktir. Zaman alıcı ve pahalı olabilen tamamen yeni verileri toplamak ve etiketlemek yerine, artırma işlemi orijinal örnekler üzerinde çeşitli dönüşümler uygular. Bu değişiklikler, machine learning models modellerinin kalıpları daha dayanıklı bir şekilde tanımayı öğrenmesine yardımcı olur ve gerçek dünya ortamlarında varyasyonlarla karşılaştıklarında bile iyi performans göstermelerini sağlar. Modelleri eğitim sırasında daha geniş bir senaryo yelpazesine maruz bırakarak, geliştiriciler overfitting durumunu etkili bir şekilde azaltabilir ve genellemeyi iyileştirebilir.
Modern Yapay Zekada Önemi#
computer vision alanında, modeller genellikle eğitim verilerinden biraz farklı olan görüntülerle karşılaştıklarında zorluk yaşar. Aydınlatma, yönelim veya arka plan karmaşıklığındaki varyasyonlar, yeterli çeşitliliği görmemiş bir modelin kafasını karıştırabilir. Veri artırımı, bu varyasyonları programatik olarak simüle ederek bunu çözer. Örneğin, bir kedinin fotoğrafı döndürülebilir, çevrilebilir veya hafifçe bulanıklaştırılabilir; böylece modele, bu değişikliklere rağmen konunun "kedi" olarak kaldığı öğretilir.
Bu süreç, object detection ve image segmentation gibi görevlerde yüksek doğruluk elde etmek için zengin ve varied veri setlerine güvenen Ultralytics YOLO26 gibi modern mimarilerin başarısının ayrılmaz bir parçasıdır. Yeni eğitim örnekleri sentezleyerek artırma, modellerin değişmeyen özellikleri (girdi değişikliklerine rağmen değişmeyen özellikleri) öğrenmesini sağlar.
Yaygın Teknikler ve Yöntemler#
Veri çoğaltma, basit geometrik ayarlamalardan karmaşık üretken yaklaşımlara kadar uzanan çok çeşitli dönüşüm tekniklerini kapsar:
- Geometrik Dönüşümler: Bunlar; görüntüleri döndürme, ölçeklendirme, çevirme, kırpma ve öteleme (kaydırma) gibi işlemleri içerir. Bunlar, kameranın bakış açısındaki veya nesnenin konumundaki değişiklikleri temsil eder.
- Renk Uzayı Ayarlamaları: Parlaklığı, kontrastı, doygunluğu ve renk tonunu değiştirmek, modellerin farklı aydınlatma koşulları veya kamera sensörleriyle başa çıkmasına yardımcı olur.
- Gürültü Enjeksiyonu: Rastgele gürültü (Gauss gürültüsü gibi) eklemek, modelleri grenli veya düşük kaliteli girdi verilerine karşı daha dirençli hale getirebilir.
- Görüntüleri Karıştırma: MixUp veya (YOLO eğitiminde popüler olan) Mosaic gibi teknikler, birden fazla görüntüyü tek bir eğitim örneğinde birleştirerek modeli bağlamı ve nesne ilişkilerini daha etkili bir şekilde öğrenmeye zorlar.
- Üretken Yaklaşımlar: Gelişmiş yöntemler, orijinal veri setinin özelliklerini taklit eden tamamen yeni, sentetik eğitim örnekleri oluşturmak için Generative AI veya diffusion models kullanır.
Gerçek Dünya Uygulamaları#
Veri çoğaltmanın pratik etkisi, veri kıtlığının veya yüksek değişkenliğin zorluk teşkil ettiği çok sayıda endüstriye yayılmaktadır.
Otonom Sürüş#
autonomous vehicles geliştirilmesinde, olası her hava koşulu veya aydınlatma senaryosu için veri toplamak neredeyse imkansızdır. Mühendisler, açık hava görüntülerinde yağmur, sis, kar veya parlamayı simüle etmek için veri artırımı kullanır. Bu, algılama sisteminin çevresel faktörlerden bağımsız olarak yayaları, trafik işaretlerini ve diğer araçları güvenilir bir şekilde tespit edebilmesini sağlayarak güvenliği ve güvenilirliği artırır.
Tıbbi Görüntüleme#
Medical image analysis alanı genellikle gizlilik endişeleri ve belirli durumların nadir olması nedeniyle sınırlı veri setlerinden muzdariptir. Artırma; araştırmacıların elastik deformasyonlar, rotasyonlar veya yoğunluk kaymaları uygulayarak X-ışını veya MR taramalarından oluşan küçük veri setlerini genişletmesine olanak tanır. Bu, hasta pozisyonu veya tarama kalitesi değişse bile tümörleri veya kırıkları yüksek hassasiyetle tanımlayabilen güçlü teşhis modelleri eğitmeye yardımcı olur.
İlgili Kavramları Ayırt Etme#
Veri artırımını Sentetik Veri'den ayırmak önemlidir. Her ikisi de veri seti boyutunu artırmayı amaçlasa da, synthetic data sıfırdan yapay olarak üretilirken (genellikle 3D oluşturma veya simülasyon motorları kullanılarak), veri artırımı mevcut gerçek dünya verilerini değiştirir. Buna ek olarak, Veri Ön İşleme (Data Preprocessing), verileri bir model için uygun hale getirmek üzere temizlemeyi ve biçimlendirmeyi (ör. yeniden boyutlandırma, normalizasyon) içerir, ancak artırımdan farklı olarak eğitim örneklerinin sayısını mutlaka artırmaz.
Ultralytics ile Çoğaltma Uygulama#
Modern çatılar, veri artırımını doğrudan eğitim boru hattına entegre eder. Aşağıdaki örnek, ultralytics paketini kullanarak bir Ultralytics YOLO26 modelinin eğitimi sırasında ters çevirme ve ölçekleme gibi veri artırımlarının nasıl uygulanacağını gösterir.
from ultralytics import YOLO
# Load the YOLO26 model
model = YOLO("yolo26n.pt")
# Train with custom data augmentation hyperparameters
# fliplr: 50% chance of horizontal flip, scale: image scaling gain
results = model.train(data="coco8.yaml", epochs=10, fliplr=0.5, scale=0.5)Bu hiperparametreleri ayarlayarak geliştiriciler, verimli model geliştirme için Ultralytics Platform esnekliğinden yararlanarak artırma stratejisini veri setlerinin ve uygulamalarının özel ihtiyaçlarına göre uyarlayabilirler.






