Data Augmentation
Veri artırmanın model sağlamlığını nasıl iyileştirdiğini ve aşırı öğrenmeyi nasıl azalttığını keşfet. Bilgisayarlı görü için Ultralytics YOLO26 performansını artıracak temel teknikleri öğren.
Veri artırma, mevcut verilerin değiştirilmiş sürümlerini oluşturarak bir eğitim veri kümesinin boyutunu ve çeşitliliğini yapay olarak artırmak için makine öğrenimi ve bilgisayarlı görüde kullanılan kritik bir tekniktir. Tamamen yeni verileri toplamak ve etiketlemek —ki bu zaman alıcı ve pahalı olabilir— yerine artırma, özgün örneklere çeşitli dönüşümler uygular. Bu değişiklikler, makine öğrenimi modellerinin örüntüleri daha sağlam bir şekilde tanımayı öğrenmesine yardımcı olur ve gerçek dünya ortamlarındaki değişkenlerle karşılaştıklarında bile iyi performans göstermelerini sağlar. Eğitim sırasında modelleri daha geniş bir senaryo yelpazesine maruz bırakarak geliştiriciler aşırı uyumu etkili bir şekilde azaltabilir ve genelleştirmeyi iyileştirebilir.
Modern Yapay Zekâdaki Önemi#
Bilgisayarlı görü alanında modeller, eğitim verilerinden biraz farklı görüntülerle karşılaştıklarında genellikle zorlanır. Aydınlatma, yönelim veya arka plan karmaşasındaki değişiklikler, yeterli çeşitlilik görmemiş bir modelin kafasını karıştırabilir. Veri artırma, bu değişkenleri programatik olarak simüle ederek sorunu ele alır. Örneğin bir kedi görüntüsü, modele bu değişikliklerden bağımsız olarak öznenin "kedi" olarak kaldığını öğretmek için döndürülebilir, çevrilebilir veya hafifçe bulanıklaştırılabilir.
Bu süreç, Ultralytics YOLO26 gibi modern mimarilerin başarısı için kritik öneme sahiptir; bu mimariler, nesne algılama ve görüntü segmentasyonu gibi görevlerde yüksek doğruluk elde etmek için zengin ve çeşitli veri kümelerine dayanır. Artırma, yeni eğitim örnekleri sentezleyerek modellerin değişmez özellikleri, yani girdideki değişikliklere rağmen değişmeyen karakteristikleri öğrenmesini sağlar.
Yaygın Teknikler ve Yöntemler#
Veri artırma, basit geometrik ayarlamalardan karmaşık üretici yaklaşımlara kadar geniş bir dönüşüm teknikleri yelpazesini kapsar:
- Geometrik Dönüşümler: Bunlar görüntüleri döndürme, ölçekleme, çevirme, kırpma ve öteleme (kaydırma) gibi işlemleri içerir. Bu işlemler, kameranın bakış açısındaki veya nesnenin konumundaki değişiklikleri temsil eder.
- Renk Uzayı Ayarlamaları: Parlaklığı, kontrastı, doygunluğu ve tonu değiştirmek, modellerin farklı aydınlatma koşullarını veya kamera sensörlerini ele almasına yardımcı olur.
- Gürültü Ekleme: Rastgele gürültü (Gauss gürültüsü gibi) eklemek, modelleri grenli veya düşük kaliteli girdi verilerine karşı daha dayanıklı hâle getirebilir.
- Görüntüleri Birleştirme: MixUp veya Mosaic gibi teknikler (YOLO eğitiminde yaygındır), birden fazla görüntüyü tek bir eğitim örneğinde birleştirerek modeli bağlamı ve nesneler arasındaki ilişkileri daha etkili bir şekilde öğrenmeye zorlar.
- Üretici Yaklaşımlar: Gelişmiş yöntemler, özgün veri kümesinin özelliklerini taklit eden tamamen yeni, sentetik eğitim örnekleri oluşturmak için Üretici Yapay Zekâ veya difüzyon modelleri kullanır.
Gerçek Dünya Uygulamaları#
Veri artırmanın pratik etkisi, veri kıtlığının veya yüksek değişkenliğin sorun oluşturduğu çok sayıda sektöre yayılır.
Otonom Sürüş#
Otonom araçların geliştirilmesinde, olası her hava koşulu veya aydınlatma senaryosu için veri toplamak neredeyse imkânsızdır. Mühendisler, açık hava koşullarında çekilmiş görüntüler üzerinde yağmur, sis, kar veya parlamayı simüle etmek için veri artırmayı kullanır. Bu, algılama sisteminin çevresel faktörlerden bağımsız olarak yayaları, trafik işaretlerini ve diğer araçları güvenilir bir şekilde algılayabilmesini sağlayarak güvenliği ve güvenilirliği artırır.
Tıbbi Görüntüleme#
Tıbbi görüntü analizi, gizlilik endişeleri ve bazı durumların nadir görülmesi nedeniyle genellikle sınırlı veri kümelerinden olumsuz etkilenir. Artırma, elastik deformasyonlar, döndürmeler veya yoğunluk değişimleri uygulayarak küçük X-ray veya MRI taraması veri kümelerini genişletmelerini sağlar. Bu, hasta konumlandırması veya tarama kalitesi değişse bile tümörleri veya kırıkları yüksek duyarlılıkla tanımlayabilen sağlam tanı modellerinin eğitilmesine yardımcı olur.
İlişkili Kavramları Ayırt Etme#
Veri artırmayı Sentetik Veriden ayırmak önemlidir. Her ikisi de veri kümesinin boyutunu artırmayı amaçlasa da sentetik veri sıfırdan yapay olarak oluşturulur (genellikle 3B oluşturma veya simülasyon motorları kullanılarak); veri artırma ise mevcut gerçek dünya verilerini değiştirir. Ayrıca Veri Ön İşleme, verileri bir modele uygun hâle getirmek için temizlemeyi ve biçimlendirmeyi (ör. yeniden boyutlandırma, normalleştirme) içerir; ancak artırmanın aksine eğitim örneklerinin sayısını mutlaka artırmaz.
Ultralytics ile Artırmayı Uygulama#
Modern çerçeveler, artırmayı doğrudan eğitim işlem hattına entegre eder. Aşağıdaki örnek, ultralytics paketi kullanılarak bir Ultralytics YOLO26 modelinin eğitimi sırasında çevirme ve ölçekleme gibi artırmaların nasıl uygulanacağını gösterir.
from ultralytics import YOLO
# Load the YOLO26 model
model = YOLO("yolo26n.pt")
# Train with custom data augmentation hyperparameters
# fliplr: 50% chance of horizontal flip, scale: image scaling gain
results = model.train(data="coco8.yaml", epochs=10, fliplr=0.5, scale=0.5)Geliştiriciler bu hiperparametreleri ayarlayarak artırma stratejisini veri kümelerinin ve uygulamalarının özel gereksinimlerine göre uyarlayabilir ve verimli model geliştirme için Ultralytics Platformu esnekliğinden yararlanabilir.









