Validation Data
Doğrulama verilerinin model genellemesini nasıl iyileştirdiğini keşfet. Ultralytics YOLO26'yı ince ayarlamayı, aşırı öğrenmeyi önlemeyi ve en yüksek mAP için hiperparametreleri optimize etmeyi öğren.
Doğrulama verileri, makine öğrenimi geliştirme yaşam döngüsünde kritik bir kontrol noktası görevi görür ve eğitim sırasında bir modelin performansını değerlendirmek için kullanılan ara veri kümesi olarak işlev görür. Algoritmayı öğretmek için kullanılan birincil veri kümesinden farklı olarak doğrulama kümesi, sistemin yeni ve daha önce görülmemiş bilgilere ne kadar iyi genelleme öğrendiğine dair tarafsız bir tahmin sağlar. Geliştiriciler, bu özel alt kümedeki metrikleri izleyerek modelin yapılandırmasına ince ayar yapabilir ve sistemin temel örüntüleri anlamak yerine eğitim örneklerini ezberlediği aşırı öğrenme gibi olası sorunları belirleyebilir. Bu geri bildirim döngüsü, gerçek dünyada güvenilir şekilde performans gösteren sağlam yapay zekâ (AI) çözümleri oluşturmak için gereklidir.
Hiperparametre Ayarlamada Doğrulamanın Rolü#
Doğrulama verilerinin temel işlevi, hiperparametrelerin optimizasyonunu kolaylaştırmaktır. Model ağırlıkları gibi dahili parametreler eğitim süreciyle otomatik olarak öğrenilirken, öğrenme oranı, yığın boyutu ve ağ mimarisi dâhil hiperparametreler manuel olarak ayarlanmalı veya denemeler yoluyla keşfedilmelidir.
Doğrulama verileri, model seçimi aracılığıyla mühendislerin farklı yapılandırmaları etkili bir şekilde karşılaştırmasını sağlar. Örneğin bir geliştirici, bir YOLO26 modelini eğitiyorsa üç farklı öğrenme oranını test edebilir. Doğrulama kümesinde en yüksek doğruluğu sağlayan sürüm genellikle seçilir. Bu süreç, modelin veri ayrıntılarını yakalayacak kadar karmaşık, ancak genelleştirilebilirliğini koruyacak kadar basit olmasını sağlayarak bias-varyans ödünleşiminde yol göstermeye yardımcı olur.
Veri Bölümleri Arasındaki Farklar#
Bilimsel titizliği sağlamak için eksiksiz bir veri kümesi genellikle üç farklı alt kümeye ayrılır. Her birinin kendine özgü amacını anlamak, etkili veri yönetimi için hayati önem taşır.
- Eğitim Verileri: Bu, veri kümesinin en büyük bölümüdür ve modeli doğrudan uydurmak için kullanılır. Algoritma, geri yayılım yoluyla dahili parametrelerini ayarlamak üzere bu örnekleri işler.
- Doğrulama Verileri: Bu alt küme, sık aralıklarla değerlendirme yapmak için eğitim süreci sırasında kullanılır. En önemlisi, model ağırlıklarını bu verilere dayanarak doğrudan güncellemez; bu verileri yalnızca model seçimi ve erken durdurma kararlarına rehberlik etmek için kullanır.
- Test Verileri: Yalnızca nihai model yapılandırması seçildikten sonra kullanılan, tamamen ayrılmış bir veri kümesidir. Model dağıtımı performansına ilişkin gerçekçi bir metrik sağlamak için "final sınavı" görevi görür.
Ultralytics ile Pratik Uygulama#
Ultralytics ekosisteminde bir modeli doğrulamak kolaylaştırılmış bir süreçtir. Bir kullanıcı eğitimi veya doğrulamayı başlattığında çerçeve, veri kümesinin YAML yapılandırmasında belirtilen görüntüleri otomatik olarak kullanır. Bu işlem, kullanıcıların nesne algılama veya segmentasyon görevlerinin doğruluğunu değerlendirmesine yardımcı olan Ortalama Ortalama Kesinlik (mAP) gibi temel performans göstergelerini hesaplar.
Aşağıdaki örnek, Python kullanarak önceden eğitilmiş bir YOLO26 modelinin standart COCO8 veri kümesi üzerinde nasıl doğrulanacağını gösterir:
from ultralytics import YOLO
# Load the YOLO26 model (recommended for state-of-the-art performance)
model = YOLO("yolo26n.pt")
# Validate the model using the 'val' mode
# The 'data' argument points to the dataset config containing the validation split
metrics = model.val(data="coco8.yaml")
# Print the Mean Average Precision at IoU 0.5-0.95
print(f"Validation mAP50-95: {metrics.box.map}")Gerçek Dünya Uygulamaları#
Doğrulama verileri, hassasiyet ve güvenilirliğin vazgeçilmez olduğu çeşitli sektörlerde büyük önem taşır.
- Akıllı Tarım: Tarımda AI alanında sistemler, mahsul hastalıklarını tespit etmek veya büyüme aşamalarını izlemek üzere eğitilir. Farklı hava koşullarında (güneşli, kapalı, yağmurlu) çekilmiş görüntüler içeren bir doğrulama kümesi, modelin yalnızca mükemmel ve güneşli günlerde çalışmamasını sağlar. Veri artırma stratejileri doğrulama puanlarına göre ayarlanarak çiftçiler, çevresel değişkenlikten bağımsız olarak tutarlı içgörüler elde eder.
- Tıbbi Tanı: BT taramalarındaki tümörleri belirlemek gibi tıbbi görüntü analizi çözümleri geliştirilirken doğrulama verileri, modelin tek bir hastanenin ekipmanına özgü yanlılıkları öğrenmesini önlemeye yardımcı olur. Farklı hasta demografileri üzerinde gerçekleştirilen titiz doğrulama, tanı araçlarının FDA'nın dijital sağlık kılavuzları gibi düzenleyici kurumların gerektirdiği güvenlik standartlarını karşılamasını sağlar.
İleri Teknikler: Çapraz Doğrulama#
Verilerin kıt olduğu senaryolarda doğrulama için özel olarak %20 ayırmak, değerli eğitim bilgilerinin çok büyük bir bölümünü ortadan kaldırabilir. Bu gibi durumlarda uygulayıcılar genellikle Çapraz Doğrulama, özellikle de K Katlı Çapraz Doğrulama kullanır. Bu teknik, verileri 'K' alt kümeye bölmeyi ve hangi alt kümenin doğrulama verisi olarak kullanılacağını dönüşümlü biçimde değiştirmeyi içerir. Bu sayede her veri noktası hem eğitim hem de doğrulama için kullanılır ve istatistiksel öğrenme teorisinde açıklandığı üzere model performansına ilişkin istatistiksel açıdan daha sağlam bir tahmin elde edilir.
Doğrulama verilerinin etkili kullanımı, profesyonel Makine Öğrenimi Operasyonlarının (MLOps) temel taşlarından biridir. Ekipler, Ultralytics Platformu gibi araçlardan yararlanarak bu veri kümelerinin yönetimini otomatikleştirebilir ve modellerin üretim ortamına ulaşmadan önce titizlikle test edilip optimize edilmesini sağlayabilir.









