Veri artırmayla AI modelinin sağlamlığını iyileştir
Veri artırma yoluyla eğitim verilerine gerçekçi çeşitlilikler eklemenin AI modelinin sağlamlığını ve gerçek dünya performansını nasıl iyileştirdiğini öğren.

Test, her türlü teknolojik çözümün geliştirilmesinin kritik bir parçasıdır. Ekiplerin bir sistemin kullanıma sunulmadan önce gerçekte nasıl çalıştığını görmesini ve sorunları erkenden gidermesini sağlar. Bu durum, modellerin kullanıma sunulduktan sonra öngörülemeyen gerçek dünya koşullarıyla başa çıkmasının beklendiği yapay zekâ dahil birçok alan için geçerlidir.
Örneğin, bilgisayarlı görü, makinelere görüntüleri ve videoları anlamayı öğreten bir yapay zekâ dalıdır. Ultralytics YOLO26 gibi bilgisayarlı görü modelleri nesne algılama, örnek bölütleme ve görüntü sınıflandırma gibi görevleri destekler.
Bu modeller; hasta takibi, trafik analizi, otomatik ödeme ve üretimde kalite denetimi gibi uygulamalar için birçok sektörde kullanılabilir. Ancak gelişmiş modellere ve yüksek kaliteli eğitim verilerine rağmen görü yapay zekâsı çözümleri; değişen aydınlatma, hareket veya kısmen engellenmiş nesneler gibi gerçek dünya değişkenleriyle karşılaştıklarında zorlanabilir.
Bunun nedeni, modellerin eğitim sırasında kendilerine sunulan örneklerden öğrenmesidir. Parlama, hareket bulanıklığı veya kısmi görünürlük gibi koşullarla daha önce karşılaşmadılarsa bu senaryolarda nesneleri doğru tanıma olasılıkları daha düşüktür.
Model sağlamlığını geliştirmenin bir yolu veri artırmadan geçer. Büyük miktarlarda yeni veri toplamak yerine mühendisler, aydınlatmayı ayarlama, kırpma veya görüntüleri birleştirme gibi küçük ve anlamlı değişiklikler yaparak mevcut görüntüleri dönüştürebilir. Bu, modelin aynı nesneleri daha geniş bir durum aralığında tanımayı öğrenmesine yardımcı olur.
Bu makalede veri artırmanın, kontrollü ortamların dışında kullanıma sunulduğunda model sağlamlığını ve görü yapay zekâsı sistemlerinin güvenilirliğini nasıl geliştirdiğini inceleyeceğiz. Hadi başlayalım!
Bir modelin sağlamlığı nasıl kontrol edilir#
Veri artırmaya geçmeden önce, bir bilgisayarlı görü modelinin gerçek dünyada kullanıma gerçekten hazır olup olmadığını nasıl anlayabileceğimizi ele alalım.
Sağlam bir model, yalnızca temiz ve kusursuz biçimde etiketlenmiş görüntülerde çalışmak yerine koşullar değiştiğinde de iyi performans göstermeye devam eder. Yapay zekâ modeli sağlamlığını değerlendirirken göz önünde bulundurabileceğin bazı pratik faktörler şunlardır:
- Aydınlatma değişiklikleri: Modeller parlak ışık, düşük ışık, parlama veya gölgelerle karşılaştığında farklı davranabilir; bu durum nesnelerin ne kadar güvenle algılandığını etkileyebilir.
- Kısmi örtülme: Günlük sahnelerde nesneler genellikle başka öğeler tarafından engellenir veya yalnızca kısmen görünür. Daha sağlam bir model, görsel bilgiler eksik olsa bile nesneleri tanıyabilir.
- Kalabalık sahneler: Birbiriyle örtüşen çok sayıda nesnenin bulunduğu ortamlar algılamayı zorlaştırabilir. Bu durumlarda iyi performans gösteren modeller, karmaşık ortamlarda genellikle daha güvenilirdir.
Temiz ve kusursuz şekilde yakalanmış görüntülerdeki iyi sonuçlar, gerçek dünyada her zaman güçlü performansa dönüşmez. Farklı koşullarda düzenli test yapmak, bir modelin kullanıma sunulduktan sonra ne kadar iyi dayanabildiğini göstermeye yardımcı olur.
Veri artırma nedir?#
Bir nesnenin fotoğrafta görünme şekli; aydınlatmaya, açıya, mesafeye veya arka plana bağlı olarak değişebilir. Bir bilgisayarlı görü modeli eğitilirken, öngörülemeyen ortamlarda iyi performans gösterebilmesi için öğrendiği veri kümesinin bu tür değişkenleri içermesi gerekir.
Veri artırma, sahip olduğun görüntülerden ek örnekler oluşturarak bir eğitim veri kümesini genişletir. Bu işlem; görüntüyü döndürme veya çevirme, parlaklığı ayarlama ya da görüntünün bir bölümünü kırpma gibi bilinçli değişiklikler uygulanarak gerçekleştirilir.
Örneğin, elinde yalnızca bir kedi fotoğrafı olduğunu düşün. Görüntüyü döndürür veya parlaklığını değiştirirsen bu tek fotoğraftan birkaç yeni sürüm oluşturabilirsin. Her sürüm biraz farklı görünür, ancak hâlâ aynı kedinin fotoğrafıdır. Bu değişiklikler, modele bir nesnenin farklı görünebilse de aynı şey olmaya devam edebileceğini öğretmeye yardımcı olur.

Şekil 1. Bir kedi görüntüsünü artırmaya bakış (Kaynak)
Veri artırma model performansını nasıl geliştirir?#
Model eğitimi sırasında veri artırma doğrudan eğitim işlem hattına eklenebilir. Yeni görüntü kopyalarını manuel olarak oluşturup depolamak yerine, her görüntü yüklendiğinde rastgele dönüşümler uygulanabilir.
Bu, görüntü her yüklendiğinde modelin biraz farklı bir sürüm görmesi anlamına gelir; görüntü daha parlak olabilir, çevrilebilir veya kısmen gizlenebilir. Rastgele silme gibi teknikler, bir nesnenin engellendiği ya da yalnızca kısmen göründüğü gerçek dünya durumlarını simüle etmek için görüntünün küçük bölgelerini kaldırabilir.

Şekil 2. Rastgele silmeye dayalı veri artırma örnekleri (Kaynak)
Aynı görüntünün birçok farklı sürümünü görmek, modelin tek bir kusursuz örneğe bağlı kalmak yerine hangi özelliklerin önemli olduğunu öğrenmesini sağlar. Bu çeşitlilik, yapay zekâ modelinin sağlamlığını artırarak gerçek dünya koşullarında daha güvenilir performans göstermesine yardımcı olur.
Yaygın veri artırma teknikleri#
Eğitim görüntülerine çeşitlilik kazandırmak için kullanılan bazı veri artırma teknikleri şunlardır:
- Geometrik dönüşümler: Bu teknikler, bir nesnenin görüntü içindeki mekânsal görünümünü değiştirir. Bir görüntüyü döndürmek, çevirmek, yeniden boyutlandırmak, kırpmak veya kaydırmak; modelin bir nesnenin farklı açılardan ya da mesafelerden nasıl görülebileceğini anlamasını sağlar.
- Renk ve aydınlatma ayarlamaları: Gerçek dünya aydınlatması nadiren tutarlıdır. Kullanılan ortama veya kameraya bağlı olarak görüntüler fazla parlak, fazla karanlık veya renk açısından biraz farklı olabilir. Parlaklığı, kontrastı, renk tonunu ve doygunluğu ayarlamak, modellerin bu görsel değişikliklerle başa çıkmasını ve farklı sahnelerde iyi performans göstermesini sağlar.
- Görüntü kalitesi değişiklikleri: Bulanıklık veya görsel gürültü, görüntülerin net görünmemesine neden olabilir. Eğitim sırasında bulanıklık veya gürültü eklemek, modelin hareket bulanıklığı, düşük ışıklı görüntüler veya düşük kaliteli kamera sonuçlarıyla başa çıkmayı öğrenmesine yardımcı olur ve modelin kusurlu görsellere duyarlılığını azaltır.
- Örtülmeye dayalı veri artırmalar: Gerçek ortamlarda nesneler genellikle başka nesneler tarafından kısmen engellenir. Bu durum görüntü örtülmesi olarak adlandırılır. Eğitim sırasında görüntünün küçük alanlarını gizlemek veya maskelemek, modelin yalnızca bir kısmı görünür olsa bile nesneleri algılamayı öğrenmesine yardımcı olur.
- Çoklu görüntü veri artırmaları: Bu teknikler, birden fazla görüntünün parçalarını tek bir eğitim örneğinde birleştirir. Böylece görüntüdeki nesne sayısı artırılabilir ve modelin karmaşık veya kalabalık sahnelerle başa çıkma yeteneği geliştirilebilir.

Şekil 3. Çoklu görüntü veri artırma örneği (Kaynak)
Ultralytics Python paketiyle veri artırmayı kolaylaştırma#
Veri kümelerini yönetmek, görüntü varyasyonları oluşturmak ve dönüşüm kodu yazmak, bir bilgisayarlı görü uygulaması geliştirirken ek adımlar oluşturabilir. Ultralytics Python paketi, YOLO26 gibi Ultralytics YOLO modellerini eğitmek, çalıştırmak ve kullanıma sunmak için tek bir arayüz sağlayarak bu süreci basitleştirir. Eğitim iş akışlarını kolaylaştırma çabasının bir parçası olarak paket, YOLO modelleri için optimize edilmiş ve Ultralytics tarafından test edilmiş yerleşik veri artırma özelliklerini içerir.
Paket ayrıca ayrı araçlara veya özel koda duyulan ihtiyacı ortadan kaldıran yararlı entegrasyonları destekler. Özellikle veri artırma için paket, yaygın olarak kullanılan bir görüntü artırma kütüphanesi olan Albumentations ile entegre olur. Bu entegrasyon, ek betiklere veya özel koda ihtiyaç duymadan artırmaların eğitim sırasında otomatik olarak uygulanmasını sağlar.
Açıklamaları ve artırılmış veri kümelerini yönetme#
Model sağlamlığını etkileyen bir diğer faktör açıklama kalitesidir. Roboflow gibi açıklama araçlarıyla oluşturulan ve yönetilen temiz, doğru etiketler, modelin nesnelerin nerede olduğunu ve nasıl göründüğünü anlamasına yardımcı olur.
Eğitim sırasında çevirme, kırpma ve döndürme gibi veri artırmalar dinamik olarak uygulanır ve açıklamalar bu değişikliklere uyacak şekilde otomatik olarak ayarlanır. Etiketler doğru olduğunda bu süreç sorunsuz ilerler ve modele aynı sahnenin birçok gerçekçi örneğini sunar.
Açıklamalar hatalı veya tutarsızsa bu hatalar artırılmış görüntüler boyunca tekrarlanabilir ve eğitimin daha az etkili olmasına neden olabilir. Doğru açıklamalarla başlamak, bu hataların yayılmasını önler ve daha iyi model sağlamlığına katkıda bulunur.
Veri artırmayla görü yapay zekâsı uygulamalarını geliştirme#
Şimdi veri artırmanın gerçek dünya uygulamalarında yapay zekâ modeli sağlamlığına nasıl katkıda bulunduğuna dair örnekleri inceleyelim.
Gerçek ortamlarda nesne algılama doğruluğunu artırma#
Gerçek verilerin sınırlı, hassas veya toplanmasının zor olduğu durumlarda nesne algılama sistemlerini eğitmek için genellikle sentetik görüntüler kullanılır. Ekiplerin gerçek hayatta her senaryoyu kaydetmesine gerek kalmadan ürünlere, ortamlara ve kamera açılarına ait örnekleri hızlıca oluşturmalarını sağlar.
Ancak sentetik veri kümeleri, aydınlatmanın değiştiği, nesnelerin birbiriyle örtüştüğü ve sahnelerde arka plan karmaşasının bulunduğu gerçek dünya görüntülerine kıyasla bazen fazla temiz görünebilir. Veri artırma; farklı aydınlatma, gürültü veya nesne yerleşimi gibi gerçekçi değişkenler ekleyerek bu farkı kapatmaya yardımcı olur. Böylece model, kullanıma sunulduğunda karşılaşacağı koşullarla başa çıkmayı öğrenir.
Örneğin yakın tarihli bir çalışmada, bir Ultralytics YOLO11 modeli tamamen sentetik görüntülerle eğitildi ve ek çeşitlilik sağlamak için veri artırma kullanıldı. Bu, modelin nesneleri daha genel biçimde tanımayı öğrenmesinde rol oynadı. Model, eğitim sırasında gerçek dünya verilerini hiç görmemiş olmasına rağmen gerçek görüntüler üzerinde test edildiğinde iyi performans gösterdi.
Tıbbi görüntüleme çözümlerini daha güvenilir hâle getirme#
Tıbbi görüntüleme veri kümeleri genellikle sınırlıdır ve taramaların kendisi ekipman türüne, görüntüleme ayarlarına veya klinik ortama göre değişebilir. Hasta anatomisindeki, açılardaki, aydınlatmadaki veya görsel gürültüdeki farklılıklar, bilgisayarlı görü modellerinin hastalar ve hastaneler arasında genellenebilen örüntüleri öğrenmesini zorlaştırabilir.
Veri artırma; eğitim sırasında gürültü eklemek, görüntüyü biraz kaydırmak veya küçük bozulmalar uygulamak gibi yöntemlerle aynı taramanın birden çok varyasyonunu oluşturarak bu sorunun ele alınmasına yardımcı olur. Bu değişiklikler, eğitim verilerinin gerçek klinik koşulları daha iyi temsil etmesini sağlar.
Örneğin bir pediatrik görüntüleme çalışmasında araştırmacılar anatomik bölütleme için Ultralytics YOLO11 kullandı ve modeli artırılmış tıbbi verilerle eğitti. Görüntüleri daha gerçekçi hâle getirmek için ek gürültü, küçük konum değişiklikleri ve ufak bozulmalar gibi varyasyonlar eklediler.

Şekil 4. Orijinal ve artırılmış pediatrik tıbbi görüntüler (Kaynak)
Model bu varyasyonlardan öğrenerek yüzeysel farklılıklar yerine anlamlı anatomik özelliklere odaklandı. Bu, farklı taramalar ve hasta vakaları arasındaki bölütleme sonuçlarını daha kararlı hâle getirdi.
Önemli çıkarımlar#
Çeşitli veriler toplamak zordur, ancak veri artırma modellerin daha geniş bir görsel koşul aralığından öğrenmesini sağlar. Bunun sonucunda örtülmeler, aydınlatma değişiklikleri ve kalabalık sahnelerle başa çıkarken model sağlamlığı artar. Genel olarak bu, modellerin kontrollü eğitim ortamlarının dışında daha güvenilir performans göstermesine yardımcı olur.
Topluluğumuza katıl ve görü yapay zekâsındaki en son gelişmeleri GitHub depomuzda keşfet. Üretimde yapay zekâ ve sağlık hizmetlerinde bilgisayarlı görü gibi uygulamaların ilerlemeyi nasıl desteklediğini öğrenmek için çözüm sayfalarımızı ziyaret et ve bir sonraki yapay zekâ çözümünü desteklemek için lisanslama seçeneklerimize göz at.









