Verini çeşitlendirmek için Albumentations artırmalarını kullanma
Ultralytics YOLO11'i özel olarak eğitirken model performansını çeşitli eğitim verileriyle artırmak için Albumentations kütüphanesini nasıl kullanacağını öğren.

Bir computer vision çözümü geliştirirken, vizyon AI modellerini eğitmek için çeşitli bir görüntü seti toplamak sürecin kritik bir parçası olabilir. Bu genellikle çok fazla zaman ve para gerektirir ve bazen toplanan görüntüler modellerin etkili bir şekilde öğrenmesi için hâlâ yeterince çeşitlilik içermez.
Örneğin, Ultralytics YOLO11 gibi computer vision modelleri, farklı uygulamalarla ilgili çeşitli computer vision tasks için görüntü veri setleri üzerinde özel olarak eğitilebilir. Çeşitli veriler önemlidir çünkü modelin daha iyi genelleme yapmasına yardımcı olur ve geniş bir gerçek dünya senaryosu yelpazesinde nesneleri ve kalıpları tanınmasını sağlar.
Eğer veri çeşitliliği eksikliğiyle mücadele ediyorsan, görüntü veri artırma teknikleri harika bir çözüm olabilir. Döndürme, yansıtma ve parlaklığı ayarlama gibi yöntemler veri setinin çeşitliliğini artırmana ve modelin daha geniş bir koşul yelpazesini ele alma yeteneğini geliştirmene yardımcı olabilir.
Bu nedenle Ultralytics, görüntü verisi artırma için bir entegrasyonu destekler. Bir dizi dönüşüm sunan popüler bir araç olan Albumentations kullanarak çeşitli görsel veriler oluşturabilirsin. Bu entegrasyon, eğitim görüntülerine otomatik olarak veri artırma uygulayarak YOLO11 eğitim sürecini basitleştirir ve model performansının artmasını sağlar.
Bu makalede, Albumentations entegrasyonunu nasıl kullanabileceğini, sağladığı faydaları ve model eğitimi üzerindeki etkisini keşfedeceğiz.
Albumentations nedir?#
Computer vision models, farklı ortamlardaki nesneleri tanımak için geniş bir yüksek kaliteli görüntü setinden öğrenebilir. Gerçek dünya kaynaklarından büyük veri setleri toplamak yavaş, masraflı ve verimsiz olabilir. Bu görevi kolaylaştırmak için, daha fazla veri toplamak zorunda kalmadan modellerin farklı senaryolardan öğrenmesine yardımcı olmak amacıyla mevcut görüntülerin yeni varyasyonlarını oluşturmak için image data augmentation kullanabilirsin.
Özellikle, 2018 yılında verimli görüntü veri artırma için tanıtılan açık kaynaklı bir kütüphane olan Albumentations'dan yararlanabilirsin. Döndürme ve yansıtma gibi basit geometrik değişikliklerden parlaklık, kontrast ve gürültü ekleme gibi daha karmaşık ayarlamalara kadar çeşitli işlemleri destekler.

Fig 1. Farklı görüntü verisi artırma türlerine örnekler.
Albumentations'ın temel özellikleri#
Albumentations, yüksek performansı ile bilinir; yani görüntüleri hızlı ve verimli bir şekilde işleyebilir. OpenCV ve NumPy gibi optimize edilmiş kütüphaneler üzerine kurulmuştur, büyük veri setlerini minimum işlem süresiyle yönetir ve bu da onu model eğitimi sırasında hızlı veri artırma için ideal kılar.
İşte Albumentations'ın diğer bazı temel özellikleri:
- Geniş dönüşüm yelpazesi: Albumentations, 70'ten fazla artırma türü sunar. Bu varyasyonlar, aydınlatma, açılar veya arka planlardaki değişikliklere rağmen modellerin nesneleri tespit etmeyi öğrenmesine yardımcı olur.
- Hız için optimize edilmiştir: Görüntü artırmayı hızlandırmak ve büyük veri setlerini verimli bir şekilde işlemek için birden fazla veri noktasını aynı anda işleyen SIMD (Single Instruction, Multiple Data) gibi gelişmiş optimizasyon teknikleri kullanır.
- Üç seviyeli artırma: Veriyi üç şekilde geliştirir. Örneğin, piksel seviyesindeki artırmalar nesneleri değiştirmeden parlaklığı ve rengi ayarlar. Bu arada, uzamsal seviyedeki artırmalar önemli detayları koruyarak nesne konumlandırmasını değiştirir ve karıştırma seviyesindeki artırmalar yeni örnekler oluşturmak için farklı görüntülerin parçalarını harmanlar.
Neden Albumentations entegrasyonunu kullanmalısın?#
Şunu merak ediyor olabilirsin: Bir veri setine artırma uygulamanın birçok yolu var ve hatta OpenCV gibi araçları kullanarak kendininkini bile oluşturabilirsin. Peki neden Albumentations gibi bir kütüphaneyi destekleyen bir entegrasyonu seçesin?
OpenCV gibi araçlarla manuel olarak veri artırma oluşturmak çok zaman alabilir ve bazı uzmanlık gerektirir. En iyi sonuçları elde etmek için dönüşümleri hassas bir şekilde ayarlamak da zor olabilir. Albumentations entegrasyonu bu süreci daha kolay hale getirir. dataset hazırlarken zamandan ve emekten tasarruf etmeni sağlayacak kullanıma hazır birçok dönüşüm sunar.
Albumentations entegrasyonunu seçmenin bir diğer nedeni de Ultralytics model training hattıyla sorunsuz bir şekilde çalışmasıdır. Eğitim sırasında veri artırma işlemleri otomatik olarak uygulandığı için YOLO11'i özel olarak eğitmeni çok daha kolay hale getirir. Süreci basitleştirir, böylece veri hazırlamayla uğraşmak yerine modelini geliştirmeye daha fazla odaklanabilirsin.
Albumentations entegrasyonuna başlarken#
İlginç bir şekilde, Ultralytics YOLO11 modelini eğitmek için Albumentations entegrasyonlarını kullanmak göründüğünden daha basittir. Doğru kütüphaneler kurulduktan sonra, entegrasyon eğitim sırasında otomatik olarak görüntü veri artırımları uygular. Modelin aynı veri kümesini kullanarak farklı görüntü varyasyonlarından öğrenmesine yardımcı olur.
Sonra, özel olarak bir Ultralytics YOLO11 eğitimi yaparken Albumentations entegrasyonunun nasıl kurulacağını ve kullanılacağını adım adım inceleyelim.
Ultralytics Python paketini ve Albumentations'ı kurma#
Veri artırma uygulamadan önce hem Ultralytics Python package hem de Albumentations yüklenmelidir. Entegrasyon, her iki kütüphanenin varsayılan olarak sorunsuz bir şekilde birlikte çalışacağı şekilde oluşturulmuştur, bu nedenle karmaşık yapılandırmalar hakkında endişelenmene gerek yoktur.
Tüm kurulum süreci, aşağıda gösterildiği gibi Python kütüphanelerini kurmak için bir paket yönetim aracı olan tek bir pip komutuyla birkaç dakika içinde tamamlanabilir.

Şekil 2. Ultralytics ve Albumentations'ı kurma.
Albumentations yüklendikten sonra Ultralytics model training modu eğitim sırasında otomatik olarak görüntü artırma uygular. Albumentations yüklü değilse, bu artırmalar uygulanmaz. Daha fazla ayrıntı için official Ultralytics documentation adresine başvurabilirsin.
Albumentations entegrasyonunun yardımıyla Ultralytics YOLO11 eğitimi#
Albumentations entegrasyonunun perde arkasında neler olduğuna dair daha iyi bir anlayış kazanalım.
İşte Ultralytics YOLO11 eğitimi sırasında uygulanan veri artırımlarına daha yakından bir bakış:
- Bulanıklaştırma (Blur): Bu dönüşüm, görüntüye hafif bir bulanıklık ekler. Modelin odak dışı kalsa bile nesneleri tespit etmesine yardımcı olur.
- Medyan bulanıklaştırma (Median blur): Görüntüdeki nesne kenarlarını korurken rastgele gürültüyü azaltır. Bu, modelin karmaşık ortamlardaki nesneleri tespit etmesini kolaylaştırır.
- Gri tonlama (Grayscale): Bir görüntüyü siyah beyaza dönüştürerek, bu artırma modelin renklere değil şekillere ve dokulara odaklanmasına yardımcı olabilir.
- CLAHE (Kontrast sınırlı uyarlamalı histogram eşitleme): Bu artırma, özellikle çok karanlık veya görülmesi zor olan alanlarda, örneğin düşük ışıklı veya puslu koşullarda, görüntüdeki kontrastı artırır. Bu, o alanlardaki nesneleri daha net hale getirir ve modelin tanımlamasını kolaylaştırır.

Fig 3. Bir kedi görüntüsüne uygulanan gri tonlama artırma örneği.
Ultralytics YOLO11 ve Albumentations entegrasyonunun uygulama alanları#
Belirli bir uygulama için özel olarak Ultralytics YOLO11 eğitiyorsan, Albumentations entegrasyonu çeşitli koşullara uyum sağlayarak modelin performansını artırmana yardımcı olabilir. Gerçek dünya uygulamalarını ve bu entegrasyonun çözebileceği zorlukları ele alalım.
Tıbbi görüntülemeyi iyileştirme#
Vision AI in healthcare, doktorların tıbbi görüntüleri daha doğru bir şekilde analiz etmesine yardımcı olarak teşhislere destek olur ve hasta bakımını iyileştirir. Aslında, around a fifth of healthcare organizations halihazırda AI çözümleri kullanmaktadır.
Ancak, bu bilgisayarlı görü çözümlerini oluşturmak kendi zorluklarını da beraberinde getiriyor. Tıbbi taramalar, farklı ekipmanlar, ayarlar ve hatta teknisyenlerin deneyimi gibi faktörlerden etkilenerek hastaneler arasında büyük farklılıklar gösterebilir. Parlaklık, kontrast ve pozlamadaki farklılıklar, bilgisayarlı görü modellerinin tutarlılığını ve doğruluğunu etkileyebilir ve bu da farklı ortamlarda güvenilir bir şekilde çalışmalarını zorlaştırabilir.
İşte Albumentations gibi araçların entegrasyonunun temel hale geldiği nokta burasıdır. Aynı taramanın birden fazla artırılmış sürümünü oluşturarak, Albumentations modelin çeşitli görüntü kalitelerinden öğrenmesini sağlar. Bu, modelin daha dayanıklı hale gelmesine yardımcı olur ve hem yüksek hem de düşük kaliteli görüntülerde hastalıkları doğru bir şekilde tespit etmesine olanak tanır.

Fig 4. Artırılmış X-ışını görüntüleri.
Güvenliği ve gözetimi geliştirme#
Vision AI'ın bir diğer ilginç uygulaması güvenlik ve gözetim alanındadır. Real-time object detection, güvenlik ekiplerinin olası tehditleri hızlı bir şekilde tanımlamasına yardımcı olabilir.
Bu uygulamayla ilgili temel bir endişe, güvenlik kameralarının gün boyunca çeşitli aydınlatma koşullarında görüntü yakalamasıdır ve bu koşullar bir modelin bu tür görüntüleri nasıl anladığını önemli ölçüde etkileyebilir. Düşük ışıklı ortamlar, parlama veya zayıf görünürlük gibi faktörler, bilgisayarlı görü modellerinin nesneleri tespit etmesini veya olası tehditleri tutarlı bir şekilde tanımasını zorlaştırabilir.
Albumentations entegrasyonu, farklı aydınlatma koşullarını taklit etmek için dönüşümler uygulayarak yardımcı olur. Bu, modelin hem parlak hem de düşük ışıklı ortamlarda nesneleri tespit etmeyi öğrenmesini sağlayarak onu daha güvenilir hale getirir ve zorlu koşullarda tepki sürelerini iyileştirir.
Perakende iş akışlarını ve müşteri deneyimini yeniden tanımlama#
Süpermarket koridorunda dökülen bir sıvı, mağazada koşan bir kömürcü köpeği veya bir ürün teşhirini deviren bir çocuk, vision AI in retail ortamlarında uç durumlar olabilecek günlük olaylardan sadece birkaçıdır. Computer vision, alışveriş yapanların davranışlarını takip ederek, yaya trafiğini izleyerek ve raflardaki ürünleri tanımlayarak müşteri deneyimini iyileştirmek için giderek daha fazla kullanılmaktadır. Ancak bu gerçek dünya durumlarının AI sistemleri tarafından anlaşılması ve doğru bir şekilde işlenmesi zor olabilir.
Her senaryo bir bilgisayarlı görü veri setinde temsil edilemese de, Albumentations entegrasyonu beklenmedik aydınlatma, alışılmadık açılar veya engeller gibi birçok olası durumu kapsayacak şekilde verileri artırarak yardımcı olur. Bu, bilgisayarlı görü modellerinin çeşitli koşullara uyum sağlamasına yardımcı olur, uç durumları ele alma ve dinamik perakende ortamlarında doğru tahminler yapma yeteneklerini geliştirir.
Öne çıkanlar#
Model eğitimi için çeşitli gerçek dünya verileri toplamak karmaşık olabilir, ancak Albumentations, modellerin farklı koşullara uyum sağlamasına yardımcı olan görüntü varyasyonları oluşturarak bunu kolaylaştırır.
Ultralytics tarafından desteklenen Albumentations entegrasyonu, YOLO11'i özel olarak eğitirken bu artırmaları uygulama sürecini basitleştirir. Bu, daha doğru ve güvenilir bilgisayarlı görü modelleri üreterek çok çeşitli endüstrilere fayda sağlayan daha iyi veri seti kalitesi ile sonuçlanır.
AI hakkında daha fazla bilgi edinmek için our community katılım sağla ve our GitHub repository incele, ayrıca vision AI projelerini başlatmak için our licensing options göz at. AI in manufacturing veya computer vision in self-driving gibi yeniliklerle ilgileniyor musun? Daha fazlasını keşfetmek için çözüm sayfalarımızı ziyaret et.






