2025'teki en iyi bilgisayarlı görü veri kümelerini keşfetme
2025'in en iyi bilgisayarlı görü veri kümelerine daha yakından bakarken bize katıl. Çeşitli ve yüksek kaliteli veri kümelerinin daha akıllı görsel yapay zeka çözümlerini nasıl desteklediğini öğren.

Verilerin günlük olarak yaptığın neredeyse her şeyde rol oynadığını biliyor muydun? Video izlemek, fotoğraf çekmek veya Google Maps'i kontrol etmek, 75 milyardan fazla bağlı cihaz tarafından yakalanan sürekli bilgi akışına katkıda bulunur. Bu veri parçaları, yapay zekânın (AI) temelini oluşturur. Aslında Ultralytics YOLO11 gibi gelişmiş bilgisayarlı görü modelleri; kalıpları belirlemek, görüntüleri yorumlamak ve çevremizdeki dünyayı anlamlandırmak için görsel verilere güvenir.
İlginç olan şu ki verilerin değeri yalnızca miktarla ilgili değildir. Verilerin ne kadar iyi organize edildiği ve hazırlandığı daha önemlidir. Bir veri kümesi dağınık veya eksikse hatalara yol açabilir. Ancak veri kümeleri temiz ve çeşitli olduğunda, ister kalabalıkta nesneleri tanımak ister karmaşık görselleri analiz etmek olsun, bilgisayarlı görü modellerinin daha iyi performans göstermesine yardımcı olurlar. Yüksek kaliteli veri kümeleri büyük fark yaratır.
Bu makalede 2025'in en iyi bilgisayarlı görü veri kümelerini inceleyecek ve bunların daha doğru ve verimli bilgisayarlı görü modelleri oluşturmaya nasıl katkıda bulunduğunu göreceğiz. Hadi başlayalım!
Bilgisayarlı görü veri kümeleri nedir?#
Bir bilgisayarlı görü veri kümesi, bilgisayarlı görü sistemlerinin görsel bilgileri anlamayı ve tanımayı öğrenmesine yardımcı olan görüntü veya video koleksiyonudur. Bu veri kümeleri, modellerin verilerdeki nesneleri, insanları, sahneleri ve kalıpları tanımasına yardımcı olan etiketler veya açıklamalarla birlikte gelir.
Yüzleri belirleme, nesneleri algılama veya sahneleri analiz etme gibi görevlerde bilgisayarlı görü modellerini eğitmek ve geliştirmek için kullanılabilirler. Veri kümesi ne kadar iyi organize edilmiş, çeşitli ve doğru olursa, görü yapay zekâ modeli de o kadar iyi performans gösterir; bu da günlük yaşamda daha akıllı ve kullanışlı teknolojilerin ortaya çıkmasını sağlar.
Bilgisayarlı görü veri kümesi nasıl oluşturulur#
Bilgisayarlı görü veri kümesi oluşturmak, birine dünyayı görmeyi ve anlamayı öğretmek için ders notları hazırlamaya benzer. Her şey, geliştirdiğin belirli uygulamayla eşleşen görüntü ve videoları toplamaya başlamakla başlar.
İdeal bir veri kümesi; ilgilenilen nesnelerin farklı açılardan, çeşitli aydınlatma koşullarında ve farklı arka planlar ile ortamlarda çekilmiş çeşitli örneklerini içerir. Bu çeşitlilik, bilgisayarlı görü modelinin kalıpları doğru şekilde tanımayı öğrenmesini ve gerçek dünya senaryolarında güvenilir performans göstermesini sağlar.

Şekil 1. Mükemmel görü veri kümesi oluşturma. Görsel: yazar.
İlgili görüntü ve videoları topladıktan sonraki adım veri etiketlemedir. Bu süreç, yapay zekânın her görüntü veya videonun ne içerdiğini anlayabilmesi için verilere etiketler, açıklamalar veya tanımlar eklemeyi kapsar.
Etiketler; modelin görsel bilgileri doğru şekilde tanıması ve yorumlaması için eğitilmesine yardımcı olan nesne adlarını, konumları, sınırları veya diğer ilgili ayrıntıları içerebilir. Veri etiketleme, basit bir görüntü koleksiyonunu bir bilgisayarlı görü modelini eğitmek için kullanılabilecek yapılandırılmış bir veri kümesine dönüştürür.
Model eğitimi yüksek kaliteli veriler gerektirir#
Bir veri kümesini yüksek kaliteli yapan şeyin ne olduğunu merak ediyor olabilirsin. Doğru etiketleme, çeşitlilik ve tutarlılık gibi birçok faktör rol oynar. Örneğin, birden fazla açıklayıcı bir nesne algılama veri kümesinde kedi kulaklarını etiketliyorsa, biri bunları başın bir parçası olarak etiketlerken diğeri ayrı olarak kulak şeklinde etiketleyebilir. Bu tutarsızlık modeli şaşırtabilir ve doğru şekilde öğrenme yeteneğini etkileyebilir.
İdeal bir bilgisayarlı görü veri kümesinin niteliklerine hızlıca göz atalım:
- Net etiketler: Her görüntü, tutarlı ve kesin etiketlerle doğru şekilde açıklanır.
- Çeşitli veriler: Veri kümesi, modelin farklı durumlarda iyi çalışmasına yardımcı olmak için farklı nesneler, arka planlar, aydınlatma koşulları ve açılar içerir.
- Yüksek çözünürlüklü görüntüler: Keskin ve ayrıntılı görüntüler, modelin özellikleri öğrenmesini ve tanımasını kolaylaştırır.
Ultralytics çeşitli veri kümelerini destekler#
YOLO11 gibi Ultralytics YOLO modelleri, belirli bir YOLO dosya formatındaki veri kümeleriyle çalışacak şekilde tasarlanmıştır. Kendi verilerini bu formata dönüştürmek kolay olsa da hemen denemeye başlamak isteyenler için zahmetsiz bir seçenek de sunuyoruz.
Ultralytics Python paketi, çok çeşitli bilgisayarlı görü veri kümelerini destekler; böylece ek kurulum yapmadan nesne algılama, örnek bölütleme veya poz tahmini gibi görevleri kullanan projelere dalabilirsin.
Kullanıcılar, eğitim işlevindeki parametrelerden biri olarak veri kümesinin adını belirterek COCO, DOTA-v2.0, Open Images V7 ve ImageNet gibi kullanıma hazır veri kümelerine kolayca erişebilir. Bunu yaptığında veri kümesi otomatik olarak indirilir ve önceden yapılandırılır; böylece sen modellerini oluşturmaya ve geliştirmeye odaklanabilirsin.
2025'teki en iyi 5 bilgisayarlı görü veri kümesi#
Görü yapay zekâsındaki ilerlemeler, yenilikleri teşvik eden ve çığır açan gelişmeleri mümkün kılan çeşitli, büyük ölçekli veri kümelerine dayanır. Bilgisayarlı görü modellerini etkileyen ve Ultralytics tarafından desteklenen en önemli veri kümelerinden bazılarına göz atalım.
ImageNet veri kümesi#
ImageNet, 2007'de Fei-Fei Li ve Princeton University'deki ekibi tarafından oluşturulmuş ve 2009'da tanıtılmış, 14 milyondan fazla etiketli görüntü içeren büyük bir veri kümesidir. Farklı nesneleri tanıyıp kategorilere ayıran sistemleri eğitmek için yaygın olarak kullanılır. Yapılandırılmış tasarımı, modellerin görüntüleri doğru şekilde sınıflandırmayı öğrenmesi açısından onu özellikle kullanışlı kılar. İyi belgelenmiş olsa da temel olarak görüntü sınıflandırmaya odaklanır ve nesne algılama gibi görevler için ayrıntılı açıklamalardan yoksundur.
ImageNet'in temel güçlü yönlerinden bazılarına göz atalım:
- Çeşitlilik: 20.000'den fazla kategoriye yayılan görüntüleriyle ImageNet, model eğitimini ve genelleştirmeyi geliştiren geniş ve çeşitli bir veri kümesi sunar.
- Yapılandırılmış organizasyon: Görüntüler, WordNet hiyerarşisi kullanılarak titizlikle kategorilere ayrılır; bu da verilerin verimli şekilde alınmasını ve sistematik model eğitimini kolaylaştırır.
- Kapsamlı dokümantasyon: Geniş kapsamlı araştırmalar ve yıllarca süren çalışmalar, ImageNet'i hem yeni başlayanlar hem de uzmanlar için erişilebilir kılar ve bilgisayarlı görü projeleri için değerli içgörüler ile rehberlik sunar.
Ancak her veri kümesi gibi bunun da sınırlamaları vardır. Dikkate alınması gereken zorluklardan bazıları şunlardır:
- Hesaplama gereksinimleri: Büyük boyutu, sınırlı bilgi işlem kaynaklarına sahip küçük ekipler için zorluk oluşturabilir.
- Zamansal veri eksikliği: Yalnızca statik görüntüler içerdiğinden video veya zamana dayalı veri gerektiren uygulamaların ihtiyaçlarını karşılamayabilir.
- Güncelliğini yitirmiş görüntüler: Veri kümesindeki bazı görüntüler eskidir ve güncel nesneleri, stilleri veya ortamları yansıtmayabilir; bu da modern uygulamalar açısından ilgililiği azaltabilir.
DOTA-v2.0 veri kümesi#
DOTA-v2.0 veri kümesi, DOTA'nın Hava Görüntülerinde Nesne Algılama Veri Kümesi anlamına geldiği, özellikle yönlendirilmiş sınırlayıcı kutu (OBB) nesne algılama için oluşturulmuş kapsamlı bir hava görüntüsü koleksiyonudur. OBB algılamada, görüntüdeki nesnelerin gerçek yönelimiyle daha doğru şekilde hizalanmak için döndürülmüş sınırlayıcı kutular kullanılır. Bu yöntem, nesnelerin genellikle çeşitli açılarda göründüğü hava görüntülerinde özellikle iyi çalışır; böylece daha hassas konumlandırma ve genel olarak daha iyi algılama sağlar.
Bu veri kümesi, 18 nesne kategorisinde 11.000'den fazla görüntü ve 1,7 milyondan fazla yönlendirilmiş sınırlayıcı kutudan oluşur. Görüntüler 800×800 ile 20.000×20.000 piksel arasında değişir ve uçak, gemi ve bina gibi nesneleri içerir.

Şekil 2. DOTA-v2.0 veri kümesinden görüntü ve açıklama örnekleri. Görsel: yazar.
Ayrıntılı açıklamaları sayesinde DOTA-v2.0, uzaktan algılama ve hava gözetimi projeleri için popüler bir seçenek hâline gelmiştir. DOTA-v2.0'ın temel özelliklerinden bazıları şunlardır:
- Çeşitli nesne kategorileri: Araçlar, limanlar ve depolama tankları gibi birçok farklı nesne türünü kapsar ve modelleri çeşitli gerçek dünya nesneleriyle tanıştırır.
- Yüksek kaliteli açıklamalar: Uzman açıklayıcılar, nesne şekillerini ve yönlerini net biçimde gösteren, hassas şekilde yönlendirilmiş sınırlayıcı kutular sağlamıştır.
- Çok ölçekli görüntüler: Veri kümesi farklı boyutlarda görüntüler içerir ve modellerin nesneleri hem küçük hem de büyük ölçeklerde algılamayı öğrenmesine yardımcı olur.
DOTA-v2'nin birçok güçlü yönü olsa da kullanıcıların aklında tutması gereken bazı sınırlamalar şunlardır:
- Ek indirme adımları: DOTA veri kümesinin bakım şekli nedeniyle DOTA-v2.0 ek bir kurulum adımı gerektirir. Veri kümesini tamamlamak için önce DOTA-v1.0 görüntülerini indirmen, ardından DOTA-v2.0 için ek görüntüleri ve güncellenmiş açıklamaları eklemen gerekir.
- Karmaşık açıklamalar: Yönlendirilmiş sınırlayıcı kutuların model eğitimi sırasında işlenmesi ek çaba gerektirebilir.
- Sınırlı kapsam: DOTA-v2 hava görüntüleri için tasarlanmıştır; bu nedenle bu alan dışındaki genel nesne algılama görevlerinde daha az kullanışlıdır.
Roboflow 100 veri kümesi#
Roboflow 100 (RF100) veri kümesi, Intel'in desteğiyle Roboflow tarafından oluşturulmuştur. Nesne algılama modellerinin ne kadar iyi çalıştığını test etmek ve kıyaslamak için kullanılabilir. Bu kıyaslama veri kümesi, 90.000'den fazla herkese açık veri kümesinden seçilen 100 farklı veri kümesini içerir. Sağlık, hava görüntüleri ve oyun gibi alanlardan 224.000'den fazla görüntü ve 800 nesne sınıfına sahiptir.
RF100 kullanmanın temel avantajlarından bazıları şunlardır:
- Geniş alan kapsamı: Tıbbi görüntüleme, hava görüntüleri ve su altı keşfi gibi yedi alandan veri kümeleri içerir.
- Model geliştirmeyi teşvik eder: RF100'deki değişkenlik ve alana özgü zorluklar, mevcut modellerdeki eksikleri ortaya çıkararak araştırmaları daha uyarlanabilir ve sağlam nesne algılama çözümlerine yönlendirir.
- Tutarlı görüntü formatı: Tüm görüntüler 640x640 piksele yeniden boyutlandırılır. Bu, kullanıcıların görüntü boyutlarını ayarlamak zorunda kalmadan modelleri eğitmesine yardımcı olur.
Güçlü yönlerine rağmen RF100'ün akılda tutulması gereken bazı dezavantajları da vardır:
- Görevler açısından sınırlı: RF100 nesne algılama için tasarlanmıştır; bu nedenle bölütleme veya sınıflandırma gibi görevleri destekleyemez.
- Kıyaslama odaklı yaklaşım: RF100, gerçek dünya uygulamaları için model eğitmekten ziyade temel olarak bir kıyaslama aracı olarak tasarlanmıştır; bu nedenle sonuçları pratik dağıtım senaryolarına tam olarak yansımayabilir.
- Açıklama değişkenliği: RF100, kitle kaynaklı veri kümelerini bir araya getirdiğinden açıklama kalitesinde ve etiketleme uygulamalarında tutarsızlıklar olabilir; bu da model değerlendirmesini ve ince ayarını etkileyebilir.
COCO (Bağlam İçindeki Yaygın Nesneler) veri kümesi#
COCO veri kümesi, ayrıntılı görüntü açıklamaları içeren 330.000'den fazla görüntü sunan, en yaygın kullanılan bilgisayarlı görü veri kümelerinden biridir. Nesne algılama, bölütleme ve görüntü açıklama için tasarlanmıştır; bu da onu birçok proje için değerli bir kaynak hâline getirir. Sınırlayıcı kutular ve bölütleme maskeleri dâhil ayrıntılı etiketleri, sistemlerin görüntüleri hassas şekilde analiz etmeyi öğrenmesine yardımcı olur.
Bu veri kümesi esnekliğiyle bilinir ve basit projelerden karmaşık projelere kadar çeşitli görevler için kullanışlıdır. Görü yapay zekâsı alanında bir standart hâline gelmiş ve model performansını değerlendirmek için zorluklarda ve yarışmalarda sıkça kullanılmıştır.
Güçlü yönlerinden bazıları şunlardır:
- Çeşitli ve gerçekçi veriler: Veri kümesi, birden fazla nesne, örtüşme ve değişken aydınlatma koşulları içeren gerçek dünya senaryolarından görüntüler barındırır.
- Güçlü topluluk ve araştırma benimsenmesi: Büyük makine öğrenimi yarışmalarında ve araştırmalarda kullanılan COCO veri kümesi; kapsamlı dokümantasyona, önceden eğitilmiş modellere ve aktif topluluk desteğine sahiptir.
- Zengin ve ayrıntılı açıklamalar: COCO veri kümesi; nesne bölütleme, anahtar noktalar ve açıklamalar dâhil son derece ayrıntılı açıklamalar sunarak hassas görsel anlayış gerektiren projeler için ideal hâle gelir.
Dikkate alınması gereken bazı sınırlayıcı faktörler de şunlardır:
- Yüksek hesaplama gereksinimleri: Boyutu ve karmaşıklığı nedeniyle COCO üzerinde model eğitmek önemli miktarda bilgi işlem kaynağı gerektirebilir; bu da sınırlı donanıma sahip ekipler için zorluk oluşturur.
- Veri dengesizliği: Bazı nesne kategorilerinde diğerlerine kıyasla önemli ölçüde daha fazla görüntü bulunur; bu da model eğitiminde yanlılığa yol açabilir.
- Karmaşık açıklama yapısı: Veri kümesinin ayrıntılı açıklamaları değerli olsa da yapılandırılmış görü yapay zekâ veri kümeleriyle çalışma deneyimi olmayan yeni başlayanlar veya küçük ekipler için bunaltıcı olabilir.
Open Images V7 veri kümesi#
Open Images V7, Google tarafından derlenmiş, 600 nesne kategorisi için açıklamalar içeren 9 milyondan fazla görüntüye sahip devasa bir açık kaynaklı veri kümesidir. Çeşitli açıklama türleri içerir ve karmaşık bilgisayarlı görü görevlerini ele almak için idealdir. Ölçeği ve derinliği, bilgisayarlı görü modellerini eğitmek ve test etmek için kapsamlı bir kaynak sunar.

Şekil 3. Open Images V7 veri kümesine kısa bir bakış. Görsel: yazar.
Ayrıca Open Images V7 veri kümesinin araştırmalardaki popülerliği, kullanıcıların öğrenebileceği çok sayıda kaynak ve örnek sunar. Ancak devasa boyutu, özellikle küçük ekipler için indirme ve işleme süreçlerini zaman alıcı hâle getirebilir. Bir diğer sorun, bazı açıklamaların tutarsız olabilmesi ve verileri temizlemek için ek çaba gerektirmesidir. Entegrasyon da her zaman sorunsuz değildir; bu nedenle ek hazırlık gerekebilir.
Doğru veri kümesini seçme#
Doğru veri kümesini seçmek, bilgisayarlı görü projenin başarıya ulaşması için önemli bir adımdır. En iyi seçim, belirli görevine bağlıdır; iyi bir eşleşme bulmak modelinin doğru becerileri öğrenmesine yardımcı olur. Ayrıca araçlarınla kolayca entegre olmalıdır; böylece sorun gidermeye daha az, modelini oluşturmaya daha fazla odaklanabilirsin.

Şekil 4. Doğru veri kümesini seçme faktörleri. Görsel: yazar.
Önemli çıkarımlar#
Yüksek kaliteli veri kümeleri, her bilgisayarlı görü modelinin temelini oluşturur ve sistemlerin görüntüleri doğru şekilde yorumlamayı öğrenmesine yardımcı olur. Çeşitli ve iyi açıklanmış veri kümeleri özellikle önemlidir; çünkü modellerin gerçek dünya senaryolarında güvenilir performans göstermesini sağlar ve sınırlı veya düşük kaliteli verilerin neden olduğu hataları azaltır.
Ultralytics, bilgisayarlı görü veri kümelerine erişme ve bunlarla çalışma sürecini basitleştirerek projen için doğru verileri bulmanı kolaylaştırır. Doğru veri kümesini seçmek, yüksek performanslı bir model oluşturmanın kritik bir adımıdır ve daha kesin, etkili sonuçlara ulaşmanı sağlar.
Topluluğumuza katıl ve yapay zekâ hakkında daha fazla bilgi edinmek için GitHub depomuzu keşfet. Çözümler sayfalarımızda sağlık hizmetlerinde bilgisayarlı görü ve otonom araçlarda yapay zekâ gibi gelişmeleri keşfet. Lisans seçeneklerimize göz at ve bugün bilgisayarlı görüye başlamak için ilk adımı at!









