Image Recognition
Görüntü tanımanın görsel verileri belirlemek için yapay zekâ ve derin öğrenmeyi nasıl kullandığını öğren. Gerçek dünya uygulamalarını keşfet ve son teknoloji sonuçlar için Ultralytics YOLO26'yı dağıt.
Görüntü tanıma, bilgisayarlı görü (CV) alanının daha geniş kapsamındaki temel bir teknolojidir ve yazılım sistemlerinin dijital görüntülerdeki nesneleri, insanları, yerleri ve metinleri tanımasını sağlar. Bu teknoloji, bir görüntünün veya video karesinin piksel içeriğini analiz ederek insan gözünün ve beyninin görsel algılama yeteneklerini taklit etmeye çalışır. Yapay zekâ (AI) tarafından desteklenen görüntü tanıma, yapılandırılmamış görsel verileri yapılandırılmış ve eyleme geçirilebilir bilgilere dönüştürerek sağlık hizmetlerinden otonom taşımacılığa kadar uzanan sektörlerde otomasyonun temelini oluşturur.
Temel Mekanizmalar ve Teknolojiler#
Modern görüntü tanıma sistemleri, geleneksel kural tabanlı programlamanın ötesine geçerek büyük ölçüde derin öğrenme (DL) algoritmalarına dayanmaktadır. Bu görevlerde kullanılan en yaygın mimari Evrişimli Sinir Ağı (CNN) mimarisidir. Bir CNN, görüntüleri genellikle Kırmızı, Yeşil ve Mavi (RGB) renk kanallarını temsil eden değerlerden oluşan bir ızgara olarak işler ve bunları birden çok matematiksel işlem katmanından geçirir.
Bu süreç sırasında ağ, özellik çıkarma işlemini gerçekleştirir. İlk katmanlar kenarlar veya köşeler gibi basit geometrik desenleri algılarken, daha derin katmanlar bu desenleri bir araya getirerek gözler, tekerlekler veya yapraklar gibi karmaşık yapıları tanır. Yüksek doğruluk elde etmek için bu modeller büyük miktarda etiketli eğitim verisine ihtiyaç duyar. ImageNet gibi büyük ölçekli herkese açık veri kümeleri, modellerin belirli bir görsel düzenlemenin "kedi", "bisiklet" veya "dur işareti" gibi bir kavrama karşılık gelme olasılığını öğrenmesine yardımcı olur.
Tanımayı İlgili Kavramlardan Ayırma#
"Görüntü tanıma" terimi sıklıkla her şeyi kapsayan bir ifade olarak kullanılsa da diğer belirli bilgisayarlı görü görevlerinden farklıdır. Bu ayrımları anlamak, bir proje için doğru modeli seçmek açısından kritik önem taşır:
- Tanıma ve Görüntü Sınıflandırma karşılaştırması: Sınıflandırma, tüm görüntüye tek bir etiket atama görevidir (örneğin, bir resmi "plaj" olarak etiketlemek). Tanıma ise sistemin içeriği anlamasını sağlayan daha geniş kapsamlı yetenektir.
- Tanıma ve Nesne Algılama karşılaştırması: Tanıma bir görüntüde ne olduğunu belirlerken algılama bunun nerede olduğunu belirler. Algılama algoritmaları her nesne örneğinin çevresine bir sınırlayıcı kutu çizer ve onu arka plandan ayırır.
- Tanıma ve Örnek Bölütleme karşılaştırması: Bu yöntem, yalnızca bir kutu belirlemek yerine bir nesnenin tam piksel konturlarını tanımlayarak tanımayı bir adım ileri taşır. Bu, biyomedikal görüntü analizi gibi hassas ölçümler gerektiren uygulamalar için kritik öneme sahiptir.
Gerçek Dünya Uygulamaları#
Görüntü tanımanın faydası, görsel verilerin üretildiği neredeyse her sektöre uzanır.
- Tıbbi Teşhis: Sağlık hizmetlerinde tanıma algoritmaları, röntgen ve MR görüntüleri gibi tıbbi görüntüleri analiz ederek radyologlara yardımcı olur. Radyolojide yapay zekâ gibi araçlar, tümörler veya kırıklar gibi anormallikleri yalnızca insan gözleminden daha hızlı ve bazen daha doğru bir şekilde tespit edebilir.
- Perakende ve Envanter: Akıllı süpermarketler, ürünleri raflardan alındıkça takip etmek ve otomatik ödeme sistemlerini mümkün kılmak için tanıma teknolojisini kullanır. Benzer şekilde, depo robotları da paketleri tanımlamak ve sınıflandırmak için bu teknolojiyi kullanır.
- Güvenlik ve Erişim Kontrolü: Yüz tanıma sistemleri, kimliği kayıtlı yüz gömülerinden oluşan bir veritabanına karşı doğrulayarak akıllı telefonlara ve binalara güvenli erişim sağlar.
Ultralytics YOLO26 ile Görüntü Tanıma Uygulama#
Geliştiriciler ve araştırmacılar için görüntü tanıma uygulamak, yerel olarak sınıflandırma, algılama ve bölütlemeyi destekleyen YOLO26 gibi son teknoloji modeller sayesinde çok daha erişilebilir hâle gelmiştir. Aşağıdaki örnek, ultralytics Python paketi kullanılarak bir görüntü üzerinde tanımanın (özellikle nesne algılamanın) nasıl gerçekleştirileceğini gösterir.
from ultralytics import YOLO
# Load a pre-trained YOLO26 model (n for nano, fastest speed)
model = YOLO("yolo26n.pt")
# Run inference on an image to recognize and locate objects
# The source can be a file path, URL, or webcam (source=0)
results = model("https://ultralytics.com/images/bus.jpg")
# Display the results with bounding boxes and labels
results[0].show()Kendi veri kümelerine açıklama eklemek ve bulutta özel modeller eğitmek isteyen ekipler için Ultralytics Platform, veri toplamadan dağıtıma kadar bir görüntü tanıma projesinin tüm yaşam döngüsünü yönetmek üzere kolaylaştırılmış bir ortam sunar.
Gelecekteki Eğilimler#
İşlem gücü arttıkça görüntü tanıma, sistemlerin kareler arasındaki zamansal bağlamı analiz ettiği video anlama alanına doğru evrilmektedir. Ayrıca üretken yapay zekânın entegrasyonu, sistemlerin görüntüleri yalnızca tanımasını değil, aynı zamanda bunların ayrıntılı metinsel açıklamalarını oluşturmasını da sağlıyor ve Doğal Dil İşleme (NLP) ile görü arasındaki boşluğu kapatıyor.









