Accuracy
Yapay zekâda doğruluğun temellerini keşfet. Performansı nasıl değerlendireceğini, doğruluk paradoksundan nasıl kaçınacağını ve sonuçları Ultralytics YOLO26 kullanarak nasıl ölçeceğini öğren.
Doğruluk, yapay zekâ sistemlerinin değerlendirilmesinde temel bir ölçüt olarak hizmet eder ve bir modelin yaptığı doğru tahminlerin toplam tahmin sayısına oranla yüzdesini nicelendirir. Makine öğrenimi ve özellikle denetimli öğrenme bağlamında bu metrik, bir algoritmanın eğitim sürecinde sağlanan gerçek değerlerle ne kadar etkili biçimde örtüştüğüne dair üst düzey bir görünüm sunar. Performansın en sezgisel ölçüsü olan doğruluk, “Model ne sıklıkla doğru sonuç veriyor?” şeklindeki basit soruyu yanıtlar ve geliştiriciler daha ayrıntılı metriklere geçmeden önce bir sistemin güvenilirliğinin temel göstergesi olarak işlev görür.
Performansı Değerlendirmenin İncelikleri#
Doğruluk mükemmel bir başlangıç noktası olsa da tüm sınıfların eşit şekilde temsil edildiği dengeli eğitim verilerine uygulandığında en etkilidir. Örneğin, kediler ile köpekleri ayırt eden standart bir görüntü sınıflandırma görevinde veri kümesi her birinden 500 görüntü içeriyorsa doğruluk güvenilir bir metriktir. Ancak dengesiz veri kümeleri ile ilgili zorluklar ortaya çıkar ve bu durum “doğruluk paradoksuna” yol açar.
Bir model, işlemlerin yalnızca %1'inin sahte olduğu bir sahtekârlık tespiti görevi için eğitilirse her işlemi “meşru” olarak tahmin eden bir model, amaçlanan görevinde tamamen başarısız olmasına rağmen %99 doğruluk elde eder. Bunu azaltmak için mühendisler, veri kümesi dağılımını görselleştirmek ve modellerin çoğunluk sınıfını basitçe ezberlemediğinden emin olmak amacıyla genellikle Ultralytics Platform kullanır.
Doğruluğu İlişkili Terimlerden Ayırt Etme#
Model performansını tam olarak anlamak için doğruluğu benzer metriklerden ayırt etmek çok önemlidir:
- Kesinlik: Pozitif tahminlerin kalitesini ölçer. “Pozitif olarak tahmin edilen tüm örneklerin kaçı gerçekten pozitifti?” sorusunu yanıtlar.
- Duyarlılık: Sensitivite olarak da bilinen bu metrik, modelin ilgili tüm durumları bulma becerisini ölçer. “Gerçek pozitif örneklerin tümünün kaçını model doğru şekilde belirledi?” sorusunu yanıtlar.
- F1-Skoru: Kesinlik ve duyarlılığın harmonik ortalamasıdır ve özellikle sınıf dağılımlarının dengesiz olduğu durumlarda yararlı olan, bu ikisini dengeleyen tek bir skor sağlar.
Doğruluk genel bir doğru tahmin görünümü sunarken kesinlik ve duyarlılık, yanlış pozitifler veya yanlış negatifler gibi belirli hata türleri hakkında bilgi sağlar.
Gerçek Dünya Uygulamaları#
Doğruluğun faydası, kritik ortamlarda bilgisayarlı görü ve tahmine dayalı modellerin güvenilirliğini doğrulayarak çeşitli sektörlere uzanır.
- Tıbbi Tanı: Tıbbi görüntü analizi alanında modeller, X-ray veya MRI taramalarını sınıflandırmak için kullanılır. Taramaları “sağlıklı” veya “patolojik” olarak sınıflandıran bir model, hastaların doğru tanı almasını sağlamak için yüksek doğruluğa ihtiyaç duyar. Sağlık hizmetlerinde yapay zekâ alanındaki yenilikler, otomatik hataları en aza indirmek için büyük ölçüde titiz doğrulamaya dayanır.
- Üretimde Kalite Kontrolü: Akıllı üretim alanındaki otomatik sistemler, üretim hatlarındaki kusurları belirlemek için görsel denetim kullanır. Yüksek doğruluk, yalnızca kusursuz ürünlerin sevk edilmesini sağlayarak israfı ve garanti maliyetlerini azaltır. Fabrikalar kusurları tespit etmek için nesne algılama kullanarak üretim standartlarını otomatik olarak korur.
Kodda Doğruluğu Ölçme#
Python kullanılan pratik senaryolarda geliştiriciler, yerleşik kütüphaneleri kullanarak bir modelin doğruluğunu kolayca ölçebilir. Aşağıdaki örnek, en iyi 1 doğruluğunu elde etmek üzere bir YOLO26 sınıflandırma modelinin nasıl doğrulanacağını gösterir. En iyi 1 doğruluğu, modelin en yüksek olasılıklı tahmininin doğru etiketle eşleşme sıklığını ifade eder.
from ultralytics import YOLO
# Load a pre-trained YOLO26 classification model
model = YOLO("yolo26n-cls.pt")
# Validate the model on a standard dataset (e.g., MNIST)
metrics = model.val(data="mnist")
# Print the Top-1 Accuracy
print(f"Top-1 Accuracy: {metrics.top1:.4f}")İyileştirme Stratejileri#
Bir model düşük doğruluktan muzdarip olduğunda performansı artırmak için çeşitli teknikler uygulanabilir. Mühendisler, modelin aşırı öğrenmesini önlemek amacıyla eğitim kümesinin çeşitliliğini yapay olarak artırmak için genellikle veri artırma kullanır. Ayrıca hiperparametre ayarı—öğrenme oranı gibi ayarların değiştirilmesi—yakınsamayı önemli ölçüde etkileyebilir. Karmaşık görevlerde aktarım öğrenmesi, daha küçük ve belirli bir veri kümesinde daha yüksek doğruluk elde etmek için modelin büyük, önceden eğitilmiş bir veri kümesinden (örneğin ImageNet) yararlanmasını sağlar.









