Support Vector Machine (SVM)
Destek Vektör Makinelerini (SVM) keşfet. Optimal hiper düzlemler, çekirdek hilesi ve SVM'lerin Ultralytics YOLO26 gibi modern modellerle karşılaştırılması hakkında bilgi edin.
Destek Vektör Makinesi (SVM), sınıflandırma ve regresyon problemlerinde yaygın olarak kullanılan, sağlam ve çok yönlü bir denetimli öğrenme algoritmasıdır. Eğitim hatalarını en aza indirmeyi amaçlayan birçok algoritmanın aksine SVM, veri noktalarını farklı sınıflara en iyi şekilde ayıran ve hiper düzlem adı verilen optimal sınırı bulmaya odaklanır. Temel amaç, bu karar sınırı ile her kategorideki en yakın veri noktaları arasındaki mesafe olan marjı en üst düzeye çıkarmaktır. Model, mümkün olan en geniş ayrımı önceliklendirerek yeni ve daha önce görülmemiş verilerde daha iyi genelleme yapar ve standart doğrusal regresyon gibi daha basit yöntemlere kıyasla aşırı öğrenme riskini etkili şekilde azaltır.
Temel Mekanizmalar ve Kavramlar#
SVM'lerin nasıl çalıştığını anlamak için her boyutun belirli bir özelliği temsil ettiği çok boyutlu bir uzayda görselleştirilmiş verileri incelemek yararlıdır. Algoritma, gruplar arasındaki en etkili ayrımı keşfetmek için bu uzayda gezinir.
- Optimal Hiper Düzlem: Temel amaç, girdi uzayını bölen düz bir düzlem (veya daha yüksek boyutlarda hiper düzlem) belirlemektir. Basit bir 2B veri kümesinde bu bir doğru, 3B'de ise düz bir yüzey olarak görünür. Optimal hiper düzlem, herhangi bir sınıfa ait en yakın veri noktalarından mümkün olan en büyük uzaklığı koruyan ve net bir ayrım sağlayan düzlemdir.
- Destek Vektörleri: Bunlar karar sınırına en yakın konumda bulunan kritik veri noktalarıdır. Hiper düzlemin konumunu ve yönelimini etkili şekilde destekledikleri veya belirledikleri için "destek vektörleri" olarak adlandırılırlar. Diğer veri noktalarını değiştirmek veya kaldırmak çoğu zaman model üzerinde bir etki oluşturmazken bir destek vektörünü hareket ettirmek sınırı önemli ölçüde değiştirir. Bu kavram, Scikit-learn SVM kılavuzunda ayrıntılı şekilde açıklandığı üzere SVM'lerin verimliliğinin temelini oluşturur.
- Çekirdek Hilesi: Karmaşık doğal dil işleme (NLP) veri kümeleri gibi gerçek dünya verileri nadiren doğrusal olarak ayrılabilir. SVM'ler bu sınırlamayı, verileri doğrusal bir ayırıcının sınıfları etkili şekilde bölebileceği daha yüksek boyutlu bir uzaya yansıtan "çekirdek hilesi" adlı bir teknikle ele alır. Yaygın çekirdekler arasında Radyal Taban Fonksiyonu (RBF) ve polinom çekirdekleri bulunur; bunlar modelin karmaşık, doğrusal olmayan ilişkileri yakalamasını sağlar.
SVM ve İlgili Algoritmaların Karşılaştırması#
SVM'leri diğer makine öğrenimi tekniklerinden ayırt etmek, uygulayıcıların tahmine dayalı modelleme projeleri için doğru aracı seçmesine yardımcı olur.
- Lojistik Regresyon: Her ikisi de doğrusal sınıflandırıcıdır, ancak optimizasyon hedefleri önemli ölçüde farklıdır. Lojistik Regresyon olasılıksaldır ve gözlemlenen verilerin olabilirliğini en üst düzeye çıkarırken SVM geometriktir ve sınıflar arasındaki marjı en üst düzeye çıkarır. SVM'ler iyi ayrılmış sınıflarda genellikle daha iyi performans gösterirken Lojistik Regresyon kalibre edilmiş olasılık çıktıları sunar.
- K-En Yakın Komşu (KNN): KNN, bir noktayı komşularının çoğunluk sınıfına göre sınıflandıran parametrik olmayan, örnek tabanlı bir öğrenicidir. Buna karşılık SVM, global bir sınır öğrenen parametrik bir modeldir. SVM'ler, çalışma zamanında tüm veri kümesini depolayıp aramaları gerekmediğinden, eğitimden sonra genellikle daha hızlı çıkarım gecikmesi sunar.
- Karar Ağaçları: Karar ağacı, hiyerarşik kurallar kullanarak veri uzayını dikdörtgen bölgelere ayırır. SVM'ler çekirdekler aracılığıyla karmaşık, eğri karar sınırları oluşturabilir; karar ağaçları ise aşırı derinleşmeden ve aşırı öğrenmeye yatkın hâle gelmeden bu sınırları yaklaşık olarak modellemekte zorlanabilir.
- Modern Derin Öğrenme (ör. YOLO26): SVM'ler genellikle uzmanların ilgili girdileri seçtiği manuel özellik mühendisliğine dayanır. Ultralytics YOLO26 gibi gelişmiş modeller, ham görüntülerden doğrudan otomatik özellik çıkarma konusunda başarılıdır; bu da onları gerçek zamanlı nesne algılama ve örnek bölütleme gibi karmaşık algısal görevlerde çok daha üstün kılar.
Gerçek Dünya Uygulamaları#
Destek Vektör Makineleri, doğrulukları ve yüksek boyutlu verileri işleyebilme yetenekleri sayesinde çeşitli sektörlerde önemini korumaktadır.
- Biyoinformatik: SVM'ler protein yapısı tahmini ve gen sınıflandırması için yaygın olarak kullanılır. Araştırmacılar, karmaşık biyolojik dizileri analiz ederek belirli hastalıklarla ilişkili örüntüleri belirleyebilir ve böylece erken tanı ile kişiselleştirilmiş tıbba katkı sağlayabilir.
- Metin Kategorilendirme: Metin özetleme ve spam filtreleme alanlarında SVM'ler, metin vektörlerinin yüksek boyutluluğunu yönetmede başarılıdır. E-postaları etkili şekilde "spam" veya "spam değil" olarak sınıflandırabilir ve haber makalelerini konuya göre yüksek hassasiyetle kategorilere ayırabilirler.
Uygulama Örneği#
Modern bilgisayarlı görü görevlerinde genellikle Ultralytics YOLO26 gibi uçtan uca modeller kullanılsa da SVM'ler, bu modellerden çıkarılan özellikleri sınıflandırmak için hâlâ güçlüdür. Örneğin nesneleri algılamak ve özelliklerini çıkarmak için bir YOLO modeli kullanılabilir; ardından özel bir görev için bu belirli özellik vektörlerini sınıflandırmak üzere bir SVM eğitilebilir.
Aşağıda, sentetik veriler üzerinde basit bir sınıflandırıcı eğitmek için popüler scikit-learn kitaplığını kullanan kısa bir örnek verilmiştir.
from sklearn import svm
from sklearn.datasets import make_classification
from sklearn.model_selection import train_test_split
# Generate synthetic classification data
X, y = make_classification(n_features=4, random_state=0)
X_train, X_test, y_train, y_test = train_test_split(X, y, random_state=0)
# Initialize and train the Support Vector Classifier
clf = svm.SVC(kernel="linear", C=1.0)
clf.fit(X_train, y_train)
# Display the accuracy on the test set
print(f"Accuracy: {clf.score(X_test, y_test):.2f}")Daha büyük veri kümelerini yönetmek veya SVM iş akışlarının yerine geçebilecek ya da bunları destekleyebilecek derin öğrenme modelleri eğitmek isteyen ekipler için Ultralytics Platformu, sorunsuz veri etiketleme ve model dağıtımı araçları sunar. Matematiksel temellerle ilgilenenler, SVM'lerin gürültülü gerçek dünya verilerini etkili şekilde işlemesini sağlayan yumuşak marj optimizasyonunu ayrıntılı olarak açıklayan Cortes ve Vapnik'in (1995) özgün makalesine başvurabilir.









