Support Vector Machine (SVM)
Support Vector Machines (SVM) modellerini keşfet. Optimal hiper düzlemler, çekirdek numarası (kernel trick) hakkında bilgi edin ve SVM'lerin Ultralytics YOLO26 gibi modern modellerle nasıl kıyaslandığını öğren.
Destek Vektör Makinesi (SVM), sınıflandırma ve regresyon zorlukları için yaygın olarak kullanılan güçlü ve çok yönlü bir denetimli öğrenme algoritmasıdır. Basitçe eğitim hatalarını en aza indirmeyi amaçlayan birçok algoritmanın aksine, bir SVM, veri noktalarını ayrı sınıflara en iyi şekilde ayıran hiper düzlem adı verilen optimal sınırı bulmaya odaklanır. Birincil amaç, bu karar sınırı ile her kategoriden en yakın veri noktaları arasındaki mesafe olan marjini maksimize etmektir. Model, mümkün olan en geniş ayrımına öncelik vererek yeni, görülmemiş veriler üzerinde daha iyi genelleme elde eder ve standart doğrusal regresyon gibi daha basit yöntemlere kıyasla aşırı öğrenme riskini etkili bir şekilde azaltır.
Temel Mekanizmalar ve Kavramlar#
SVM'lerin nasıl çalıştığını anlamak için, her boyutun belirli bir özelliği temsil ettiği çok boyutlu bir uzayda çizilen verileri görselleştirmek yardımcı olur. Algoritma, gruplar arasındaki en etkili ayrımı keşfetmek için bu uzayda gezinir.
- Optimal Hiper Düzlem: Merkezi amaç, girdi uzayını bölen düz bir düzlem (veya daha yüksek boyutlarda hiper düzlem) tanımlamaktır. Basit bir 2D veri kümesinde bu bir çizgi olarak görünür; 3D'de ise düz bir yüzey haline gelir. Optimal hiper düzlem, herhangi bir sınıfın en yakın veri noktalarından mümkün olan en büyük mesafeyi koruyan ve net bir ayrım sağlayan düzlemdir.
- Destek Vektörleri: Bunlar, karar sınırına en yakın duran kritik veri noktalarıdır. Hiper düzlemin konumunu ve yönelimini etkili bir şekilde destekledikleri veya tanımladıkları için "destek vektörleri" olarak adlandırılırlar. Diğer veri noktalarını değiştirmek veya kaldırmak genellikle model üzerinde hiçbir etki yaratmaz, ancak bir destek vektörünü taşımak sınırı önemli ölçüde kaydırır. Bu kavram, Scikit-learn SVM kılavuzu içinde ayrıntılı olarak açıklandığı gibi, SVM'lerin verimliliğinin merkezinde yer alır.
- Çekirdek Hilesi: Karmaşık doğal dil işleme (NLP) veri kümeleri gibi gerçek dünya verileri neredeyse hiç doğrusal olarak ayrılamaz. SVM'ler, verileri doğrusal bir ayırıcının sınıfları etkili bir şekilde bölebileceği daha yüksek boyutlu bir uzaya yansıtan "çekirdek hilesi" adı verilen bir teknik kullanarak bu sınırlamayı ele alır. Yaygın çekirdekler, modelin karmaşık, doğrusal olmayan ilişkileri yakalamasına olanak tanıyan Radyal Tabanlı Fonksiyonu (RBF) ve polinom çekirdekleri içerir.
SVM ve İlgili Algoritmaların Karşılaştırılması#
SVM'leri diğer makine öğrenimi tekniklerinden ayırt etmek, uygulayıcıların tahmine dayalı modelleme projeleri için doğru araçları seçmesine yardımcı olur.
- Lojistik Regresyon: İkisi de doğrusal sınıflandırıcıdır, ancak optimizasyon hedefleri önemli ölçüde farklılık gösterir. Lojistik Regresyon olasılıksaldır ve gözlemlenen verilerin olasılığını maksimize ederken, SVM ise geometriktir ve sınıflar arasındaki marjini maksimize eder. SVM'ler iyi ayrılmış sınıflarda daha iyi performans gösterme eğilimindeyken, Lojistik Regresyon kalibre edilmiş olasılık çıktıları sunar.
- K-En Yakın Komşu (KNN): KNN, bir noktayı komşularının çoğunluk sınıfına göre sınıflandıran parametrik olmayan, örnek tabanlı bir öğrenicidir. Buna karşılık, SVM küresel bir sınır öğrenen parametrik bir modeldir. SVM'ler, çalışma zamanında tüm veri kümesini saklamak ve aramak zorunda olmadıklarından, eğitildikten sonra genellikle daha hızlı çıkarım gecikmesi sunar.
- Karar Ağaçları: Bir karar ağacı, hiyerarşik kurallar kullanarak veri uzayını dikdörtgen bölgelere ayırır. SVM'ler çekirdekler aracılığıyla karmaşık, kavisli karar sınırları oluşturabilir; karar ağaçları ise aşırı derinleşmeden ve aşırı öğrenmeye eğilimli hale gelmeden bunu taklit etmekte zorlanabilir.
- Modern Derin Öğrenme (örn. YOLO26): SVM'ler genellikle uzmanların ilgili girdileri seçtiği manuel öznitelik mühendisliğine dayanır. Ultralytics YOLO26 gibi gelişmiş modeller, doğrudan ham görüntülerden otomatik öznitelik çıkarımı konusunda mükemmeldir ve onları gerçek zamanlı nesne algılama ve örnek bölütleme gibi karmaşık algısal görevler için çok daha üstün kılar.
Gerçek Dünya Uygulamaları#
Destek Vektör Makineleri, doğrulukları ve yüksek boyutlu verileri işleme yetenekleri nedeniyle çeşitli endüstrilerde son derece geçerli olmaya devam etmektedir.
- Biyoenformatik: SVM'ler protein yapısı tahmini ve gen sınıflandırması için yaygın olarak kullanılmaktadır. Karmaşık biyolojik dizileri analiz ederek araştırmacılar, erken teşhise ve kişiselleştirilmiş tıbba yardımcı olan belirli hastalıklarla ilgili kalıpları belirleyebilir.
- Metin Kategorizasyonu: Metin özetleme ve istenmeyen posta filtreleme alanında SVM'ler, metin vektörlerinin yüksek boyutluluğunu yönetmede mükemmeldir. E-postaları "istenmeyen posta" veya "istenmeyen posta değil" olarak etkili bir şekilde sınıflandırabilir ve haber makalelerini konuya göre yüksek hassasiyetle kategorize edebilirler.
Uygulama Örneği#
Modern bilgisayarlı görü görevleri genellikle Ultralytics YOLO26 gibi uçtan uca modelleri kullansa da SVM'ler, bu modellerden çıkarılan özellikleri sınıflandırmak için hâlâ güçlüdür. Örneğin, nesneleri tespit etmek ve özelliklerini çıkarmak için bir YOLO modeli kullanılabilir, ardından özel bir görev için bu belirli özellik vektörlerini sınıflandırmak üzere bir SVM eğitilebilir.
Aşağıda, sentetik veriler üzerinde basit bir sınıflandırıcı eğitmek için popüler scikit-learn kütüphanesini kullanan kısa bir örnek verilmiştir.
from sklearn import svm
from sklearn.datasets import make_classification
from sklearn.model_selection import train_test_split
# Generate synthetic classification data
X, y = make_classification(n_features=4, random_state=0)
X_train, X_test, y_train, y_test = train_test_split(X, y, random_state=0)
# Initialize and train the Support Vector Classifier
clf = svm.SVC(kernel="linear", C=1.0)
clf.fit(X_train, y_train)
# Display the accuracy on the test set
print(f"Accuracy: {clf.score(X_test, y_test):.2f}")Daha büyük veri kümelerini yönetmek veya SVM iş akışlarının yerini alabilecek ya da bunları artırabilecek derin öğrenme modelleri eğitmek isteyen ekipler için Ultralytics Platform, kesintisiz veri etiketleme ve model dağıtımı için araçlar sağlar. Matematiksel temellerle ilgilenenler, SVM'lerin gürültülü gerçek dünya verilerini etkili bir şekilde ele almasına olanak tanıyan yumuşak marjin optimizasyonunu ayrıntılı olarak açıklayan Cortes ve Vapnik (1995) orijinal makalesine başvurabilir.






