Unsupervised Learning
Etiketlenmemiş verilerdeki gizli örüntüleri keşfetmek için denetimsiz öğrenimi incele. Kümeleme ve anomali tespitini, ayrıca bunların modern yapay zekâ çözümlerini nasıl güçlendirdiğini öğren.
Denetimsiz öğrenme, bir algoritmanın insan müdahalesi olmadan etiketsiz verilerden örüntüler öğrendiği bir makine öğrenimi türüdür. Bir modeli eğitmek için etiketli girdi-çıktı çiftlerine dayanan denetimli öğrenmenin aksine, denetimsiz öğrenme geçmişte oluşturulmuş etiketleri olmayan verilerle çalışır. Sistem, girdi verilerindeki gizli yapıları, örüntüleri veya ilişkileri keşfederek esasen kendi kendine öğrenmeye çalışır. Bu yaklaşım özellikle değerlidir çünkü günümüzde üretilen verilerin büyük çoğunluğu (görüntüler, videolar, metinler ve sensör günlükleri) yapılandırılmamış ve etiketsizdir.
Denetimsiz Öğrenme Nasıl Çalışır?#
Denetimsiz senaryolarda algoritma, verilerdeki ilgi çekici yapıları keşfetmek üzere kendi başına bırakılır. Amaç genellikle verilerin temel dağılımını modellemek veya verilerin kendisi hakkında daha fazla bilgi edinmektir. Eğitim sırasında hiçbir "doğru yanıt" sağlanmadığından model, geleneksel anlamda doğruluk üzerinden değerlendirilemez. Bunun yerine performans çoğunlukla modelin boyutluluğu ne kadar iyi azalttığı veya benzer veri noktalarını ne kadar iyi birlikte kümelediği üzerinden ölçülür.
Bu metodoloji, insanların yeni kavramları öğrenme biçimini yansıtır. Örneğin bir çocuk, başlangıçta "köpek" ve "kedi" adlarını bilmeden, farklı şekillerini ve davranışlarını gözlemleyerek köpeklerle kedileri ayırt edebilir. Benzer şekilde, denetimsiz algoritmalar bilgileri doğuştan gelen benzerliklerine göre gruplandırır. Bu yetenek, sistemlerin sürekli insan denetimi olmadan yeni ortamlara uyum sağlamasına olanak tanıdığı için yapay genel zekânın (AGI) geliştirilmesi açısından temeldir.
Denetimsiz Öğrenmede Temel Teknikler#
Denetimsiz öğrenme, her biri farklı veri analizi problemlerine uygun olan çeşitli farklı teknikleri kapsar:
- Kümeleme: Bu, algoritmanın birbirine benzeyen veri noktalarını gruplandırdığı en yaygın uygulamadır. Popüler bir yöntem olan K-Means kümeleme, özellik benzerliğine göre verileri k farklı gruba ayırır. Bu yöntem, benzer satın alma davranışlarına sahip müşteri gruplarını belirlemek için pazar segmentasyonunda yaygın olarak kullanılır.
- Boyutluluk Azaltma: Yüksek boyutlu verilerin işlenmesi karmaşık ve hesaplama açısından maliyetli olabilir. Temel Bileşen Analizi (PCA) gibi teknikler, temel bilgilerini korurken bir veri kümesindeki değişken sayısını azaltır. Bu, veri görselleştirmeyi basitleştirir ve diğer makine öğrenimi modellerinin eğitimini hızlandırır.
- Anomali Tespiti: Denetimsiz modeller, "normal" verilerin nasıl göründüğünü öğrenerek normalden önemli ölçüde sapan aykırı değerleri belirleyebilir. Bu, olağandışı işlem örüntülerinin güvenlik uyarılarını tetiklediği finansta dolandırıcılık tespiti için kritik öneme sahiptir.
- İlişkilendirme Kuralı Öğrenimi: Bu teknik, büyük veritabanlarındaki değişkenler arasındaki ilgi çekici ilişkileri keşfeder. Özellikle sepet analizi için kullanılır ve perakendecilerin ekmek satın alan müşterilerin tereyağı da satın alma olasılığının yüksek olduğunu anlamasına yardımcı olur.
Denetimsiz ve Denetimli Öğrenme#
Denetimsiz öğrenmeyi denetimli öğrenmeden ayırt etmek önemlidir. Temel fark, kullanılan verilerde yatar. Denetimli öğrenme, her eğitim örneğinin doğru bir çıktıyla eşleştirildiği etiketli bir veri kümesi gerektirir (örneğin, "kedi" olarak etiketlenmiş bir kedi görüntüsü). Model, hatayı en aza indirmek için girdileri çıktılarla eşlemeyi öğrenir.
Buna karşılık denetimsiz öğrenme etiketsiz verileri kullanır. Modele çıktısının doğru olup olmadığını bildiren bir geri bildirim döngüsü yoktur. Yarı denetimli öğrenme adı verilen bir orta yol bulunur; bu yaklaşım, öğrenme doğruluğunu artırmak için az miktarda etiketli veriyi büyük miktarda etiketsiz veriyle birleştirir ve genellikle verileri etiketlemenin pahalı veya zaman alıcı olduğu durumlarda kullanılır.
Gerçek Dünya Uygulamaları#
Denetimsiz öğrenme, günlük hayatta karşılaştığımız birçok teknolojiye güç verir. İşte iki somut örnek:
-
Perakendede Müşteri Segmentasyonu: E-ticaret platformları, önceden tanımlanmış kategoriler olmadan milyonlarca kullanıcı etkileşimini analiz eder. Kümeleme algoritmalarını kullanarak "hafta sonu fırsat avcıları" veya "teknoloji meraklıları" gibi farklı kullanıcı profillerini belirlerler. Bu, son derece kişiselleştirilmiş pazarlama kampanyalarına ve öneri sistemlerine olanak tanıyarak müşteri deneyimini önemli ölçüde iyileştirir.
-
Genomik Dizi Analizi: Biyoinformatikte araştırmacılar, genetik verileri analiz etmek için denetimsiz öğrenmeyi kullanır. Algoritmalar, farklı popülasyonlardaki benzer genetik belirteçleri veya mutasyonları bulmak için DNA dizilerini kümeler. Bu, her bir genin özel işlevi hakkında önceden bilgi sahibi olmadan evrimsel ilişkilerin anlaşılmasına ve hastalıklara yönelik genetik yatkınlıkların belirlenmesine yardımcı olur.
Kod Örneği: Scikit-Learn ile Kümeleme#
Ultralytics YOLO26 öncelikle denetimli bir nesne tespit çerçevesi olsa da, bağlantı kutusu dağılımlarını analiz etmek veya veri kümesi özelliklerini kümelemek gibi ön işleme adımlarında denetimsiz teknikler sıklıkla kullanılır. Aşağıda, temel bir denetimsiz teknik olan K-Means kümelemesini gerçekleştirmek için sklearn kullanan basit bir örnek verilmiştir.
import numpy as np
from sklearn.cluster import KMeans
# Generate synthetic data: 10 points with 2 features each
X = np.array([[1, 2], [1, 4], [1, 0], [10, 2], [10, 4], [10, 0]])
# Initialize KMeans with 2 clusters (k=2)
kmeans = KMeans(n_clusters=2, random_state=0, n_init="auto")
# Fit the model to the data (no labels provided!)
kmeans.fit(X)
# Predict which cluster each point belongs to
print(f"Labels: {kmeans.labels_}")
# Output will group the first 3 points together (0) and the last 3 together (1)Derin Öğrenmede Denetimsiz Öğrenmenin Rolü#
Modern derin öğrenme (DL), denetimsiz ilkeleri giderek daha fazla entegre etmektedir. Öz denetimli öğrenme (SSL) gibi teknikler, modellerin kendi denetim sinyallerini verilerden üretmesine olanak tanır. Örneğin Doğal Dil İşlemede (NLP) GPT-4 gibi modeller, bir cümledeki sonraki kelimeyi tahmin etmek üzere çok büyük miktarda metinle önceden eğitilir ve açık etiketler olmadan dilin yapısını etkili bir şekilde öğrenir.
Benzer şekilde bilgisayarlı görüde (CV) otomatik kodlayıcılar, verimli veri kodlamalarını öğrenmek için kullanılır. Bu sinir ağları, görüntüleri daha düşük boyutlu bir temsile sıkıştırır ve ardından yeniden yapılandırır. Bu süreç, ağa görsel verilerin en belirgin özelliklerini öğretir; bu da görüntü gürültü giderme ve üretici modelleme gibi görevler için yararlıdır.
Eğitim için veri kümelerini yönetmek isteyenler için Ultralytics Platform, veri dağılımlarını görselleştirmeye yönelik araçlar sunar; bu araçlar, denetimli eğitim süreci başlamadan önce kümelerin veya anomalilerin belirlenmesine yardımcı olabilir. Verilerinin yapısını denetimsiz keşif yoluyla anlamak, çoğu zaman sağlam AI çözümleri oluşturmanın ilk adımıdır.









