Unsupervised Learning
Etiketlenmemiş verilerdeki gizli kalıpları keşfetmek için denetimsiz öğrenmeyi keşfet. Kümeleme, anomali tespiti ve bunun modern yapay zeka çözümlerini nasıl desteklediği hakkında bilgi edin.
Denetimsiz öğrenme, bir algoritmanın insan müdahalesi olmadan etiketlenmemiş verilerden kalıpları öğrendiği bir makine öğrenimi türüdür. Bir modeli eğitmek için etiketli girdi-çıktı çiftlerine dayanan denetimli öğrenmenin aksine, denetimsiz öğrenme geçmiş etiketleri olmayan verilerle ilgilenir. Sistem temel olarak girdi verileri içindeki gizli yapıları, kalıpları veya ilişkileri keşfederek kendi kendine öğretmeye çalışır. Bu yaklaşım, bugün üretilen verilerin büyük çoğunluğu (görüntüler, videolar, metinler ve sensör kayıtları) yapılandırılmamış ve etiketlenmemiş olduğundan özellikle değerlidir.
Denetimsiz Öğrenme Nasıl Çalışır#
Denetimsiz senaryolarda, algoritma verilerdeki ilginç yapıları keşfetmek için kendi haline bırakılır. Amaç genellikle verilerin altında yatan dağılımı modellemek veya verinin kendisi hakkında daha fazla şey öğrenmektir. Eğitim sırasında "doğru cevaplar" sağlanmadığından, model geleneksel anlamda doğruluk açısından değerlendirilemez. Bunun yerine performans, genellikle modelin boyutsallığı ne kadar iyi azalttığına veya benzer veri noktalarını ne kadar iyi gruplandırdığına göre ölçülür.
Bu metodoloji, insanların yeni kavramları genellikle nasıl öğrendiğini yansıtır. Örneğin bir çocuk, "köpek" ve "kedi" adlarını başlangıçta bilmek zorunda kalmadan, farklı şekillerini ve davranışlarını gözlemleyerek köpekler ile kediler arasında ayrım yapabilir. Benzer şekilde denetimsiz algoritmalar da içsel benzerliklere dayanarak bilgileri gruplandırır. Bu yetenek, sistemlerin sürekli insan denetimi olmaksızın yeni ortamlara uyum sağlamasına olanak tanıdığı için yapay genel zeka (AGI) geliştirilmesinin temelini oluşturur.
Denetimsiz Öğrenmedeki Temel Teknikler#
Denetimsiz öğrenme, her biri farklı türdeki veri analizi problemleri için uygun olan birkaç farklı tekniği kapsar:
- Kümeleme: Bu, algoritmanın birbirine benzeyen veri noktalarını gruplandırdığı en yaygın uygulamadır. Popüler bir yöntem, özellikleri arasındaki benzerliğe dayanarak verileri k farklı gruba ayıran K-Means kümeleme yöntemidir. Bu, benzer satın alma davranışlarına sahip müşteri gruplarını belirlemek amacıyla pazar segmentasyonunda yaygın olarak kullanılır.
- Boyut İndirgeme: Yüksek boyutlu veriler karmaşık olabilir ve işlenmeleri hesaplama açısından maliyetli olabilir. Temel Bileşen Analizi (PCA) gibi teknikler, temel bilgilerini korurken bir veri setindeki değişken sayısını azaltır. Bu, veri görselleştirmeyi basitleştirir ve diğer makine öğrenimi modellerinin eğitimini hızlandırır.
- Anomali Tespiti: Denetimsiz modeller, "normal" verilerin neye benzediğini öğrenerek normdan önemli ölçüde sapma gösteren aykırı değerleri belirleyebilir. Bu, olağandışı işlem kalıplarının güvenlik uyarılarını tetiklediği finansta sahtekarlık tespiti için çok önemlidir.
- Birliktelik Kuralı Öğrenme: Bu teknik, büyük veritabanlarındaki değişkenler arasındaki ilginç ilişkileri keşfeder. Pazar sepeti analizi için yaygın olarak kullanılır ve perakendecilerin ekmek satın alan müşterilerin büyük olasılıkla tereyağı da satın alacağını anlamalarına yardımcı olur.
Denetimsiz ve Denetimli Öğrenme Karşılaştırması#
Denetimsiz öğrenmeyi denetimli öğrenmeden ayırmak önemlidir. Temel fark, kullanılan verilerde yatar. Denetimli öğrenme etiketlenmiş bir veri seti gerektirir; yani her eğitim örneği doğru bir çıktı ile eşleştirilir (örn. "kedi" olarak etiketlenmiş bir kedi resmi). Model, hatayı en aza indirmek için girdileri çıktılara eşlemeyi öğrenir.
Buna karşılık denetimsiz öğrenme, etiketlenmemiş verileri kullanır. modele çıktısının doğru olup olmadığını söyleyen bir geri bildirim döngüsü yoktur. Öğrenme doğruluğunu artırmak için az miktarda etiketli veriyi çok miktarda etiketlenmemiş verilerle birleştiren ve genellikle verileri etiketlemenin pahalı veya zaman alıcı olduğu durumlarda kullanılan yarı denetimli öğrenme adı verilen bir orta yol mevcuttur.
Gerçek Dünya Uygulamaları#
Denetimsiz öğrenme, günlük hayatta karşılaştığımız birçok teknolojiye güç verir. İşte iki somut örnek:
-
Perakendede Müşteri Segmentasyonu: E-ticaret platformları, önceden tanımlanmış kategoriler olmadan milyonlarca kullanıcı etkileşimini analiz eder. Kümeleme algoritmalarını kullanarak "hafta sonu indirim avcıları" veya "teknoloji meraklıları" gibi belirgin kullanıcı profillerini tanımlarlar. Bu, son derece kişiselleştirilmiş pazarlama kampanyalarına ve tavsiye sistemlerine olanak tanıyarak müşteri deneyimini önemli ölçüde iyileştirir.
-
Genomik Dizi Analizi: Biyoinformatikte araştırmacılar, genetik verileri analiz etmek için denetimsiz öğrenmeyi kullanırlar. Algoritmalar, farklı popülasyonlar arasında benzer genetik belirteçleri veya mutasyonları bulmak için DNA dizilerini kümelendirir. Bu, her bir gen fonksiyonu hakkında ön bilgiye ihtiyaç duymadan evrimsel ilişkileri anlamaya ve hastalıklara yönelik genetik yatkınlıkları belirlemeye yardımcı olur.
Kod Örneği: Scikit-Learn ile Kümeleme#
Ultralytics YOLO26 öncelikle denetimli bir nesne algılama çerçevesi olsa da, çapa kutusu dağılımlarını analiz etmek veya veri seti özelliklerini kümelemek gibi ön işleme adımlarında genellikle denetimsiz teknikler kullanılır. Aşağıda, temel bir denetimsiz teknik olan K-Means kümeleme işlemini gerçekleştirmek için sklearn kullanan basit bir örnek bulunmaktadır.
import numpy as np
from sklearn.cluster import KMeans
# Generate synthetic data: 10 points with 2 features each
X = np.array([[1, 2], [1, 4], [1, 0], [10, 2], [10, 4], [10, 0]])
# Initialize KMeans with 2 clusters (k=2)
kmeans = KMeans(n_clusters=2, random_state=0, n_init="auto")
# Fit the model to the data (no labels provided!)
kmeans.fit(X)
# Predict which cluster each point belongs to
print(f"Labels: {kmeans.labels_}")
# Output will group the first 3 points together (0) and the last 3 together (1)Derin Öğrenmede Denetimsiz Öğrenmenin Rolü#
Modern derin öğrenme (DL) ilkeleri giderek daha fazla denetimsiz prensiplerle bütünleştirmektedir. Öz Denetimli Öğrenme (SSL) gibi teknikler, modellerin verilerden kendi denetim sinyallerini oluşturmasına olanak tanır. Örneğin Doğal Dil İşleme (NLP) alanında GPT-4 gibi modeller, bir cümledeki bir sonraki kelimeyi tahmin etmek için devasa metin miktarları üzerinde ön eğitilir ve açık etiketler olmadan dilin yapısını etkili bir şekilde öğrenir.
Benzer şekilde bilgisayarlı görüde (CV) verimli veri kodlamalarını öğrenmek için otomatik kodlayıcılar kullanılır. Bu sinir ağları, görüntüleri daha düşük boyutlu bir temsile sıkıştırır ve ardından bunları yeniden oluşturur. Bu süreç, ağa görsel verilerin görüntü gürültüsü giderme ve üretken modelleme gibi görevler için yararlı olan en belirgin özelliklerini öğretir.
Eğitim için veri setlerini yönetmek isteyenler Ultralytics Platform, denetimli eğitim süreci başlamadan önce kümelerin veya anomalilerin belirlenmesine yardımcı olabilecek veri dağılımlarını görselleştirme araçları sunar. Denetimsiz keşif yoluyla verilerinin yapısını anlamak, genellikle sağlam yapay zeka çözümleri oluşturmaya yönelik ilk adımdır.






