AI Safety
Hizalama ve sağlamlık da dâhil olmak üzere yapay zekâ güvenliğinin temel sütunlarını öğren. Ultralytics YOLO26 ile güvenilir modeller dağıtmayı ve yapay zekâ güvenilirliğini sağlamayı keşfet.
Yapay Zekâ Güvenliği, Yapay Zekâ (AI) sistemlerinin güvenilir, öngörülebilir ve faydalı şekilde çalışmasını sağlamaya odaklanan disiplinler arası bir alandır. Sistemleri dış saldırılara karşı koruyan siber güvenliğin aksine Yapay Zekâ Güvenliği, sistemin tasarımında ve işletiminde bulunan riskleri ele alır. Buna hedef uyumsuzluğundan kaynaklanan istenmeyen sonuçların, yeni ortamlarda dayanıklılık eksikliğinin veya Derin Öğrenme (DL) genelleştirmesindeki hataların önlenmesi dahildir. Modeller daha otonom hâle geldikçe Center for Human-Compatible AI gibi kuruluşlardaki araştırmacılar, bu teknolojilerin insan niyetiyle ve güvenlik standartlarıyla uyumlu olmasını sağlamaya çalışır.
Güvenli Yapay Zekânın Temel İlkeleri#
Güvenli bir sistem oluşturmak, basit doğruluk ölçümlerinin ötesine geçen çeşitli teknik zorlukların ele alınmasını gerektirir. Bu ilkeler, Makine Öğrenimi (ML) modellerinin karmaşık, gerçek dünya senaryolarında kullanıma sunulduğunda bile kontrol altında kalmasını sağlar.
- Dayanıklılık: Güvenli bir model, bozulmuş girdilerle veya ortamdaki değişikliklerle karşılaştığında performansını korumalıdır. Buna, girdi verilerindeki küçük değişikliklerin bir modeli yüksek güvenle hatalar yapmaya yönlendirebildiği adversarial saldırılara karşı savunma da dahildir.
- Uyum: Bu ilke, bir yapay zekânın hedeflerinin tasarımcının gerçek niyetiyle örtüşmesini sağlar. Uyumsuzluk, bir sistem ödül işlevini "istismar etmeyi" öğrendiğinde Pekiştirmeli Öğrenme sırasında sıkça ortaya çıkar; örneğin bir temizlik robotu, ortalığı daha hızlı temizlemek için bir vazoyu kırabilir. Bunu azaltmak için İnsan Geri Bildiriminden Pekiştirmeli Öğrenme (RLHF) gibi teknikler kullanılır.
- Yorumlanabilirlik: Açıklanabilir Yapay Zekâ (XAI) olarak da bilinen bu yaklaşım, "kara kutu" modellerinde şeffaflık oluşturmayı içerir. Öznitelik haritalarını görselleştirmek, mühendislerin karar verme sürecini anlamasını ve modelin sahte korelasyonlara dayanmamasını sağlar.
- İzleme: Sürekli model izleme, veri kaymasını tespit etmek için gereklidir. Gerçek dünya verileri eğitim verilerinden önemli ölçüde sapmaya başlarsa güvenlik protokolleri uyarıları veya geri dönüş mekanizmalarını tetiklemelidir.
Gerçek Dünya Uygulamaları#
Yapay Zekâ Güvenliği, algoritmik bir hatanın fiziksel zarara veya önemli ekonomik kayıplara yol açabileceği yüksek riskli alanlarda büyük önem taşır.
-
Otonom Araçlar: Otomotivde yapay zekâ alanında güvenlik çerçeveleri, bir aracın belirsizliğe nasıl tepki vereceğini tanımlar. Bir nesne algılama modeli bir engeli yüksek güven düzeyiyle tanımlayamazsa sistem tahminde bulunmak yerine fren yapmak gibi güvenli bir duruma geçmelidir. NHTSA Automated Vehicles yönergeleri bu güvenli arıza mekanizmalarını vurgular.
-
Tıbbi Tanı: Sağlık hizmetlerinde yapay zekâ uygulanırken güvenlik, kritik tanılarda yanlış negatifleri en aza indirmeyi içerir. Hiçbir olası durumun gözden kaçırılmamasını sağlamak için sistemler genellikle yüksek geri çağırma değerine göre ayarlanır ve doktorlar için fiilen bir "ikinci görüş" işlevi görür. FDA Digital Health Center gibi düzenleyici kurumlar, tıbbi cihaz olarak yazılım (SaMD) için sıkı standartlar belirler.
Güvenlik Eşiklerini Uygulama#
Bilgisayarlı görüdeki en temel güvenlik mekanizmalarından biri, güven eşiklerinin kullanılmasıdır. Geliştiriciler, çıkarım sırasında düşük olasılıklı tahminleri filtreleyerek sistemlerin zayıf bilgilere dayanarak hareket etmesini önler.
Aşağıdaki örnek, yalnızca güvenilir algılamaların işlenmesini sağlamak için Ultralytics YOLO26 kullanarak bir güvenlik filtresinin nasıl uygulanacağını gösterir.
from ultralytics import YOLO
# Load the YOLO26 model (latest standard for efficiency)
model = YOLO("yolo26n.pt")
# Run inference with a strict confidence threshold of 0.7 (70%)
# This acts as a safety gate to ignore uncertain predictions
results = model.predict("https://ultralytics.com/images/bus.jpg", conf=0.7)
# Verify detections meet safety criteria
print(f"Safety Check: {len(results[0].boxes)} objects detected with >70% confidence.")Yapay Zekâ Güvenliği ve Yapay Zekâ Etiği#
Bu terimler çoğu zaman birbirinin yerine kullanılsa da sorumlu yapay zekânın farklı yönlerini ele alır.
- Yapay Zekâ Güvenliği, teknik bir mühendislik disiplinidir. Şu soruyu sorar: "Bu sistem kazalara yol açmadan doğru şekilde çalışacak mı?" Model halüsinasyonu ve pekiştirmeli öğrenmede güvenli keşif gibi sorunlarla ilgilenir.
- Yapay Zekâ Etiği, sosyoteknik bir çerçevedir. Şu soruları sorar: "Bu sistemi geliştirmeli miyiz ve sistem adil mi?" Algoritmik önyargı, gizlilik hakları ve faydaların adil dağıtımı gibi konulara, AB Yapay Zekâ Yasası kapsamında odaklanır.
Geleceğe Bakış#
Sektör Yapay Genel Zekâ (AGI) yönünde ilerledikçe güvenlik araştırmaları giderek daha kritik hâle geliyor. Kuruluşlar, veri kümelerini yönetmek ve model dağıtımını denetlemek için Ultralytics Platformu'ndan yararlanabilir; böylece yapay zekâ çözümlerinin yaşam döngüleri boyunca dayanıklı, şeffaf ve güvenlik standartlarıyla uyumlu kalmasını sağlayabilir.









