XML
XML'in makine öğrenimi ve bilgisayarlı görü için verileri nasıl yapılandırdığını öğren. PASCAL VOC etiketlemelerindeki, tıbbi yapay zekadaki ve Ultralytics YOLO26 eğitimindeki rolünü keşfet.
Genellikle XML olarak anılan Genişletilebilir İşaretleme Dili (Extensible Markup Language), yapılandırılmış verileri depolamak, taşımak ve organize etmek için tasarlanmış esnek, metin tabanlı bir biçimdir. Bilgilerin bir web sayfasında nasıl görüntülendiğine odaklanan HTML'nin aksine XML, özel etiketlerden oluşan hiyerarşik bir yapı aracılığıyla verilerin neyi temsil ettiğini açıklamaya adanmıştır. Bu çok yönlülük, onu çeşitli bilgi işlem sistemleri ve internet genelinde veri değişimi için temel bir standart haline getirir. makine öğrenimi (ML) bağlamında XML; veri setlerini ve yapılandırma dosyalarını yönetmede kritik bir rol oynar, karmaşık bilgilerin hem insanlar hem de makineler tarafından okunabilir kalmasını sağlarken World Wide Web Consortium (W3C) tarafından tanımlanan katı doğrulama standartlarına uyar.
Yapay Zekada XML'in Rolü#
Hızla gelişen yapay zeka (AI) alanında yapılandırılmış veriler, gelişmiş algoritmalar için yakıt görevi görür. XML, mühendislerin görüntüler veya metin gibi ham medyayı zengin, açıklayıcı meta verilerle sarmalamasına olanak tanıyarak veri etiketleme için sağlam bir altyapı sağlar. Bu yapılandırılmış yaklaşım, modellerin kalıpları ve özellikleri tanımlamak için açıkça etiketlenmiş örneklere ihtiyaç duyduğu denetimli öğrenme için esastır.
Modern iş akışları, kesintisiz bulut tabanlı etiketleme ve eğitim için sıklıkla Ultralytics Platform kullanırken, XML eski sistemlerde ve belirli akademik veri setlerinde derinlemesine kök salmaya devam etmektedir. Katı sözdizimi veri bütünlüğünü sağlayarak onu, doğrulamanın çok önemli olduğu kurumsal entegrasyon ve karmaşık bilgisayarlı görü görevleri için tercih edilen bir seçenek haline getirir.
AI/ML'de Gerçek Dünya Uygulamaları#
XML, özellikle veri standardizasyonu, taşınabilirlik ve ayrıntılı meta verilerin kritik gereksinimler olduğu çeşitli pratik uygulamalarda etkilidir.
- Nesne Algılama Veri Setleri (PASCAL VOC): Bilgisayarlı görüde XML'in en kalıcı kullanım alanlarından biri PASCAL Visual Object Classes (VOC) biçimidir. Bu standarda göre, bir veri setindeki her görüntü, etiketleme ayrıntılarını içeren bir XML dosyasıyla eşleştirilir. Bu dosyalar, her nesne için sınırlayıcı kutu koordinatlarını (
xmin,ymin,xmax,ymax) ve sınıf etiketlerini tanımlar. YOLO26 gibi son teknoloji modeller, nesne algılama alanında temel bir süreç olan nesnelerin nasıl konumlandırılacağını öğrenmek için (genellikle dönüştürmeden sonra) bu etiketlemeleri işleyebilir. - Tıbbi Görüntüleme ve Sağlık Hizmetleri: Sağlık sektöründe AI uzmanlık alanında birlikte çalışabilirlik hayati önem taşır. Tıbbi taramalar için evrensel olarak kullanılan Digital Imaging and Communications in Medicine (DICOM) standardı, karmaşık hasta meta verilerini işlemek için sıklıkla XML ile arayüz oluşturur. XML, tanı sonuçlarının ve çalışma parametrelerinin yapılandırılmış bir şekilde raporlanmasına olanak tanıyarak hassas tıbbi görüntü analizi sağlar. Bu, bu veriler üzerinde eğitilen AI modellerinin Health Level Seven (HL7) gibi sağlık verisi standartlarına sıkı sıkıya uymasını sağlar.
XML ve JSON ve YAML Karşılaştırması#
XML güçlü olmasına rağmen, genellikle ML iş akışlarında kullanılan diğer veri serileştirme formatlarıyla karşılaştırılır. Aralarındaki farkları anlamak, iş için doğru aracı seçmeye yardımcı olur.
- XML ve JSON: JavaScript Object Notation (JSON), web uygulamaları için genellikle daha hafiftir ve ayrıştırılması daha kolaydır. JSON, API yanıtları ve birçok modern veri seti (COCO gibi) için standart haline gelmiş olsa da, XML belge merkezli veriler ve şema doğrulaması gerektiren ortamlar için hala tercih edilmektedir. Web veri yapılarına daha derinlemesine bir bakış için Mozilla Developer Network gibi kaynaklar mükemmel karşılaştırmalar sunar.
- XML ve YAML: YAML, etiketler yerine girintiye güvenerek insan tarafından okunabilirliği ve minimum sözdizimi ile bilinir. Bu durum YAML'ı, düzenleme kolaylığının çok önemli olduğu Ultralytics YOLO gibi çerçevelerdeki model YAML yapılandırması dosyaları için tercih edilen seçenek haline getirir. Buna karşılık XML, daha ayrıntılıdır ancak daha güçlü bir yapı yaptırımı sunar.
Model Eğitimi İçin XML Ayrıştırma#
PASCAL VOC formatı ndakiler gibi eski veri setleriyle çalışırken geliştiriciler genellikle eğitim için sınırlayıcı kutu koordinatlarını çıkarmak üzere XML dosyalarını ayrıştırmaya ihtiyaç duyarlar. Python'un yerleşik kütüphaneleri bu süreci kolaylaştırır.
Aşağıdaki örnek, Python ElementTree API kullanarak nesne sınıfı adlarını ve sınırlayıcı kutu koordinatlarını çıkarmak için basit bir XML etiketleme dizesinin nasıl ayrıştırılacağını göstermektedir.
import xml.etree.ElementTree as ET
# Example XML string simulating a PASCAL VOC annotation
voc_xml_data = """
person
50
30
200
400
"""
# Parse the XML structure
root = ET.fromstring(voc_xml_data)
# Extract and print object details
for obj in root.findall("object"):
class_name = obj.find("name").text
bbox = obj.find("bndbox")
# Convert coordinates to integers
coords = [int(bbox.find(tag).text) for tag in ["xmin", "ymin", "xmax", "ymax"]]
print(f"Detected Class: {class_name}, Bounding Box: {coords}")Bu formatların nasıl manipüle edileceğini anlamak, eğitim verisi hazırlamak için esastır. Ultralytics Platform üzerindeki otomatik araçlar bu dönüşümleri yönetebilseെങ്കിലും, manuel ayrıştırma bilgisi hata ayıklama ve özel veri hatları için değerli kalmaya devam eder. Veri yapıları üzerine daha fazla okuma için IBM XML Guide, kurumsal kullanım hakkında kapsamlı bir genel bakış sunar.






