Apple silicon çipli iOS uygulamaları için en iyi nesne tespit modelleri
En iyi nesne tespit modelleriyle daha akıllı iOS uygulamaları oluştur. iPhone ve iPad gibi iOS cihazlarda hangi modellerin hızlı, doğru ve gerçek zamanlı performans sunduğunu öğren.

Android cihazlar ve iPhone'lar günlük yaşamın vazgeçilmezleri hâline geldi. İnsanlar bunları gün boyunca alışveriş yapmak, yön bulmak, fotoğraf çekmek, ürünleri taramak ve uygulamalarla etkileşim kurmak için kullanıyor.
Yapay zekânın hızla gelişmesiyle birlikte birçok akıllı telefon artık cihazın kamerasıyla çekilen görüntüleri ve videoları anlayabilen özellikler içeriyor. Bu özellikleri verimli bir şekilde çalıştırabilme becerisi büyük ölçüde temel donanıma bağlı.
Örneğin Apple ekosisteminde iPhone, iPad ve Mac gibi cihazlar A serisi ve M serisi dâhil olmak üzere Apple Silicon çiplerle çalışır. Bu çip üzeri sistem (SoC) tasarımları merkezi işlem birimlerini (CPU), grafik işlem birimlerini (GPU) ve özel makine öğrenimi hızlandırıcılarını bir araya getirerek yapay zekâ iş yükleri için cihaz üzerinde çıkarım yapılmasını sağlar.
Özellikle görüntü analiz özellikleri, makinelerin görüntüler ve videolardaki görsel bilgileri bilgisayarlı görü aracılığıyla yorumlayıp anlamasını sağlayan bir yapay zekâ alanı olan nesne algılama sayesinde mümkün olur.
Daha açık ifadeyle, nesne algılama modelleri görüntüleri analiz eder ve nesnelerin çevresine sınırlayıcı kutular çizerek onları belirler. Bu modeller, Apple Silicon çipler gibi mobil donanımlarda verimli çalışacak şekilde optimize edilebilir ve iOS cihazlarında doğrudan cihaz üzerinde gerçek zamanlı görsel analiz yapılmasını sağlar.

Şekil 1. Sınırlayıcı kutularla nesnelerin belirlendiği bir nesne algılama örneği. (Kaynak)
Bu makalede hızlı ve gerçek zamanlı iOS uygulamaları geliştirmek için en iyi nesne algılama modellerinden bazılarını inceleyeceğiz. Hadi başlayalım!
Nesne algılayıcılar iOS cihazlarında nasıl çalışır?#
Nesne algılama, uygulamaların bir görüntüdeki nesneleri tanımasına ve konumlandırmasına yardımcı olur. Bir uygulama girdi görüntüsünü işlediğinde, nesne algılama modeli sahneyi analiz edebilir, farklı nesneleri belirleyebilir, çevrelerine sınırlayıcı kutular yerleştirebilir ve etiketler atayabilir.
Çoğu nesne algılama sistemi, eğitim verilerindeki örüntüleri tanıyabilen sinir ağlarına dayanır. Görüntü görevleri için bu modeller, büyük eğitim veri kümelerindeki piksel düzeyindeki bilgileri analiz ederek görsel temsilleri öğrenir.
Evrişimli sinir ağları (CNN'ler) genellikle nesne algılama modellerinin omurgası olarak kullanılır. CNN'ler görüntü tahminlerinde başarılıdır; çünkü kenarlar, şekiller ve dokular gibi hiyerarşik görsel özellikleri öğrenerek modelin bir sahnedeki nesneleri tanımasına yardımcı olur.
Araştırmacılar bilgisayarlı görü görevleri için Transformer tabanlı mimarileri de inceliyor. Bu modeller, görüntünün farklı bölgeleri arasındaki ilişkileri analiz eder ve sahne genelindeki daha kapsamlı bağlamsal bilgileri yakalar.
Model mimarisinin türünün ötesinde, verimlilik iOS cihazlarında nesne algılama için kritik bir unsurdur. Bu modeller doğrudan mobil cihazlarda çalıştığından, sınırlı hesaplama kaynaklarını kullanırken görüntüleri hızlı bir şekilde işlemeleri gerekir.
Verimli modeller düşük gecikmeyi korur ve özellikle sürekli kamera girdisini analiz ederken mobil uygulamalarda gerçek zamanlı nesne algılamayı destekler.
Bir nesne algılama modelini iOS için uygun kılan nedir?#
iOS için en iyi nesne algılama modellerinden bazılarına geçmeden önce, bir modeli mobil uygulamalar için başarılı kılan özellikleri anlamak üzere bir adım geri atalım.
Bir iOS uygulaması için ideal nesne algılama modeli; performans, verimlilik ve güvenilirlik arasında denge kurar. iOS dağıtımı için güçlü bir modeli tanımlayan bazı temel faktörler şunlardır:
- Düşük gecikme: Model, özellikle sürekli kamera girdisine dayanan uygulamalarda gerçek zamanlı nesne algılamayı desteklemek için görüntüleri hızlı bir şekilde işlemelidir.
- Verimli model boyutu: Kompakt modeller mobil cihazlarda daha verimli çalışır ve genellikle daha az bellek ile hesaplama kaynağı gerektirir.
- Algılama doğruluğu: Doğru algılama, nesnelerin doğru şekilde sınıflandırılmasını ve sınırlayıcı kutuların farklı sahneler, nesne ölçekleri ve aydınlatma koşullarında hassas kalmasını sağlar.
- Çıkarım kararlılığı: Gerçek zamanlı uygulamalar için kareler arasındaki çıkarım süresinin tutarlı olması önemlidir. İşleme süresindeki büyük dalgalanmalar karelerin atlanmasına veya kararsız kamera deneyimlerine yol açabilir.
- Bellek ayak izi: Çıkarım sırasında gereken RAM miktarı, bir modelin iOS cihazlarındaki diğer uygulama işlemleriyle birlikte ne kadar sorunsuz çalıştığını etkiler.
En iyi nesne algılama modellerine iOS için bir bakış#
Şimdi iOS cihazları için en yaygın kullanılan nesne algılama modellerinden bazılarına göz atalım.
1. Ultralytics YOLO modelleri#
Ultralytics YOLO modelleri, gerçek zamanlı bilgisayarlı görü uygulamaları için tasarlanmış popüler bir nesne algılama modelleri ailesidir. Yıllar içinde Ultralytics, Ultralytics YOLOv5, Ultralytics YOLOv8, Ultralytics YOLO11 gibi görü modellerinin yanı sıra en yeni son teknoloji model olan Ultralytics YOLO26 modelini yayımladı.
Her yeni sürüm algılama doğruluğu, model verimliliği ve çalışma zamanı performansında iyileştirmeler sundu. Bu güncellemeler, Ultralytics YOLO modellerini akıllı telefonlar gibi uç cihazlar için giderek daha uygun hâle getirdi.

Şekil 2. YOLO26, gerçek dünyadaki bir sahnede birden fazla nesneyi algılamak için kullanılabilir. (Kaynak)
Ultralytics YOLO modellerini iOS uygulamalarında kullanmanın temel avantajlarından biri, Ultralytics Python paketi aracılığıyla sunulan CoreML entegrasyonudur. Bu açık kaynaklı kütüphane, geliştiricilerin Ultralytics YOLO modellerini basit bir iş akışıyla eğitmesine, test etmesine ve dışa aktarmasına yardımcı olur.
Paket, eğitilmiş modellerin Apple'ın iOS cihazlarında modelleri dağıtmak için kullanılan makine öğrenimi biçimi olan CoreML'e aktarılmasını destekler. Dışa aktarma sonrasında CoreML modeli bir uygulamaya entegre edilebilir ve CPU, GPU ile Apple Neural Engine gibi donanımları kullanarak doğrudan cihaz üzerinde çalıştırılabilir.

Şekil 3. CoreML, yapay zekâ modellerini uygulamalara entegre etmek ve çalıştırmak için Apple'ın çerçevesidir. (Kaynak)
Bu sayede geliştiriciler, model çıkarımını cihaz üzerinde tutarken gerçek zamanlı nesne algılamayı iOS uygulamalarına kolayca entegre edebilir.
Apple Silicon üzerinde Ultralytics YOLO modelleri için dağıtım seçenekleri#
Modellerin ötesinde Ultralytics ekosistemi, YOLO modellerini Apple Silicon çiplerinde dağıtmayı kolaylaştıran çeşitli seçenekler sunar.
Örneğin Ultralytics kısa süre önce veri kümesi yönetimi, model eğitimi, doğrulama ve dağıtımı tek bir ortamda bir araya getiren Ultralytics Platform çözümünü tanıttı. Bu birleşik iş akışı, birden fazla araca duyulan ihtiyacı azaltır ve denemeden gerçek dünyadaki uygulamalara geçişi kolaylaştırır.
Platformun bir parçası olarak eğitilmiş modeller, Apple cihazları için CoreML dâhil olmak üzere birden fazla biçime aktarılabilir. Böylece bir Ultralytics YOLO modelini yalnızca birkaç tıklamayla cihaz üzerinde çıkarım için dışa aktarmak mümkün olur.
Ultralytics, dışa aktarma özelliklerinin yanı sıra iOS için açık kaynaklı bir Swift (iOS uygulamaları geliştirmek için kullanılan Apple programlama dili) uygulaması da sunar. Buna, CoreML modellerinin nasıl entegre edilebileceğini, kamera girdisiyle çalıştırılabileceğini ve gerçek zamanlı nesne algılama için kullanılabileceğini gösteren, Swift ile yazılmış kullanıma hazır bir YOLO iOS uygulaması dâhildir.
Ultralytics YOLO modellerinin ek avantajları#
Ultralytics YOLO modellerini iOS uygulamaları geliştirmek için harika bir seçenek hâline getiren diğer temel özelliklerden bazıları şunlardır:
- Çeşitli görü görevlerini destekler: Ultralytics YOLO modelleri, nesne algılamaya ek olarak örnek bölütleme, poz tahmini, nesne takibi, yönlendirilmiş sınırlayıcı kutu (OBB) algılama ve görüntü sınıflandırma için kullanılabilir.
- Birden fazla model boyutu: Ultralytics; geliştiricilerin mobil cihazların performans kısıtlarına uygun bir sürüm seçmesine olanak tanıyan farklı model varyantları (nano, small, medium, large ve extra-large gibi) sunar.
- Önceden eğitilmiş modeller: Ultralytics YOLO modelleri, kullanıma hazır şekilde kullanılabilen veya belirli görevler için ince ayar yapılabilen önceden eğitilmiş modeller olarak sunulur ve geliştirme süresini azaltır.
2. EfficientDet#
EfficientDet, Google'daki araştırmacılar tarafından 2019'da tanıtılan bir nesne algılama mimarisidir. Algılama doğruluğu ile hesaplama verimliliği arasında denge kurmak üzere tasarlanmış ve sınırlı kaynaklara sahip ortamlar için uygun hâle getirilmiştir.
EfficientDet'in arkasındaki temel fikirlerden biri, bileşik ölçekleme olarak bilinen bir ölçekleme yöntemidir. Bu yaklaşım, ağ derinliği veya görüntü çözünürlüğü gibi modelin yalnızca bir bölümünü artırmak yerine mimarinin birden fazla bileşenini birlikte ölçekler.
Model, bu unsurları eş zamanlı olarak ayarlayarak yüksek doğruluk için yapılandırıldığında da hafif dağıtımlar için optimize edildiğinde de kararlı performansını korur.
Mimari, EfficientDet-D0'dan EfficientDet-D7'ye kadar çeşitli varyantlarda sunulur. Küçük modeller daha hızlı çıkarım ve daha düşük kaynak kullanımı için tasarlanırken büyük sürümler daha yüksek algılama doğruluğu elde etmeye odaklanır.
3. MobileNet SSD#
MobileNet SSD, mobil ve uç cihazlarda verimli bir şekilde çalışmak üzere tasarlanmış hafif bir nesne algılama modelidir. Yaklaşık 2017'de popülerlik kazandı.
Model, verimli özellik çıkarımına odaklanan MobileNet omurgasını nesneleri algılamak için SSD (Tek Atışlı Algılayıcı) yaklaşımıyla birleştirir. SSD yöntemi, nesneleri algılar ve tek bir ileri geçişte sınırlayıcı kutular oluşturur.
Bu tasarım modeli nispeten hızlı ve basit tutar; bu da hızlı algılama sonuçlarına ihtiyaç duyan uygulamalar için kullanışlıdır. MobileNet SSD, daha küçük model boyutlarının ve daha hızlı çıkarım hızlarının önemli olduğu durumlarda sıklıkla kullanılır.
MobileNet mimarisi gereken hesaplama miktarını azaltarak modelin işlem gücü sınırlı cihazlarda çalıştırılmasını kolaylaştırır. MobileNet SSD bazı yeni algılama mimarileriyle aynı doğruluk düzeyine ulaşamayabilse de yaygın birçok nesne algılama görevinde hâlâ iyi performans gösterir.
4. CenterNet#
CenterNet, nesneleri merkez noktalarını tahmin ederek belirleyen bir nesne algılama modelidir. 2019'da tanıtıldı.
Model, çok sayıda aday bölge oluşturmak yerine bir nesnenin merkezini algılar ve ardından çevresindeki sınırlayıcı kutunun boyutunu tahmin eder. Bu yaklaşım algılama işlem hattını basitleştirir ve çıkarım sırasında gereken adım sayısını azaltır.

Şekil 4. CenterNet'teki nesne algılama aşamalarına genel bakış (Kaynak)
CenterNet gerçek zamanlı algılama görevleri için kullanılabilir ve bazı çok aşamalı algılayıcılara kıyasla nispeten basit mimarisiyle bilinir. ResNet omurgalı CenterNet gibi varyantlar, farklı bilgisayarlı görü uygulamalarında yaygın olarak kullanılır.
Verimli tasarımı CenterNet'i iOS cihazlarında çalışan uygulamalar da dâhil olmak üzere hızlı nesne algılamaya ihtiyaç duyan sistemler için uygun hâle getirir.
5. NanoDet#
NanoDet, uç ve mobil cihazlardaki gerçek zamanlı uygulamalar için tasarlanmış hafif bir nesne algılama modelidir. Model boyutunu ve hesaplama gereksinimlerini çok düşük tutarken verimli nesne algılama sağlamak amacıyla 2020'de tanıtıldı.
Model, nesne konumlarını ve kategorilerini ağ üzerinden tek bir geçişte tahmin etmesini sağlayan tek aşamalı bir algılama mimarisi kullanır. Bu tasarım modeli hızlı tutar ve sınırlı donanım kaynaklarına sahip sistemler için uygun hâle getirir.
NanoDet, çıkarım sırasında gereken parametre ve hesaplama sayısını azaltmak için kompakt bir omurga ve optimize edilmiş bir algılama başlığı kullanır. Bu tasarım tercihleri, hız ve verimliliğe öncelik verirken makul algılama doğruluğunun korunmasına yardımcı olur.
iOS uygulaman için doğru nesne algılama modelini seçme#
Bir iOS uygulaması için nesne algılama modeli seçimi genellikle kullanım senaryosunun özel gereksinimlerine bağlıdır. Bu modeller doğrudan iPhone ve iPad gibi cihazlarda çalıştığından, hangi seçeneğin en iyi sonucu vereceğini çeşitli faktörler etkiler.
Dikkate alınması gereken bazı önemli noktalar şunlardır:
- Enerji verimliliği: Daha az güç tüketen modeller, sürekli kamera işleme yapan mobil uygulamalar için önemli olan pil ömrünün korunmasına yardımcı olur.
- Model optimizasyonu desteği: Bazı modeller, model boyutunu azaltabilen ve iOS cihazlarındaki performansı artırabilen niceleme veya budama gibi optimizasyon tekniklerini destekler.
- Donanım uyumluluğu: Seçtiğin model mimarisi, CPU, GPU ve Apple'ın Neural Engine'i dâhil olmak üzere iOS donanımında verimli çalışmalıdır.
- Ölçeklenebilirlik: Bazı mimariler birden fazla model boyutu veya varyantı sunarak geliştiricilerin performans ve donanım gereksinimlerine en uygun sürümleri seçmesine olanak tanır.
Önemli çıkarımlar#
Nesne algılama modelleri, akıllı mobil uygulamalara gelişmiş bilgisayarlı görü yetenekleri kazandırır. Doğrudan iOS cihazlarında çalışan bu modeller, uygulamaların cihaz kamerasından gelen görüntüleri ve videoları gerçek zamanlı olarak analiz etmesini mümkün kılar. Geliştiriciler doğru modeli seçerek güvenilir gerçek zamanlı performans sunan, duyarlı ve görü odaklı mobil uygulamalar geliştirebilir.
Büyüyen topluluğumuza katıl ve uygulamalı AI kaynakları için GitHub depomuzu keşfet. Bugün görsel AI ile geliştirme yapmak için lisanslama seçeneklerimizi incele. Tarımda AI'ın çiftçiliği nasıl dönüştürdüğünü ve robotikte görsel AI'ın geleceği nasıl şekillendirdiğini çözüm sayfalarımızı ziyaret ederek öğren.









