Déploie tes modèles de vision par ordinateur dans 42 régions mondiales
Tes modèles entraînés, des tests dans le navigateur aux points de terminaison de production en quelques clics grâce à la mise à l'échelle automatique, la surveillance en temps réel et 20 formats d'exportation.

Déploie à l'échelle mondiale
Fais passer tes modèles entraînés en production avec une disponibilité mondiale, une large prise en charge de l'exportation et le volume d'utilisation éprouvé par l'écosystème Ultralytics.

Déploie dans 42 régions à travers le monde
Déploie tes modèles sur des points de terminaison dédiés à travers les Amériques, l'Europe, l'Asie-Pacifique et le Moyen-Orient. Chaque point de terminaison possède sa propre URL, sa mise à l'échelle automatique et sa surveillance.

Une mise à l'échelle automatique qui correspond à ton trafic
Les points de terminaison dédiés montent en charge lors des pics de trafic et redescendent à zéro en cas d'inactivité.
- Mise à l'échelle vers zéro par défaut : Aucun coût lorsque ton point de terminaison ne reçoit pas de requêtes.
- Aucune limite de débit : Les points de terminaison dédiés n'ont aucune limite de débit.
- Ressources configurables : Choisis le CPU (1-8 cœurs) et la mémoire (1-32 Go) pour correspondre à ta charge de travail.

20 formats d'exportation. Ton modèle. N'importe quel environnement.
La plateforme Ultralytics prend en charge le déploiement sur le cloud et en périphérie pour une haute performance. Tous les modèles Ultralytics YOLO sont nativement optimisés pour fonctionner efficacement dans divers environnements, offrant une grande précision, des performances fiables et une compatibilité même sur des appareils de périphérie avec des ressources de calcul limitées.

Surveille tout en production
Une visibilité complète en temps réel sur les performances de tes modèles. Une fois tes modèles mis en ligne, le tableau de bord des déploiements te donne une vue d'ensemble centralisée de chaque point de terminaison en cours d'exécution, avec les métriques et la boîte à outils dont tu as besoin pour optimiser et maintenir tes frameworks en fonctionnement fiable.
- Volume de requêtes : Nombre total de requêtes sur tous les points de terminaison au cours des dernières 24 heures.
- Latence P95 : Temps de réponse du 95e percentile pour suivre les performances en situation réelle.
- Taux d'erreur : Alertes claires lorsque les taux d'erreur dépassent 5 %, avec des journaux filtrés par gravité pour diagnostiquer les problèmes rapidement.
- Vérifications de santé : Surveillance en direct des points de terminaison avec nouvelle tentative automatique. Latence affichée par vérification.

Intègre en quelques minutes
Chaque point de terminaison déployé est accompagné d'exemples de code générés automatiquement en Python, JavaScript et cURL, pré-remplis avec ton URL de point de terminaison réelle et ta clé API. Copie, colle et commence à envoyer des requêtes d'inférence depuis n'importe quelle application.
Teste ton modèle dans le navigateur
Chaque modèle entraîné inclut une fonctionnalité d'onglet Predict intégrée. Télécharge une image ou ouvre ta caméra ; les boîtes englobantes (bbox) apparaissent instantanément.

Essayer l'inférence avec YOLO26
Fais glisser et dépose une image pour voir la détection d'objets en temps réel
Dépose une image ici
ou clique pour parcourir
Supporte JPEG, PNG, WebP, AVIF, HEIC, JP2, TIFF, BMP et plus (max 10 Mo)
import requests
# Replace with your deployment URL and API key
url = "https://your-deployment-url.run.app/predict"
api_key = "YOUR_API_KEY"
# Optional inference parameters (conf, iou, imgsz)
args = {"conf": 0.25, "iou": 0.7, "imgsz": 640}
with open("image.jpg", "rb") as f:
response = requests.post(
url,
headers={"Authorization": f"Bearer {api_key}"},
data=args,
files={"file": f},
)
print(response.json())Apprends comment déployer !
Regarde comment tester un modèle entraîné, le déployer sur un point de terminaison mondial et surveiller ses performances.
Explore les solutions sectorielles
Découvre comment les équipes appliquent la vision par ordinateur d'Ultralytics dans des environnements de production.

IA dans la robotique

IA dans la logistique

IA dans le commerce de détail

IA dans la santé

IA dans la fabrication

IA dans l'automobile

IA en agriculture

IA dans la robotique

IA dans la logistique

IA dans le commerce de détail

IA dans la santé

IA dans la fabrication

IA dans l'automobile

IA en agriculture

IA dans la robotique

IA dans la logistique

IA dans le commerce de détail

IA dans la santé

IA dans la fabrication

IA dans l'automobile

IA en agriculture
Questions fréquemment posées
Oui. Chaque modèle peut être déployé dans plusieurs régions simultanément. Ton plan détermine le nombre total de terminaux (endpoints) disponibles : 3 pour Free, 10 pour Pro et illimité pour Enterprise. Cela te permet de servir les utilisateurs à l'échelle mondiale avec des terminaux à faible latence dans chaque région.
Les terminaux dédiés sont facturés en fonction du CPU, de la mémoire et du volume de requêtes. Avec la mise à l'échelle automatique vers zéro activée par défaut, tu ne paies que pour le temps d'inférence actif. Il n'y a aucun coût lorsque ton terminal ne reçoit pas de requêtes. L'inférence partagée est incluse avec ton plan de plateforme.
L'inférence partagée fonctionne sur un service multi-tenant dans 3 régions et est limitée à 20 requêtes par minute. C'est idéal pour le développement et les tests rapides. Les terminaux dédiés sont des services single-tenant déployés dans l'une des 43 régions sans limites de débit, avec une latence cohérente et des ressources configurables, conçus pour des charges de travail de production évolutives.
Le déploiement d'un terminal dédié prend généralement une à deux minutes. Cela inclut le provisionnement du conteneur, le démarrage et un contrôle de santé initial pour valider que le service est prêt. Une fois le terminal prêt, il commence immédiatement à accepter les requêtes d'inférence.
Le déploiement de modèle est le processus consistant à rendre un modèle de vision par ordinateur entraîné disponible pour recevoir et traiter des données réelles. Une fois déployé, les applications de vision par ordinateur peuvent envoyer des images et des images vidéo au modèle via l'API et recevoir des prédictions, permettant tout, de l'inspection qualité automatisée à la détection d'objets en temps réel dans les systèmes de production. Sur la plateforme Ultralytics, le déploiement est intégré directement dans le flux de travail d'entraînement de bout en bout. Une fois ton modèle entraîné, tu peux le tester dans le navigateur, le déployer sur un terminal dédié dans l'une des 43 régions mondiales et surveiller ses performances, tout depuis le même espace de travail.
Commence le déploiement dès aujourd'hui !
Déploie tes modèles entraînés en production à travers 42 régions mondiales avec mise à l'échelle automatique et surveillance en temps réel.