Déploie des modèles de vision par ordinateur dans 42 régions du monde
Passe des tests dans le navigateur aux points de terminaison de production en quelques clics, avec la mise à l'échelle automatique, la surveillance du déploiement et 20 formats d'exportation.
Déploie à l’échelle de la production mondiale
Passe tes modèles entraînés en production grâce à une disponibilité mondiale, une large prise en charge des formats d’exportation et un volume d’utilisation éprouvé par l’écosystème Ultralytics.
Teste ton modèle dans le navigateur
Chaque modèle entraîné inclut une fonctionnalité intégrée dans l’onglet Predict. Téléverse une image ou ouvre ta caméra : les cadres englobants apparaissent instantanément.
Déploie dans 42 régions du monde
Déploie tes modèles sur des points de terminaison dédiés à travers les Amériques, l'Europe, l'Asie-Pacifique et le Moyen-Orient. Chaque point de terminaison possède sa propre URL, sa mise à l'échelle automatique et sa surveillance pour les requêtes, la latence, les erreurs et les journaux.
Une mise à l’échelle automatique adaptée à ton trafic
Les points de terminaison dédiés augmentent leurs capacités lors des pics de trafic et redescendent à zéro lorsqu’ils sont inactifs.
- Mise à l’échelle jusqu’à zéro par défaut : Aucun coût lorsque ton point de terminaison ne reçoit pas de requêtes.
- Aucune limite de débit : Les points de terminaison dédiés n’ont aucune limite de débit.
- Ressources configurables : Choisis le nombre de CPU (1 à 8 cœurs) et la mémoire (1 à 32 Go) adaptés à ta charge de travail.
20 formats d’exportation. Ton modèle. Tous les environnements.
Ultralytics Platform prend en charge le déploiement cloud et edge haute performance. Tous les modèles Ultralytics YOLO sont optimisés nativement pour fonctionner efficacement dans tous les environnements, offrant une grande précision, des performances fiables et une compatibilité même sur des appareils edge aux ressources de calcul limitées.
Surveille tout en production
Suivi des requêtes, de la latence, des erreurs et des journaux depuis le tableau de bord des déploiements. Les points de terminaison dédiés payants fournissent également des statistiques de prédiction en direct et des exemples temporaires que tu peux inspecter et enregistrer dans un jeu de données.
- Requêtes, latence et erreurs : Volume HTTP sur 24 heures, latence P95 pondérée par le volume et alertes de taux d'erreur supérieures à 5 %.
- Vérifications de santé et journaux : Santé des points de terminaison en direct avec nouvelle tentative automatique, ainsi que des journaux filtrés par sévérité pour diagnostiquer rapidement les problèmes.
- Exemples temporaires : Inspecte les prédictions échantillonnées sur les points de terminaison dédiés payants. Les exemples sont conservés dans la mémoire du point de terminaison ; enregistre les images utiles dans un jeu de données pour les conserver.
- Statistiques de prédiction : Comptes de classes, confiance, temps d'inférence et cartes thermiques spatiales, lorsque cela est pris en charge par la tâche du modèle. Les statistiques sont réinitialisées lorsque l'instance de service est remplacée.
Intègre en quelques minutes
Chaque point de terminaison déployé est accompagné d’exemples de code générés automatiquement en Python, JavaScript et cURL, préremplis avec l’URL réelle de ton point de terminaison et ta clé API. Copie, colle et commence à envoyer des requêtes d’inférence depuis n’importe quelle application.
Essayer l’inférence YOLO26
Glisse-dépose une image pour voir la détection d'objets en temps réel
Découvre comment déployer !
Regarde comment tester un modèle entraîné, le déployer sur un point de terminaison mondial et surveiller les requêtes, la latence et les prédictions en direct.
Tu dois d’abord entraîner un modèle ?
Ultralytics Platform relie l’annotation, l’entraînement et le déploiement au sein d’une plateforme unique.
Découvrir les solutions par secteur
Découvre comment les équipes utilisent la vision par ordinateur d’Ultralytics dans des environnements de production.

Vision par ordinateur pour l'imagerie aérienne

Vision par ordinateur dans l'aérospatiale


Vision par ordinateur en robotique

Vision par ordinateur en logistique

Vision par ordinateur dans le commerce de détail

La vision par ordinateur dans le secteur de la santé

La vision par ordinateur dans l'industrie manufacturière

Vision par ordinateur dans l’automobile

Vision par ordinateur dans l’agriculture

Vision par ordinateur pour l'imagerie aérienne

Vision par ordinateur dans l'aérospatiale


Vision par ordinateur en robotique

Vision par ordinateur en logistique

Vision par ordinateur dans le commerce de détail

La vision par ordinateur dans le secteur de la santé

La vision par ordinateur dans l'industrie manufacturière

Vision par ordinateur dans l’automobile

Vision par ordinateur dans l’agriculture

Vision par ordinateur pour l'imagerie aérienne

Vision par ordinateur dans l'aérospatiale


Vision par ordinateur en robotique

Vision par ordinateur en logistique

Vision par ordinateur dans le commerce de détail

La vision par ordinateur dans le secteur de la santé

La vision par ordinateur dans l'industrie manufacturière

Vision par ordinateur dans l’automobile

Vision par ordinateur dans l’agriculture
Sécurité de niveau entreprise, certifiée
Certifiés et audités de manière indépendante, nous protégeons tes données pendant leur transfert et au repos.
Questions fréquemment posées
Oui. Chaque modèle peut être déployé simultanément dans plusieurs régions. Ton forfait détermine le nombre total de endpoints disponibles : 3 pour Free, 10 pour Pro et un nombre illimité pour Enterprise. Tu peux ainsi servir des utilisateurs dans le monde entier avec des endpoints à faible latence dans chaque région.
Les endpoints dédiés sont facturés en fonction du CPU, de la mémoire et du volume de requêtes. La mise à l'échelle à zéro étant activée par défaut, tu ne paies que le temps d'inférence actif. Aucun coût n'est facturé lorsque ton endpoint ne reçoit pas de requêtes. L'inférence partagée est incluse dans ton forfait plateforme.
L'inférence partagée s'exécute sur un service mutualisé dans 3 régions et est limitée à 20 requêtes par minute. Elle convient particulièrement au développement et aux tests rapides. Les endpoints dédiés sont des services à locataire unique déployés dans l'une des 43 régions, sans limite de débit, avec une latence constante et des ressources configurables, conçus pour les charges de travail de production évolutives.
Le déploiement d'un endpoint dédié prend généralement une à deux minutes. Cela comprend le provisionnement du conteneur, le démarrage et une vérification initiale de l'état pour confirmer que le service est prêt. Dès que l'endpoint est prêt, il commence immédiatement à accepter les requêtes d'inférence.
Le déploiement d'un modèle consiste à rendre un modèle de vision par ordinateur entraîné disponible pour recevoir et traiter des données du monde réel. Une fois déployées, les applications de vision par ordinateur peuvent envoyer des images et des trames vidéo au modèle via une API et recevoir des prédictions, ce qui permet aussi bien l'inspection qualité automatisée que la détection d'objets en temps réel dans les systèmes de production. Sur Ultralytics Platform, le déploiement est directement intégré au workflow d'entraînement de bout en bout. Une fois ton modèle entraîné, tu peux le tester dans le navigateur, le déployer sur un endpoint dédié dans l'une des 43 régions du monde et surveiller ses performances, le tout depuis le même espace de travail.
Commence à déployer dès aujourd'hui !
Mets tes modèles entraînés en production dans 42 régions mondiales avec mise à l'échelle automatique et surveillance du déploiement.







