Implementa modelos de visão computacional em 42 regiões globais
Leva modelos treinados dos testes no navegador para endpoints de produção em poucos cliques, com dimensionamento automático, monitoramento de implantação e 20 formatos de exportação.
Implementação à escala da produção global
Coloca os modelos treinados em produção com disponibilidade mundial, amplo suporte à exportação e o volume de utilização comprovado pelo ecossistema da Ultralytics.
Testa o teu modelo no navegador
Todos os modelos treinados incluem a funcionalidade integrada do separador Predict. Carrega uma imagem ou abre a tua câmara; as caixas delimitadoras aparecem instantaneamente.
Implementa em 42 regiões do mundo
Implanta os teus modelos em endpoints dedicados nas Américas, Europa, Ásia-Pacífico e Médio Oriente. Cada endpoint tem o seu próprio URL, dimensionamento automático e monitoramento de solicitações, latência, erros e registos.
Escalabilidade automática adaptada ao teu tráfego
Os endpoints dedicados aumentam a capacidade durante picos de tráfego e reduzem-na a zero quando estão inativos.
- Redução a zero por predefinição: Não há custos quando o teu endpoint não recebe pedidos.
- Sem limites de taxa: Os endpoints dedicados não têm limites de throughput.
- Recursos configuráveis: Escolhe CPU (1-8 núcleos) e memória (1-32 GB) para corresponder à tua carga de trabalho.
20 formatos de exportação. O teu modelo. Qualquer ambiente.
A Ultralytics Platform suporta a implementação na cloud e na periferia para obter elevado desempenho. Todos os modelos YOLO da Ultralytics são otimizados nativamente para funcionar de forma eficiente em diferentes ambientes, proporcionando elevada precisão, desempenho fiável e compatibilidade, mesmo em dispositivos de periferia com recursos computacionais limitados.
Monitoriza tudo em produção
Acompanha as solicitações, a latência, os erros e os registos dos endpoints a partir do painel de implantações. Os endpoints dedicados pagos também fornecem estatísticas de previsão em tempo real e exemplos temporários que podes inspecionar e guardar num conjunto de dados.
- Solicitações, latência e erros: Volume HTTP de 24 horas, latência P95 ponderada pelo volume e alertas de taxa de erro acima de 5%.
- Verificações de integridade e registos: Integridade do endpoint em tempo real com nova tentativa automática, além de registos filtrados por gravidade para diagnosticar problemas rapidamente.
- Exemplos temporários: Inspeciona previsões amostradas em endpoints dedicados pagos. Os exemplos são mantidos na memória do endpoint; guarda imagens úteis num conjunto de dados para as preservar.
- Estatísticas de previsão: Contagens de classes, confiança, tempo de inferência e mapas de calor espaciais, quando suportados pela tarefa do modelo. As estatísticas são redefinidas quando a instância de atendimento é substituída.
Integra em minutos
Cada endpoint implementado inclui exemplos de código gerados automaticamente em Python, JavaScript e cURL, pré-preenchidos com o URL real do teu endpoint e a chave API. Copia, cola e começa a enviar pedidos de inferência a partir de qualquer aplicação.
Experimenta a inferência com YOLO26
Arrasta e larga uma imagem para veres a deteção de objetos em tempo real
Aprende a fazer a implementação!
Vê como testar um modelo treinado, implantá-lo num endpoint global e monitorizar solicitações, latência e previsões em tempo real.
Precisas de treinar um modelo primeiro?
A Ultralytics Platform liga a anotação, o treino e a implementação numa única plataforma.
Explorar soluções por setor
Veja como as equipas aplicam a visão computacional da Ultralytics em ambientes de produção.

Visão computacional para imagens aéreas

Visão computacional no setor aeroespacial


Visão computacional na robótica

Visão computacional na logística

Visão computacional no retalho

Visão computacional na área da saúde

Visão computacional na produção

Visão computacional no setor automóvel

Visão computacional na agricultura

Visão computacional para imagens aéreas

Visão computacional no setor aeroespacial


Visão computacional na robótica

Visão computacional na logística

Visão computacional no retalho

Visão computacional na área da saúde

Visão computacional na produção

Visão computacional no setor automóvel

Visão computacional na agricultura

Visão computacional para imagens aéreas

Visão computacional no setor aeroespacial


Visão computacional na robótica

Visão computacional na logística

Visão computacional no retalho

Visão computacional na área da saúde

Visão computacional na produção

Visão computacional no setor automóvel

Visão computacional na agricultura
Segurança de nível empresarial, certificada
Certificados e auditados de forma independente, para que os teus dados permaneçam protegidos durante a transmissão e em repouso.
Perguntas frequentes
Sim. Cada modelo pode ser implementado simultaneamente em várias regiões. O teu plano determina o número total de endpoints disponíveis: 3 no Free, 10 no Pro e ilimitados no Enterprise. Isto permite disponibilizar o serviço a utilizadores em todo o mundo, com endpoints de baixa latência em cada região.
Os endpoints dedicados são faturados com base na CPU, memória e volume de pedidos. Com a funcionalidade de escalabilidade até zero ativada por predefinição, pagas apenas pelo tempo de inferência ativo. Não há custos quando o teu endpoint não recebe pedidos. A inferência partilhada está incluída no teu plano da plataforma.
A inferência partilhada é executada num serviço multi-inquilino em 3 regiões e está limitada a 20 pedidos por minuto. É ideal para desenvolvimento e testes rápidos. Os endpoints dedicados são serviços de inquilino único implementados em qualquer uma das 43 regiões, sem limites de frequência, com latência consistente e recursos configuráveis, concebidos para cargas de trabalho de produção escaláveis.
A implementação de um endpoint dedicado demora normalmente entre um e dois minutos. Isto inclui o aprovisionamento do contentor, o arranque e uma verificação inicial do estado para validar que o serviço está pronto. Assim que o endpoint estiver pronto, começa imediatamente a aceitar pedidos de inferência.
A implementação de modelos é o processo de disponibilizar um modelo de visão computacional treinado para receber e processar dados do mundo real. Depois de implementadas, as aplicações de visão computacional podem enviar imagens e fotogramas de vídeo para o modelo através da API e receber previsões, permitindo desde a inspeção de qualidade automatizada até à deteção de objetos em tempo real em sistemas de produção. Na Ultralytics Platform, a implementação está integrada diretamente no fluxo de trabalho de treino end-to-end. Depois de treinares o modelo, podes testá-lo no navegador, implementá-lo num endpoint dedicado em qualquer uma das 43 regiões globais e monitorizar o seu desempenho, tudo a partir do mesmo espaço de trabalho.
Começa hoje a implementar!
Leva os teus modelos treinados para produção em 42 regiões globais com autosscaling e monitorização de implementação.







