Semi-Supervised Learning
Explore como a aprendizagem semissupervisionada combina dados anotados e não anotados para aumentar a precisão do modelo. Aprenda a implementar fluxos de trabalho de SSL com o Ultralytics YOLO26.
A aprendizagem semissupervisionada (SSL) é um paradigma estratégico na aprendizagem automática (ML) que funciona como uma ponte entre dois métodos tradicionais de treino. Enquanto a aprendizagem supervisionada depende inteiramente de conjuntos de dados totalmente anotados e a aprendizagem não supervisionada tenta encontrar padrões nos dados sem quaisquer etiquetas, a SSL funciona combinando uma pequena quantidade de dados rotulados com um conjunto significativamente maior de dados não rotulados. Esta abordagem é particularmente valiosa em cenários reais de visão computacional (CV), nos quais recolher imagens brutas — como filmagens de câmaras de segurança ou de satélites — é relativamente barato, mas o processo de anotação de dados por especialistas humanos é dispendioso, lento e trabalhoso. Ao utilizar eficazmente a estrutura oculta nos exemplos não rotulados, a SSL pode melhorar significativamente a precisão do modelo e a generalização sem exigir um orçamento exaustivo para anotação.
Mecanismos fundamentais da aprendizagem semissupervisionada#
O principal objetivo da SSL é propagar a informação encontrada no pequeno conjunto de exemplos rotulados para o conjunto maior de dados não rotulados. Isto permite que a rede neuronal aprenda fronteiras de decisão que atravessam regiões de baixa densidade dos dados, resultando numa classificação ou deteção mais robusta.
Duas técnicas populares estão na base da maioria dos fluxos de trabalho semissupervisionados:
- Pseudo-rotulagem: Neste método, um modelo é primeiro treinado com os dados rotulados limitados. Em seguida, é utilizado para executar inferência nos dados não rotulados. As previsões que ultrapassam um determinado limiar de confiança são tratadas como "pseudoetiquetas" ou verdade de referência. Estas previsões confiantes são adicionadas aos dados de treino e o modelo é treinado novamente, melhorando iterativamente o seu desempenho.
- Regularização de consistência: Esta técnica baseia-se no aumento de dados. A ideia é que um modelo deve produzir previsões semelhantes para uma imagem e para uma versão ligeiramente modificada (aumentada) dessa mesma imagem. Ao minimizar a diferença entre as previsões da versão original e da versão aumentada, o modelo aprende a concentrar-se nas características essenciais do objeto, em vez de no ruído, melhorando a sua capacidade de lidar com o sobreajuste.
Implementação prática com YOLO#
O exemplo seguinte em Python demonstra um fluxo de trabalho simples de pseudo-rotulagem utilizando o pacote ultralytics. Aqui, treinamos um modelo YOLO26 com um conjunto de dados pequeno e utilizamo-lo depois para gerar etiquetas para um diretório de imagens não rotuladas.
from ultralytics import YOLO
# Load the latest YOLO26 model
model = YOLO("yolo26n.pt")
# Train initially on a small available labeled dataset
model.train(data="coco8.yaml", epochs=10)
# Run inference on unlabeled data to generate pseudo-labels
# Setting save_txt=True saves the detections as text files for future training
results = model.predict(source="./unlabeled_images", save_txt=True, conf=0.85)Aplicações no mundo real#
A aprendizagem semissupervisionada está a transformar setores nos quais os dados são abundantes, mas a experiência é escassa.
- Imagiologia médica: Na IA para a saúde, obter exames (radiografias, ressonâncias magnéticas) é um procedimento padrão, mas pedir a um radiologista certificado para anotar cada pixel para a deteção de tumores é proibitivamente dispendioso. A SSL permite que os investigadores treinem modelos de alto desempenho utilizando apenas uma fração dos casos anotados por especialistas, aproveitando milhares de exames arquivados para aperfeiçoar a compreensão que o modelo tem das estruturas biológicas.
- Condução autónoma: As empresas de veículos autónomos recolhem diariamente petabytes de dados de vídeo provenientes dos veículos das suas frotas. É impossível anotar cada fotograma para deteção de objetos e segmentação semântica. Através da SSL, o sistema pode aprender com a grande maioria das horas de condução não rotuladas para compreender melhor ambientes rodoviários complexos, condições meteorológicas e casos-limite raros.
Distinguir conceitos relacionados#
Para implementar soluções de IA de forma eficaz, é crucial compreender em que aspetos a SSL difere de estratégias semelhantes:
- vs. Aprendizagem ativa: Embora ambas lidem com dados não rotulados, a sua abordagem à rotulagem é diferente. A SSL atribui etiquetas automaticamente com base nas previsões do modelo. Em contrapartida, a aprendizagem ativa identifica os pontos de dados mais "confusos" ou incertos e solicita explicitamente a um humano no circuito que os anote, otimizando o tempo da pessoa em vez de a eliminar completamente do processo.
- vs. Aprendizagem por transferência: A aprendizagem por transferência consiste em utilizar um modelo pré-treinado num conjunto de dados externo de grande dimensão (como o ImageNet) e ajustá-lo à tua tarefa específica. A SSL, por outro lado, concentra-se em aproveitar a parte não rotulada da distribuição de dados específica do teu conjunto de dados durante o próprio processo de treino.
- vs. Aprendizagem autossupervisionada: Embora os nomes sejam semelhantes, a aprendizagem autossupervisionada refere-se frequentemente a "tarefas pretexto" (como resolver um puzzle com partes de uma imagem), nas quais os dados geram os seus próprios sinais de supervisão sem quaisquer etiquetas externas. A SSL implica especificamente a utilização de um conjunto menor de etiquetas verificadas para orientar o processo.
Ferramentas e perspetivas futuras#
À medida que os modelos de aprendizagem profunda (DL) aumentam de dimensão, a eficiência da utilização dos dados torna-se fundamental. Frameworks modernos como PyTorch e TensorFlow fornecem o backend computacional para estes ciclos de treino avançados. Além disso, ferramentas como a Ultralytics Platform estão a simplificar o ciclo de vida da gestão de conjuntos de dados. Ao utilizar funcionalidades como a anotação automática, as equipas podem implementar fluxos de trabalho semissupervisionados com maior facilidade, transformando rapidamente dados brutos em pesos de modelo prontos para produção. Esta evolução em MLOps garante que a barreira de entrada para criar sistemas de visão de alta precisão continua a diminuir.









