Semi-Supervised Learning
Explora cómo el aprendizaje semisupervisado combina datos etiquetados y sin etiquetar para mejorar la precisión del modelo. Aprende a implementar flujos de trabajo de SSL con Ultralytics YOLO26.
El aprendizaje semisupervisado (SSL) es un paradigma estratégico del aprendizaje automático (ML) que actúa como puente entre dos métodos de entrenamiento tradicionales. Mientras que el aprendizaje supervisado depende por completo de conjuntos de datos totalmente anotados y el aprendizaje no supervisado intenta encontrar patrones en los datos sin etiquetas, SSL combina una pequeña cantidad de datos etiquetados con un conjunto mucho mayor de datos no etiquetados. Este enfoque resulta especialmente valioso en escenarios reales de visión artificial (CV), donde recopilar imágenes sin procesar —como grabaciones de vídeo de cámaras de seguridad o satélites— es relativamente económico, pero el proceso de etiquetado de datos por parte de expertos humanos es costoso, lento y laborioso. Al aprovechar eficazmente la estructura oculta en los ejemplos no etiquetados, SSL puede mejorar significativamente la precisión del modelo y su capacidad de generalización sin requerir un presupuesto exhaustivo para la anotación.
Mecanismos principales del aprendizaje semisupervisado#
El objetivo principal de SSL es propagar la información presente en el pequeño conjunto de ejemplos etiquetados al conjunto no etiquetado, de mayor tamaño. Esto permite que la red neuronal aprenda límites de decisión que atraviesen regiones de baja densidad de los datos, lo que da lugar a una clasificación o detección más robusta.
Dos técnicas populares impulsan la mayoría de los flujos de trabajo semisupervisados:
- Seudoetiquetado: En este método, primero se entrena un modelo con los datos etiquetados disponibles, que son limitados. Después, se utiliza para ejecutar inferencias sobre los datos no etiquetados. Las predicciones que superan un umbral de confianza específico se tratan como «seudoetiquetas» o verdad fundamental. Estas predicciones fiables se añaden a los datos de entrenamiento y el modelo se vuelve a entrenar, mejorando su rendimiento de forma iterativa.
- Regularización de la coherencia: Esta técnica se basa en el aumento de datos. La idea es que un modelo debe producir predicciones similares para una imagen y para una versión ligeramente modificada (aumentada) de esa misma imagen. Al minimizar la diferencia entre las predicciones de la versión original y la aumentada, el modelo aprende a centrarse en las características esenciales del objeto en lugar de en el ruido, lo que mejora su capacidad para gestionar el sobreajuste.
Implementación práctica con YOLO#
El siguiente ejemplo de Python muestra un flujo de trabajo sencillo de seudoetiquetado con el paquete ultralytics. Aquí, entrenamos un modelo YOLO26 con un conjunto de datos pequeño y después lo utilizamos para generar etiquetas para un directorio de imágenes no etiquetadas.
from ultralytics import YOLO
# Load the latest YOLO26 model
model = YOLO("yolo26n.pt")
# Train initially on a small available labeled dataset
model.train(data="coco8.yaml", epochs=10)
# Run inference on unlabeled data to generate pseudo-labels
# Setting save_txt=True saves the detections as text files for future training
results = model.predict(source="./unlabeled_images", save_txt=True, conf=0.85)Aplicaciones en el mundo real#
El aprendizaje semisupervisado está transformando sectores en los que los datos son abundantes, pero los conocimientos especializados son escasos.
- Imágenes médicas: En la IA sanitaria, obtener exploraciones (radiografías y resonancias magnéticas) es un procedimiento habitual, pero que un radiólogo con certificación oficial anote cada píxel para la detección de tumores resulta prohibitivamente caro. SSL permite a los investigadores entrenar modelos de alto rendimiento utilizando solo una fracción de los casos anotados por expertos y aprovechando miles de exploraciones archivadas para perfeccionar la comprensión que tiene el modelo de las estructuras biológicas.
- Conducción autónoma: Las empresas de vehículos autónomos recopilan diariamente petabytes de datos de vídeo procedentes de sus flotas. Etiquetar cada fotograma para la detección de objetos y la segmentación semántica es imposible. Mediante SSL, el sistema puede aprender de la gran mayoría de las horas de conducción no etiquetadas para comprender mejor los complejos entornos viales, las condiciones meteorológicas y los casos límite poco frecuentes.
Diferenciación de conceptos relacionados#
Para implementar soluciones de IA de forma eficaz, es fundamental entender en qué se diferencia SSL de estrategias similares:
- Frente al aprendizaje activo: Aunque ambos trabajan con datos no etiquetados, su enfoque del etiquetado es diferente. SSL asigna etiquetas automáticamente basándose en las predicciones del modelo. En cambio, el aprendizaje activo identifica los puntos de datos más «confusos» o inciertos y solicita explícitamente a una persona en el circuito que los etiquete, optimizando el tiempo de esa persona en lugar de eliminarla por completo del proceso.
- Frente al aprendizaje por transferencia: El aprendizaje por transferencia consiste en tomar un modelo preentrenado con un conjunto de datos externo masivo, como ImageNet, y ajustarlo para tu tarea específica. SSL, en cambio, se centra en aprovechar la parte no etiquetada de la distribución de datos de tu conjunto de datos específico durante el propio proceso de entrenamiento.
- Frente al aprendizaje autosupervisado: Aunque los nombres son similares, el aprendizaje autosupervisado suele referirse a «tareas de pretexto», como resolver un rompecabezas formado por fragmentos de imágenes, en las que los datos generan sus propias señales de supervisión sin etiquetas externas. SSL implica específicamente utilizar un conjunto más pequeño de etiquetas verificadas para guiar el proceso.
Herramientas y perspectivas de futuro#
A medida que los modelos de aprendizaje profundo (DL) aumentan de tamaño, la eficiencia en el uso de los datos se vuelve fundamental. Frameworks modernos como PyTorch y TensorFlow proporcionan el backend computacional para estos ciclos de entrenamiento avanzados. Además, herramientas como Ultralytics Platform simplifican el ciclo de vida de la gestión de conjuntos de datos. Al utilizar funciones como el autoetiquetado, los equipos pueden implementar flujos de trabajo semisupervisados con mayor facilidad y convertir rápidamente los datos sin procesar en pesos de modelo listos para producción. Esta evolución de MLOps garantiza que la barrera de entrada para crear sistemas de visión de alta precisión siga reduciéndose.









