El aprendizaje activo acelera el desarrollo de la visión artificial
Descubre cómo se utiliza el aprendizaje activo en visión artificial para minimizar el esfuerzo de anotación y explora sus aplicaciones reales en diversos sectores.

Entrenar un modelo de visión por ordenador se parece mucho a enseñar a un niño a reconocer colores. Primero, necesitarías una colección de objetos de colores. Después, guiarías al niño para identificar correctamente cada color, una tarea que a menudo resulta laboriosa y repetitiva.
Al igual que un niño necesita muchos ejemplos para aprender, un modelo de visión necesita un gran conjunto de datos etiquetados para reconocer patrones y objetos en imágenes. Sin embargo, etiquetar grandes cantidades de datos requiere mucho tiempo y esfuerzo, además de recursos. Técnicas como el aprendizaje activo pueden ayudar a simplificar este proceso.
El aprendizaje activo es un proceso paso a paso en el que se seleccionan y etiquetan los datos más importantes de un conjunto de datos grande. El modelo aprende a partir de estos datos etiquetados, lo que lo hace más preciso y eficaz. Centrarse únicamente en los datos más valiosos reduce la cantidad de etiquetado necesaria y acelera el desarrollo del modelo.
En este artículo, veremos cómo el aprendizaje activo ayuda a entrenar modelos, reduce los costes de etiquetado y mejora la precisión general del modelo.
Crear conjuntos de datos de imágenes no es fácil#
Los conjuntos de datos son la base de los modelos de visión por ordenador y aprendizaje profundo. Conjuntos de datos populares como ImageNet ofrecen millones de imágenes con categorías de objetos diversas. Sin embargo, crear y mantener volúmenes tan grandes de conjuntos de datos de alta calidad plantea diversos retos.
Por ejemplo, recopilar y etiquetar datos requiere tiempo, recursos y anotadores cualificados, lo que hace que el proceso sea complicado según la aplicación concreta. Se necesitan soluciones innovadoras y más eficientes para satisfacer la creciente demanda de conjuntos de datos de imágenes, y eso es precisamente lo que el aprendizaje activo pretende resolver.
El aprendizaje activo ofrece una solución ideal al optimizar el proceso de etiquetado de datos. Al seleccionar estratégicamente los datos más informativos para su anotación, el aprendizaje activo maximiza el rendimiento del modelo y minimiza el esfuerzo de etiquetado.
¿Qué es el aprendizaje activo?#
El aprendizaje activo es una técnica iterativa de aprendizaje automático en la que el modelo selecciona los datos más importantes que se deben etiquetar de un gran conjunto de datos sin etiquetar. Estos datos seleccionados se etiquetan manualmente y se añaden al conjunto de datos de entrenamiento.
A continuación, el modelo se vuelve a entrenar con el conjunto de datos actualizado y selecciona el siguiente grupo de datos que se deben etiquetar. Este proceso se repite, y el modelo mejora continuamente al centrarse en los datos más informativos. El ciclo continúa hasta que el modelo alcanza la precisión deseada o cumple los criterios de etiquetado establecidos previamente.

Fig. 1. Descripción general del aprendizaje activo.
Cómo funciona el aprendizaje activo#
Quizá te preguntes cómo decide la técnica de aprendizaje activo qué datos necesitan etiquetado manual y cuáles se deben etiquetar después. Veamos cómo funciona el aprendizaje activo comparándolo con estudiar para un examen: te centras en los temas sobre los que tienes dudas y también te aseguras de cubrir una variedad de materias para estar bien preparado.
Para las fases iniciales de selección de datos, el aprendizaje activo utiliza estrategias como el muestreo por incertidumbre y el muestreo basado en la diversidad. El muestreo por incertidumbre prioriza los datos en los que el modelo tiene menos confianza en sus predicciones, con el objetivo de mejorar la precisión en casos difíciles. El muestreo basado en la diversidad selecciona datos que cubren una amplia variedad de características, lo que garantiza que el modelo generalice bien a datos no vistos al exponerlo a ejemplos diversos.

Fig. 2. Muestreo por incertidumbre (a la izquierda) y muestreo basado en la diversidad (a la derecha).
Después de la selección inicial de datos, el aprendizaje activo utiliza dos enfoques principales para el etiquetado: el muestreo basado en conjuntos y el muestreo basado en flujos. Son similares a la forma en que un profesor ayuda a un alumno a centrarse en lo más importante.
En el muestreo basado en conjuntos, el modelo analiza un gran conjunto de datos sin etiquetar y selecciona los ejemplos más difíciles o informativos para etiquetarlos, como un alumno que prioriza las fichas de estudio que le resultan más complicadas. En el muestreo basado en flujos, el modelo procesa los datos a medida que llegan y decide si etiquetarlos o ignorarlos, de forma similar a un alumno que pide ayuda solo cuando se atasca. En ambos casos, los datos etiquetados se añaden al conjunto de entrenamiento y el modelo vuelve a entrenarse, mejorando progresivamente con cada iteración.
Exploración de las aplicaciones del aprendizaje activo#
El aprendizaje activo desempeña un papel clave en las aplicaciones de visión por ordenador, como la obtención de imágenes médicas y la conducción autónoma, al mejorar la precisión del modelo y agilizar el proceso de etiquetado de datos. Un ejemplo interesante son los modelos de visión por ordenador utilizados en coches autónomos para detectar peatones u objetos en condiciones de poca luz o niebla. El aprendizaje activo puede mejorar la precisión al centrarse en situaciones de conducción diversas y difíciles.
En concreto, el aprendizaje activo puede utilizarse para identificar datos o fotogramas inciertos de este tipo de situaciones y etiquetarlos de forma selectiva. Añadir estos ejemplos etiquetados al conjunto de entrenamiento ayuda al modelo a reconocer mejor a peatones y objetos en entornos difíciles, como durante condiciones meteorológicas adversas o la conducción nocturna.
Por ejemplo, NVIDIA ha utilizado el aprendizaje activo para mejorar la detección de peatones de noche en sus modelos de conducción autónoma. Al seleccionar estratégicamente los datos más informativos para el entrenamiento, especialmente en situaciones difíciles, el rendimiento del modelo aumenta considerablemente.

Fig. 3. Detección de un peatón con un paraguas mediante aprendizaje activo.
El aprendizaje activo puede reducir los costes de etiquetado#
Otro aspecto clave del aprendizaje activo es su potencial para reducir los costes de etiquetado. Lo consigue al centrarse únicamente en los datos más importantes, en lugar de exigir anotaciones para todo el conjunto de datos. Este enfoque específico ahorra tiempo, esfuerzo y dinero. Al centrarse en muestras inciertas o diversas, el aprendizaje activo reduce el número de anotaciones necesarias y mantiene una alta precisión del modelo.
De hecho, las investigaciones muestran que el aprendizaje activo puede reducir los costes de etiquetado entre un 40 y un 60 % sin sacrificar el rendimiento. Esto resulta especialmente útil en sectores como la sanidad y la fabricación, donde etiquetar datos es caro. Al simplificar el proceso de anotación, el aprendizaje activo ayuda a las empresas a desarrollar modelos más rápidamente y a desplegarlos de forma más eficiente sin perder precisión.
Ventajas del aprendizaje activo#
Estas son algunas de las principales ventajas adicionales que puede ofrecer el aprendizaje activo:
- Abordar el desequilibrio de clases: el aprendizaje activo puede ayudar a abordar los problemas de desequilibrio de clases etiquetando instancias de las clases minoritarias. El modelo puede rendir mejor en situaciones poco frecuentes con datos limitados.
- Ciclos de desarrollo más rápidos: etiquetar menos datos acelera indirectamente el proceso de desarrollo de modelos de aprendizaje automático y visión por ordenador, lo que permite dedicar más tiempo y recursos a iteraciones y experimentos adicionales.
- Adaptabilidad: puede mejorar continuamente los datos de entrenamiento mediante iteraciones sobre muestras inciertas o casos límite, por lo que resulta adecuado para conjuntos de datos dinámicos o en evolución.
El aprendizaje activo y AutoML pueden trabajar juntos#
El aprendizaje automático automatizado (AutoML) se centra en automatizar las tareas laboriosas e iterativas que intervienen en la creación y el despliegue de modelos de aprendizaje automático. Simplifica los flujos de trabajo de aprendizaje automático al automatizar tareas como la selección de modelos y la evaluación del rendimiento, reduciendo la necesidad de trabajo manual.
Al integrarse con el aprendizaje activo, AutoML puede acelerar y optimizar el ciclo de vida del desarrollo de modelos. El componente de aprendizaje activo selecciona estratégicamente los datos más informativos para etiquetarlos, mientras que AutoML perfecciona el modelo automatizando la elección de la arquitectura, los parámetros y el ajuste.

Fig. 4. Flujo de trabajo de AutoML.
Veamos esta combinación de tecnologías con un ejemplo.
Supongamos que intentas detectar enfermedades poco frecuentes en imágenes médicas (un caso de uso en el que los conjuntos de datos etiquetados son limitados y caros de obtener). El aprendizaje activo puede identificar y seleccionar datos inciertos, como cambios sutiles en imágenes de rayos X que el modelo no consigue clasificar. Después, se puede dar prioridad a los datos inciertos para su anotación manual con el fin de mejorar la comprensión del modelo.
Con los datos anotados, AutoML puede optimizar el modelo explorando diversas arquitecturas, hiperparámetros y otras técnicas de aumento de datos. El proceso iterativo acelera el desarrollo de modelos de visión fiables como Ultralytics YOLO11, que ayudan a los profesionales sanitarios a realizar diagnósticos precisos.
Retos del aprendizaje activo#
El aprendizaje activo y sus técnicas ofrecen numerosas ventajas, pero hay algunos aspectos que debes tener en cuenta al implementar estas estrategias:
- Selección de la estrategia de consulta: el aprendizaje activo incluye muchas técnicas, y elegir el mejor método influye considerablemente en la eficacia del modelo. Seleccionar una estrategia inadecuada puede reducir el rendimiento del modelo para una aplicación concreta.
- Costes del reentrenamiento: la naturaleza iterativa del aprendizaje activo requiere recursos computacionales costosos, especialmente con conjuntos de datos grandes. El modelo se vuelve a entrenar después de cada ronda de etiquetado, lo que aumenta su complejidad.
- Calidad del modelo inicial: la eficacia del aprendizaje activo depende de la calidad del modelo inicial. Un modelo inicial con un rendimiento deficiente puede no identificar correctamente los datos informativos, lo que da lugar a solicitudes de etiquetado de menor calidad y reduce el rendimiento general.
El futuro del aprendizaje activo y AutoML#
Con los avances recientes en IA y visión por ordenador, el aprendizaje activo está preparado para abordar retos más complejos y agilizar los flujos de trabajo de aprendizaje automático. Combinar el aprendizaje activo con técnicas como el aprendizaje federado y el aprendizaje autosupervisado puede mejorar aún más la eficiencia y la escalabilidad de los modelos de visión.
El aprendizaje federado permite entrenar un modelo en varios dispositivos o servidores mediante un marco distribuido sin que los datos tengan que salir de su ubicación original. En sectores como la sanidad, donde la privacidad de los datos es importante, el aprendizaje federado permite entrenar directamente con datos locales sensibles y mantenerlos protegidos. En lugar de compartir datos sin procesar, solo se comparten actualizaciones o conocimientos del modelo, lo que garantiza la protección de la información privada y su contribución al proceso de entrenamiento.
Mientras tanto, el aprendizaje autosupervisado ayuda a reducir la necesidad de datos etiquetados al preentrenar modelos con datos sin etiquetar. Este proceso crea una base sólida para el modelo. El aprendizaje activo puede aprovecharla identificando y seleccionando los datos más importantes para la anotación humana y perfeccionando aún más el modelo.
Del aprendizaje activo al impacto activo#
El aprendizaje activo ofrece una forma práctica de abordar retos importantes de la visión por ordenador, como el elevado coste de la anotación de datos y la necesidad de modelos más precisos. Al centrarse en etiquetar únicamente los datos más valiosos, reduce el esfuerzo necesario por parte de las personas y mejora el rendimiento del modelo.
Cuando se combina con tecnologías como AutoML, el aprendizaje activo agiliza el desarrollo de modelos al automatizar tareas laboriosas. A medida que continúan los avances, el aprendizaje activo está destinado a convertirse en una herramienta esencial para crear sistemas de visión por ordenador más inteligentes y eficientes.
Explora nuestro repositorio de GitHub y únete a nuestra comunidad para obtener más información sobre la IA y los modelos de visión por ordenador. Descubre más aplicaciones de la visión por ordenador en la fabricación y la sanidad en nuestras páginas de soluciones. También puedes consultar nuestras opciones de licencia para comenzar hoy mismo tu trayectoria en IA para visión.









