Ultralytics YOLO27:
Guías

Mejora la robustez de los modelos de IA con el aumento de datos

Descubre cómo añadir variaciones realistas a los datos de entrenamiento mediante el aumento de datos ayuda a mejorar la robustez de los modelos de IA y su rendimiento en el mundo real.

ABAbirami Vina10 min read
Mejora la robustez de los modelos de IA con el aumento de datos

Las pruebas son una parte crucial de la creación de cualquier solución tecnológica. Muestran a los equipos cómo funciona realmente un sistema antes de ponerse en producción y les permiten solucionar los problemas con antelación. Esto es aplicable a muchos campos, incluida la IA, donde se espera que los modelos gestionen condiciones impredecibles del mundo real una vez desplegados.

Por ejemplo, la visión artificial es una rama de la IA que enseña a las máquinas a comprender imágenes y vídeos. Los modelos de visión artificial, como Ultralytics YOLO26, permiten realizar tareas como la detección de objetos, la segmentación de instancias y la clasificación de imágenes.

Pueden utilizarse en muchos sectores para aplicaciones como la monitorización de pacientes, el análisis del tráfico, las cajas de pago automatizadas y la inspección de calidad en la fabricación. Sin embargo, incluso con modelos avanzados y datos de entrenamiento de alta calidad, las soluciones de IA visual pueden seguir teniendo dificultades cuando se enfrentan a variaciones del mundo real, como cambios de iluminación, movimiento u objetos parcialmente obstruidos.

Esto ocurre porque los modelos aprenden a partir de los ejemplos que reciben durante el entrenamiento. Si no han visto antes condiciones como reflejos intensos, desenfoque por movimiento o visibilidad parcial, es menos probable que reconozcan correctamente los objetos en esas situaciones.

Una forma de mejorar la robustez de los modelos es mediante la augmentación de datos. En lugar de recopilar grandes cantidades de datos nuevos, los ingenieros pueden realizar cambios pequeños y significativos en las imágenes existentes, como ajustar la iluminación, recortar o mezclar imágenes. Esto ayuda al modelo a aprender a reconocer los mismos objetos en un abanico más amplio de situaciones.

En este artículo, veremos cómo la augmentación de datos mejora la robustez de los modelos y la fiabilidad de los sistemas de IA visual cuando se despliegan fuera de entornos controlados. ¡Empecemos!

Cómo comprobar la robustez de un modelo#

Antes de profundizar en la augmentación de datos, veamos cómo saber si un modelo de visión artificial está realmente preparado para utilizarse en el mundo real.

Un modelo robusto sigue ofreciendo un buen rendimiento incluso cuando cambian las condiciones, en lugar de funcionar únicamente con imágenes limpias y perfectamente etiquetadas. Estos son algunos factores prácticos que debes tener en cuenta al evaluar la robustez de un modelo de IA:

  • Cambios de iluminación: Los modelos pueden comportarse de forma diferente al exponerse a luz intensa, poca luz, reflejos o sombras, lo que puede afectar a la confianza con la que se detectan los objetos.
  • Oclusión parcial: En las escenas cotidianas, otros elementos suelen bloquear los objetos o estos solo son parcialmente visibles. Un modelo más robusto puede reconocerlos incluso cuando falta información visual.
  • Escenas concurridas: Los entornos con muchos objetos superpuestos pueden dificultar la detección. Los modelos que funcionan bien en estos casos suelen ser más fiables en situaciones complejas.

Los buenos resultados con imágenes limpias y perfectamente capturadas no siempre se traducen en un rendimiento sólido en el mundo real. Las pruebas periódicas en condiciones variadas ayudan a mostrar hasta qué punto un modelo mantiene su rendimiento una vez desplegado.

¿Qué es la augmentación de datos?#

La forma en que aparece un objeto en una fotografía puede cambiar según la iluminación, el ángulo, la distancia o el fondo. Cuando se entrena un modelo de visión artificial, el conjunto de datos del que aprende debe incluir este tipo de variación para que pueda funcionar bien en entornos impredecibles.

La augmentación de datos amplía un conjunto de datos de entrenamiento mediante la creación de ejemplos adicionales a partir de las imágenes que ya tienes. Para ello, se aplican cambios intencionados, como girar o voltear una imagen, ajustar el brillo o recortar una parte de ella.

Por ejemplo, imagina que solo tienes una foto de un gato. Si giras la imagen o cambias su brillo, puedes crear varias versiones nuevas a partir de esa única imagen. Cada versión tiene un aspecto ligeramente diferente, pero sigue siendo una foto del mismo gato. Estas variaciones ayudan a enseñar al modelo que un objeto puede tener un aspecto distinto y seguir siendo el mismo.

Una vista de la augmentación de una imagen de un gato

Fig. 1. Una vista de la augmentación de una imagen de un gato (Fuente)

Cómo mejora el rendimiento de los modelos la augmentación de datos#

Durante el entrenamiento del modelo, la augmentación de datos puede incorporarse directamente a la canalización de entrenamiento. En lugar de crear y almacenar manualmente nuevas copias de las imágenes, se pueden aplicar transformaciones aleatorias cada vez que se carga una imagen.

Esto significa que el modelo ve una versión ligeramente diferente de la imagen cada vez, ya sea con más brillo, volteada o parcialmente oculta. Técnicas como el borrado aleatorio pueden incluso eliminar pequeñas regiones de la imagen para simular situaciones del mundo real en las que un objeto está bloqueado o solo es parcialmente visible.

Ejemplos de augmentación mediante borrado aleatorio

Fig. 2. Ejemplos de augmentación mediante borrado aleatorio (Fuente)

Ver muchas versiones diferentes de la misma imagen permite al modelo aprender qué características son importantes, en lugar de depender de un único ejemplo perfecto. Esta variedad desarrolla la robustez del modelo de IA para que pueda funcionar de forma más fiable en condiciones del mundo real.

Técnicas habituales de augmentación de datos#

Estas son algunas técnicas de augmentación de datos utilizadas para introducir variación en las imágenes de entrenamiento:

  • Transformaciones geométricas: Estas técnicas cambian la forma en que aparece espacialmente un objeto dentro de una imagen. Girar, voltear, cambiar el tamaño, recortar o desplazar una imagen permite al modelo comprender cómo se puede ver un objeto desde diferentes ángulos o distancias.
  • Ajustes de color e iluminación: La iluminación del mundo real rara vez es constante. Las imágenes pueden ser demasiado claras, demasiado oscuras o presentar ligeras desviaciones de color, según el entorno o la cámara utilizada. Ajustar el brillo, el contraste, el tono y la saturación permite a los modelos gestionar estos cambios visuales y funcionar bien en diferentes escenas.
  • Variaciones de calidad de imagen: El desenfoque o el ruido visual pueden hacer que las imágenes no sean nítidas. Añadir desenfoque o ruido durante el entrenamiento ayuda al modelo a aprender a gestionar el desenfoque por movimiento, las imágenes con poca luz o los resultados de cámaras de menor calidad, por lo que se vuelve menos sensible a las imágenes imperfectas.
  • Augmentaciones basadas en oclusiones: En los entornos reales, otros objetos suelen bloquear parcialmente los objetos. Esto se conoce como oclusión de imágenes. Ocultar o enmascarar pequeñas áreas de una imagen durante el entrenamiento ayuda al modelo a aprender a detectar objetos incluso cuando solo es visible una parte de ellos.
  • Augmentaciones con múltiples imágenes: Estas técnicas combinan partes de varias imágenes en un único ejemplo de entrenamiento, lo que puede aumentar el número de objetos visibles y mejorar la capacidad del modelo para gestionar escenas complejas o concurridas.

Un ejemplo de augmentación con múltiples imágenes

Fig. 3. Un ejemplo de augmentación con múltiples imágenes (Fuente)

La augmentación de datos simplificada con el paquete Python de Ultralytics#

Gestionar conjuntos de datos, crear variaciones de imágenes y escribir código de transformación puede añadir pasos adicionales a la creación de una aplicación de visión artificial. El paquete Python de Ultralytics ayuda a simplificar este proceso al proporcionar una única interfaz para entrenar, ejecutar y desplegar modelos Ultralytics YOLO como YOLO26. Como parte de este esfuerzo por agilizar los flujos de trabajo de entrenamiento, el paquete incluye augmentación de datos integrada, probada por Ultralytics y optimizada para modelos YOLO.

También admite integraciones útiles que eliminan la necesidad de utilizar herramientas independientes o código personalizado. En concreto, para la augmentación de datos, el paquete se integra con Albumentations, una biblioteca de augmentación de imágenes muy utilizada. Esta integración permite aplicar augmentaciones automáticamente durante el entrenamiento, sin necesidad de scripts adicionales ni código personalizado.

Gestión de anotaciones y conjuntos de datos aumentados#

Otro factor que afecta a la robustez de los modelos es la calidad de la anotación. Las etiquetas limpias y precisas, creadas y gestionadas con herramientas de anotación como Roboflow, ayudan al modelo a comprender dónde están los objetos y qué aspecto tienen.

Durante el entrenamiento, las augmentaciones de datos, como voltear, recortar y girar, se aplican dinámicamente, y las anotaciones se ajustan automáticamente para adaptarse a estos cambios. Cuando las etiquetas son precisas, este proceso funciona sin problemas y proporciona al modelo muchos ejemplos realistas de la misma escena.

Si las anotaciones son inexactas o incoherentes, esos errores pueden repetirse en las imágenes aumentadas, lo que puede hacer que el entrenamiento sea menos eficaz. Empezar con anotaciones precisas evita que estos errores se propaguen y contribuye a mejorar la robustez del modelo.

Mejora de las aplicaciones de IA visual con augmentación de datos#

A continuación, veremos ejemplos de cómo la augmentación de datos contribuye a la robustez de los modelos de IA en aplicaciones del mundo real.

Mejora de la precisión de la detección de objetos en entornos reales#

Las imágenes sintéticas se utilizan a menudo para entrenar sistemas de detección de objetos cuando los datos reales son limitados, sensibles o difíciles de recopilar. Permiten a los equipos generar rápidamente ejemplos de productos, entornos y ángulos de cámara sin tener que capturar todas las situaciones en la vida real.

Sin embargo, los conjuntos de datos sintéticos a veces pueden parecer demasiado limpios en comparación con las grabaciones del mundo real, donde la iluminación cambia, los objetos se superponen y las escenas incluyen elementos de fondo que distraen. La augmentación de datos ayuda a salvar esta diferencia al introducir variaciones realistas, como diferentes condiciones de iluminación, ruido o posiciones de los objetos, para que el modelo aprenda a gestionar los tipos de condiciones que verá cuando se despliegue.

Por ejemplo, en un estudio reciente, un modelo Ultralytics YOLO11 se entrenó íntegramente con imágenes sintéticas y se añadió augmentación de datos para introducir variación adicional. Esto contribuyó a que el modelo aprendiera a reconocer los objetos de forma más amplia. Funcionó bien al probarlo con imágenes reales, aunque nunca había visto datos del mundo real durante el entrenamiento.

Cómo hacer más fiables las soluciones de imagen médica#

Los conjuntos de datos de imágenes médicas suelen ser limitados, y las propias exploraciones pueden variar según el tipo de equipo, la configuración de adquisición de imágenes o el entorno clínico. Las diferencias en la anatomía de los pacientes, los ángulos, la iluminación o el ruido visual pueden dificultar que los modelos de visión artificial aprendan patrones que se generalicen bien entre pacientes y hospitales.

La augmentación de datos ayuda a abordar este problema mediante la creación de múltiples variaciones de la misma exploración durante el entrenamiento, como añadir ruido, desplazar ligeramente la imagen o aplicar pequeñas distorsiones. Estos cambios hacen que los datos de entrenamiento representen mejor las condiciones clínicas reales.

Por ejemplo, en un estudio de imagen pediátrica, los investigadores utilizaron Ultralytics YOLO11 para la segmentación anatómica y lo entrenaron con datos médicos aumentados. Introdujeron variaciones como ruido añadido, ligeros desplazamientos de posición y pequeñas distorsiones para hacer que las imágenes fueran más realistas.

Imágenes médicas pediátricas originales y aumentadas

Fig. 4. Imágenes médicas pediátricas originales y aumentadas (Fuente)

Al aprender a partir de estas variaciones, el modelo se centró en características anatómicas significativas en lugar de diferencias superficiales. Esto hizo que sus resultados de segmentación fueran más estables en distintas exploraciones y casos de pacientes.

Conclusiones clave#

Recopilar datos diversos es difícil, pero la augmentación de datos permite a los modelos aprender a partir de un abanico más amplio de condiciones visuales. Esto se traduce en una mayor robustez de los modelos al gestionar oclusiones, cambios de iluminación y escenas concurridas. En conjunto, les ayuda a funcionar de forma más fiable fuera de los entornos de entrenamiento controlados.

Únete a nuestra comunidad y descubre las últimas novedades en IA visual en nuestro repositorio de GitHub. Visita nuestras páginas de soluciones para saber cómo aplicaciones como la IA en la fabricación y la visión artificial en la sanidad están impulsando el progreso, y consulta nuestras opciones de licencia para impulsar tu próxima solución de IA.

Explore solutions

Visión por computadora para imágenes aéreas

Visión por computadora para imágenes aéreas

Transforma imágenes de drones y aéreas en información en tiempo real para agricultura, acuicultura, supervisión ambiental, conservación y análisis geoespacial con Ultralytics YOLO.
Más información
Visión artificial en la industria aeroespacial

Visión artificial en la industria aeroespacial

Lleva la IA de visión al monitoreo aéreo con los modelos Ultralytics YOLO. Potencia drones, flujos de trabajo aeroespaciales, conservación ambiental e industrias geoespaciales con soluciones de visión artificial.
Más información
Visión artificial en seguridad

Visión artificial en seguridad

Protege cada sitio con los modelos Ultralytics YOLO. La IA de visión potencia el monitoreo perimetral, la detección de amenazas, el reconocimiento de matrículas y la seguridad laboral.
Más información
Visión artificial en robótica

Visión artificial en robótica

Impulsa máquinas más inteligentes con los modelos de Ultralytics YOLO. La IA de visión en robótica permite la navegación autónoma, la percepción, el seguimiento de objetos y el control en tiempo real.
Más información
Visión artificial en logística

Visión artificial en logística

Optimiza la logística con los modelos de Ultralytics YOLO. La IA de visión permite inspeccionar paquetes, clasificarlos, realizar el seguimiento de vehículos y supervisar la seguridad de los almacenes en tiempo real.
Más información
Visión artificial en comercio minorista

Visión artificial en comercio minorista

Reinventa el comercio minorista con los modelos de Ultralytics YOLO. La IA de visión impulsa el seguimiento del inventario, la supervisión de estanterías, la gestión de colas y un conocimiento más inteligente de los clientes.
Más información
Visión por computador en el sector sanitario

Visión por computador en el sector sanitario

Crea soluciones sanitarias con modelos de Ultralytics YOLO. La IA de visión en el sector sanitario permite obtener imágenes médicas más rápidamente, diagnósticos más inteligentes y supervisar a los pacientes.
Más información
Visión por computador en la fabricación

Visión por computador en la fabricación

Optimiza la fabricación con modelos de Ultralytics YOLO. La IA de visión impulsa el control de calidad, la detección de defectos, el cumplimiento del PPE y la automatización de las líneas de montaje.
Más información
Visión artificial en el sector automovilístico

Visión artificial en el sector automovilístico

Aplica visión artificial en el sector automovilístico con modelos de Ultralytics YOLO. La IA de visión mejora la seguridad vial, la asistencia al conductor y la automatización de vehículos para conseguir carreteras más inteligentes.
Más información
Visión artificial en agricultura

Visión artificial en agricultura

Lleva la IA de visión a la agricultura inteligente con modelos de Ultralytics YOLO. Impulsa la supervisión de cultivos, el seguimiento del ganado y la agricultura de precisión para obtener cosechas mayores e inteligentes.
Más información
Visión por computadora para imágenes aéreas

Visión por computadora para imágenes aéreas

Transforma imágenes de drones y aéreas en información en tiempo real para agricultura, acuicultura, supervisión ambiental, conservación y análisis geoespacial con Ultralytics YOLO.
Más información
Visión artificial en la industria aeroespacial

Visión artificial en la industria aeroespacial

Lleva la IA de visión al monitoreo aéreo con los modelos Ultralytics YOLO. Potencia drones, flujos de trabajo aeroespaciales, conservación ambiental e industrias geoespaciales con soluciones de visión artificial.
Más información
Visión artificial en seguridad

Visión artificial en seguridad

Protege cada sitio con los modelos Ultralytics YOLO. La IA de visión potencia el monitoreo perimetral, la detección de amenazas, el reconocimiento de matrículas y la seguridad laboral.
Más información
Visión artificial en robótica

Visión artificial en robótica

Impulsa máquinas más inteligentes con los modelos de Ultralytics YOLO. La IA de visión en robótica permite la navegación autónoma, la percepción, el seguimiento de objetos y el control en tiempo real.
Más información
Visión artificial en logística

Visión artificial en logística

Optimiza la logística con los modelos de Ultralytics YOLO. La IA de visión permite inspeccionar paquetes, clasificarlos, realizar el seguimiento de vehículos y supervisar la seguridad de los almacenes en tiempo real.
Más información
Visión artificial en comercio minorista

Visión artificial en comercio minorista

Reinventa el comercio minorista con los modelos de Ultralytics YOLO. La IA de visión impulsa el seguimiento del inventario, la supervisión de estanterías, la gestión de colas y un conocimiento más inteligente de los clientes.
Más información
Visión por computador en el sector sanitario

Visión por computador en el sector sanitario

Crea soluciones sanitarias con modelos de Ultralytics YOLO. La IA de visión en el sector sanitario permite obtener imágenes médicas más rápidamente, diagnósticos más inteligentes y supervisar a los pacientes.
Más información
Visión por computador en la fabricación

Visión por computador en la fabricación

Optimiza la fabricación con modelos de Ultralytics YOLO. La IA de visión impulsa el control de calidad, la detección de defectos, el cumplimiento del PPE y la automatización de las líneas de montaje.
Más información
Visión artificial en el sector automovilístico

Visión artificial en el sector automovilístico

Aplica visión artificial en el sector automovilístico con modelos de Ultralytics YOLO. La IA de visión mejora la seguridad vial, la asistencia al conductor y la automatización de vehículos para conseguir carreteras más inteligentes.
Más información
Visión artificial en agricultura

Visión artificial en agricultura

Lleva la IA de visión a la agricultura inteligente con modelos de Ultralytics YOLO. Impulsa la supervisión de cultivos, el seguimiento del ganado y la agricultura de precisión para obtener cosechas mayores e inteligentes.
Más información
Visión por computadora para imágenes aéreas

Visión por computadora para imágenes aéreas

Transforma imágenes de drones y aéreas en información en tiempo real para agricultura, acuicultura, supervisión ambiental, conservación y análisis geoespacial con Ultralytics YOLO.
Más información
Visión artificial en la industria aeroespacial

Visión artificial en la industria aeroespacial

Lleva la IA de visión al monitoreo aéreo con los modelos Ultralytics YOLO. Potencia drones, flujos de trabajo aeroespaciales, conservación ambiental e industrias geoespaciales con soluciones de visión artificial.
Más información
Visión artificial en seguridad

Visión artificial en seguridad

Protege cada sitio con los modelos Ultralytics YOLO. La IA de visión potencia el monitoreo perimetral, la detección de amenazas, el reconocimiento de matrículas y la seguridad laboral.
Más información
Visión artificial en robótica

Visión artificial en robótica

Impulsa máquinas más inteligentes con los modelos de Ultralytics YOLO. La IA de visión en robótica permite la navegación autónoma, la percepción, el seguimiento de objetos y el control en tiempo real.
Más información
Visión artificial en logística

Visión artificial en logística

Optimiza la logística con los modelos de Ultralytics YOLO. La IA de visión permite inspeccionar paquetes, clasificarlos, realizar el seguimiento de vehículos y supervisar la seguridad de los almacenes en tiempo real.
Más información
Visión artificial en comercio minorista

Visión artificial en comercio minorista

Reinventa el comercio minorista con los modelos de Ultralytics YOLO. La IA de visión impulsa el seguimiento del inventario, la supervisión de estanterías, la gestión de colas y un conocimiento más inteligente de los clientes.
Más información
Visión por computador en el sector sanitario

Visión por computador en el sector sanitario

Crea soluciones sanitarias con modelos de Ultralytics YOLO. La IA de visión en el sector sanitario permite obtener imágenes médicas más rápidamente, diagnósticos más inteligentes y supervisar a los pacientes.
Más información
Visión por computador en la fabricación

Visión por computador en la fabricación

Optimiza la fabricación con modelos de Ultralytics YOLO. La IA de visión impulsa el control de calidad, la detección de defectos, el cumplimiento del PPE y la automatización de las líneas de montaje.
Más información
Visión artificial en el sector automovilístico

Visión artificial en el sector automovilístico

Aplica visión artificial en el sector automovilístico con modelos de Ultralytics YOLO. La IA de visión mejora la seguridad vial, la asistencia al conductor y la automatización de vehículos para conseguir carreteras más inteligentes.
Más información
Visión artificial en agricultura

Visión artificial en agricultura

Lleva la IA de visión a la agricultura inteligente con modelos de Ultralytics YOLO. Impulsa la supervisión de cultivos, el seguimiento del ganado y la agricultura de precisión para obtener cosechas mayores e inteligentes.
Más información

¡Construyamos juntos el futuro de la IA!

Comienza tu recorrido hacia el futuro del aprendizaje automático