La guía definitiva sobre el aumento de datos en 2025
Descubre cómo el aumento de datos de imágenes ayuda a los modelos de IA visual a aprender mejor, mejorar la precisión y rendir con mayor eficacia en situaciones del mundo real.

Debido al auge de la IA, fenómenos como los robots trabajando en fábricas y los coches autónomos circulando por las calles aparecen cada vez más en los titulares. La IA está cambiando la forma en que las máquinas interactúan con el mundo, desde la mejora de las imágenes médicas hasta la asistencia en el control de calidad de las líneas de producción.
Gran parte de este progreso se debe a la visión por ordenador, una rama de la IA que permite a las máquinas comprender e interpretar imágenes. Al igual que las personas aprenden a reconocer objetos y patrones con el tiempo, los modelos de IA de visión, como Ultralytics YOLO11, deben entrenarse con grandes cantidades de datos de imágenes para desarrollar su comprensión visual.
Sin embargo, recopilar una cantidad tan enorme de datos visuales no siempre es fácil. Aunque la comunidad de visión por ordenador ha creado muchos conjuntos de datos grandes, todavía pueden pasar por alto ciertas variaciones, como imágenes con objetos con poca luz, elementos parcialmente ocultos o cosas vistas desde distintos ángulos. Estas diferencias pueden confundir a los modelos de visión por ordenador que solo se han entrenado en condiciones específicas.
El aumento de datos de imágenes es una técnica que resuelve este problema introduciendo nuevas variaciones en los datos existentes. Al realizar cambios en las imágenes, como ajustar los colores, girarlas o modificar la perspectiva, el conjunto de datos se vuelve más diverso, lo que ayuda a los modelos de IA de visión a reconocer mejor los objetos en situaciones reales.
En este artículo, veremos cómo funciona el aumento de datos de imágenes y el impacto que puede tener en las aplicaciones de visión por ordenador.
¿Qué es el aumento de datos de imágenes?#
Imagina que intentas reconocer a un amigo entre una multitud, pero lleva gafas de sol o está en una zona sombría. Aunque estos pequeños cambios de apariencia, sigues sabiendo quién es. En cambio, un modelo de IA de visión puede tener dificultades con estas variaciones si no se ha entrenado para reconocer objetos en distintos contextos.
El aumento de datos de imágenes mejora el rendimiento de los modelos de visión por ordenador al añadir versiones modificadas de imágenes existentes a los datos de entrenamiento, en lugar de recopilar miles de imágenes nuevas.
Los cambios en las imágenes, como voltearlas, girarlas, ajustar el brillo o añadir pequeñas distorsiones, exponen a los modelos de IA de visión a una gama más amplia de condiciones. En lugar de depender de conjuntos de datos enormes, los modelos pueden aprender de forma eficiente a partir de conjuntos de datos de entrenamiento más pequeños con imágenes aumentadas.

Fig. 1 Ejemplos de imágenes aumentadas de un coche.
La importancia del aumento de datos en la visión por ordenador#
Estas son algunas de las razones principales por las que el aumento de datos es esencial para la visión por ordenador:
- Reduce los requisitos de datos: Recopilar grandes conjuntos de datos de imágenes requiere tiempo y recursos. El aumento de datos permite entrenar modelos de forma eficaz sin necesitar conjuntos de datos enormes.
- Evita el sobreajuste: Un modelo entrenado con muy pocos ejemplos puede memorizar detalles en lugar de reconocer patrones generales. Añadir variedad mediante el aumento de datos garantiza que los modelos de IA de visión aprendan de una forma aplicable a datos nuevos y no vistos.
- Imita imágenes imperfectas: Las imágenes de los conjuntos de datos suelen ser demasiado perfectas, pero las fotos del mundo real pueden estar borrosas, ocultas o distorsionadas. Aumentar las imágenes con ruido, oclusiones u otras variaciones las hace más realistas.
- Mejora la robustez del modelo: Entrenar con una variedad de imágenes ayuda a la IA a gestionar los cambios del mundo real, lo que la hace más fiable en distintos entornos, condiciones de iluminación y situaciones.
¿Cuándo debes usar el aumento de datos de imágenes?#
El aumento de datos de imágenes resulta especialmente útil cuando un modelo de visión por ordenador necesita reconocer objetos en distintas situaciones, pero no dispone de suficientes imágenes variadas.
Por ejemplo, si unos investigadores están entrenando un modelo de IA de visión para identificar especies submarinas poco comunes que rara vez se fotografían, el conjunto de datos puede ser pequeño o carecer de variedad. Al aumentar las imágenes —ajustando los colores para simular distintas profundidades del agua, añadiendo ruido para imitar condiciones turbias o alterando ligeramente las formas para tener en cuenta el movimiento natural—, el modelo puede aprender a detectar objetos submarinos con mayor precisión.
Estas son otras situaciones en las que el aumento de datos marca una gran diferencia:
- Equilibrio del conjunto de datos: Algunos objetos pueden aparecer con menos frecuencia en los datos de entrenamiento, lo que puede sesgar a los modelos de IA de visión. El aumento de datos ayuda a crear más ejemplos de objetos poco comunes para que el modelo pueda reconocer todas las categorías de forma justa.
- Adaptación a distintas cámaras: Las imágenes pueden tener un aspecto diferente según el dispositivo. El aumento de datos ayuda a los modelos de IA de visión a funcionar bien con fotos de distintas resoluciones, condiciones de iluminación y calidad.
- Corrección de pequeños errores de etiquetado: Los pequeños desplazamientos, recortes o giros ayudan a los modelos de visión por ordenador a reconocer correctamente los objetos, aunque las etiquetas originales no estén perfectamente alineadas.
Cómo funciona el aumento de datos de imágenes#
En los inicios de la visión por ordenador, el aumento de datos de imágenes consistía principalmente en técnicas básicas de procesamiento de imágenes, como voltear, girar y recortar, para aumentar la diversidad del conjunto de datos. A medida que la IA mejoró, se introdujeron métodos más avanzados, como ajustar los colores (transformaciones del espacio de color), enfocar o desenfocar imágenes (filtros de kernel) y combinar varias imágenes (mezcla de imágenes) para mejorar el aprendizaje.
El aumento de datos puede realizarse antes y durante el entrenamiento del modelo. Antes del entrenamiento, se pueden añadir imágenes modificadas al conjunto de datos para proporcionar más variedad. Durante el entrenamiento, las imágenes pueden alterarse aleatoriamente en tiempo real, lo que ayuda a los modelos de IA de visión a adaptarse a distintas condiciones.
Estos cambios se realizan mediante transformaciones matemáticas. Por ejemplo, la rotación inclina una imagen, el recorte elimina partes para imitar distintas vistas y los cambios de brillo simulan variaciones de iluminación. El desenfoque suaviza las imágenes, el enfoque hace que los detalles sean más nítidos y la mezcla de imágenes combina partes de distintas imágenes. Los frameworks de IA de visión y herramientas como OpenCV, TensorFlow y PyTorch pueden automatizar estos procesos, haciendo que el aumento de datos sea rápido y eficaz.
Principales técnicas de aumento de datos de imágenes#
Ahora que hemos explicado qué es el aumento de datos de imágenes, veamos más de cerca algunas técnicas fundamentales de aumento de datos de imágenes utilizadas para mejorar los datos de entrenamiento.
Ajuste de la orientación y la posición#
Los modelos de visión por ordenador, como YOLO11, a menudo necesitan reconocer objetos desde distintos ángulos y puntos de vista. Para ayudar con esto, las imágenes pueden voltearse horizontal o verticalmente, de modo que el modelo de IA aprenda a reconocer objetos desde diferentes perspectivas.
Del mismo modo, girar ligeramente las imágenes cambia su ángulo y permite al modelo identificar objetos desde múltiples perspectivas. Además, desplazar las imágenes en distintas direcciones (traslación) ayuda a los modelos a adaptarse a pequeños cambios de posición. Estas transformaciones garantizan que los modelos generalicen mejor a las condiciones del mundo real, donde la colocación de los objetos en una imagen es impredecible.

Fig. 2 Diferentes métodos de aumento relacionados con la orientación y la posición.
Cambio de tamaño y recorte#
En lo que respecta a las soluciones de visión por ordenador del mundo real, los objetos de las imágenes pueden aparecer a distintas distancias y con diferentes tamaños. Los modelos de IA de visión deben ser lo bastante robustos como para detectarlos independientemente de estas diferencias.
Para mejorar la adaptabilidad, pueden utilizarse los siguientes métodos de aumento de datos:
- Escalado: Cambiar el tamaño modifica las dimensiones de la imagen manteniendo sus proporciones, lo que permite a los modelos de IA detectar objetos a distintas distancias.
- Recorte: Elimina las partes innecesarias de una imagen, ayudando al modelo a centrarse en las áreas clave y reduciendo las distracciones del fondo.
- Cizallado: Inclinar ligeramente una imagen simula un aspecto inclinado o estirado, lo que ayuda a la IA a reconocer objetos desde distintos ángulos.
Estos ajustes ayudan a los modelos de visión por ordenador a reconocer objetos aunque su tamaño o forma cambien ligeramente.
Ajustes de perspectiva y distorsión#
Los objetos de las imágenes pueden tener un aspecto diferente según el ángulo de la cámara, lo que dificulta su reconocimiento para los modelos de visión por ordenador. Para ayudar a los modelos a gestionar estas variaciones, las técnicas de aumento pueden ajustar la forma en que se presentan los objetos en las imágenes.
Por ejemplo, las transformaciones de perspectiva pueden cambiar el ángulo de visión y hacer que un objeto parezca visto desde una posición diferente. Esto permite a los modelos de IA de visión reconocer objetos aunque estén inclinados o se hayan capturado desde un punto de vista inusual.
Otro ejemplo es una transformación elástica, que estira, dobla o deforma las imágenes para simular distorsiones naturales, de modo que los objetos aparezcan como lo harían en reflejos o bajo presión.
Modificaciones del color y la iluminación#
Las condiciones de iluminación y las diferencias de color pueden afectar significativamente a la forma en que los modelos de IA de visión interpretan las imágenes. Dado que los objetos pueden tener un aspecto diferente bajo distintos ajustes de iluminación, las siguientes técnicas de aumento pueden ayudar a gestionar estas situaciones:
- Ajustes de brillo y contraste: Simular distintas condiciones de iluminación ayuda a los modelos de IA de visión a reconocer objetos tanto en entornos luminosos como oscuros.
- Variación aleatoria del color: Cambiar aleatoriamente el tono, la saturación y el equilibrio de color hace que los modelos de visión por ordenador se adapten mejor a distintas cámaras y condiciones de iluminación.
- Conversión a escala de grises: Convertir las imágenes a blanco y negro anima a los modelos de IA de visión a centrarse en las formas y las texturas, en lugar de en el color.

Fig. 3 Ejemplos de aumentos relacionados con las variaciones de color.
Técnicas avanzadas de aumento de datos de imágenes#
Hasta ahora, solo hemos explorado técnicas de aumento que modifican una sola imagen. Sin embargo, algunos métodos avanzados implican combinar varias imágenes para mejorar el aprendizaje de la IA.
Por ejemplo, MixUp combina dos imágenes, lo que ayuda a los modelos de visión por ordenador a comprender las relaciones entre objetos y mejora su capacidad de generalizar en distintos escenarios. CutMix lleva esto un paso más allá al sustituir una sección de una imagen por una parte de otra, lo que permite a los modelos aprender de múltiples contextos dentro de la misma imagen. Por su parte, CutOut funciona de forma diferente: elimina partes aleatorias de una imagen para entrenar a los modelos de IA de visión a reconocer objetos aunque estén parcialmente ocultos u obstruidos.

Fig. 4 Técnicas avanzadas de aumento de datos de imágenes.
El papel de la IA generativa en el aumento de datos de imágenes#
La IA generativa está ganando popularidad en muchos sectores y aplicaciones cotidianas. Probablemente te hayas encontrado con ella en relación con imágenes generadas por IA, vídeos deepfake o aplicaciones que crean avatares realistas. Pero, más allá de la creatividad y el entretenimiento, la IA generativa desempeña un papel crucial en el entrenamiento de modelos de IA de visión al generar nuevas imágenes a partir de otras existentes.
En lugar de limitarse a voltear o girar imágenes, puede crear variaciones realistas: cambiar las expresiones faciales, los estilos de ropa o incluso simular distintas condiciones meteorológicas. Estas variaciones ayudan a los modelos de visión por ordenador a ser más adaptables y precisos en diversos escenarios del mundo real. Los modelos avanzados de IA generativa, como las GANs (redes generativas antagónicas) y los modelos de difusión, también pueden completar detalles que faltan o crear imágenes sintéticas de alta calidad.
Limitaciones del aumento de datos de imágenes#
Aunque el aumento de datos mejora los conjuntos de datos de entrenamiento, también presenta algunas limitaciones que conviene tener en cuenta. Estos son algunos desafíos clave relacionados con el aumento de datos de imágenes:
- Diversidad de datos limitada: Las imágenes aumentadas proceden de datos existentes y no pueden introducir patrones completamente nuevos ni perspectivas poco comunes.
- Posible distorsión de los datos: Las transformaciones excesivas pueden hacer que las imágenes parezcan irreales, lo que podría reducir la precisión del modelo en situaciones del mundo real.
- Aumento del procesamiento: El aumento de datos en tiempo real que tiene lugar durante el entrenamiento del modelo puede requerir bastante potencia de procesamiento, ralentizar el entrenamiento y aumentar el uso de memoria.
- El desequilibrio de clases persiste: El aumento de datos no crea muestras completamente nuevas, por lo que las categorías infrarrepresentadas todavía pueden dar lugar a un aprendizaje sesgado.
Una aplicación real del aumento de datos de imágenes#
Una aplicación interesante del aumento de datos de imágenes se encuentra en los coches autónomos, donde las decisiones tomadas en fracciones de segundo por modelos de visión por ordenador como Ultralytics YOLO11 son cruciales. El modelo debe ser capaz de detectar carreteras, personas y otros objetos con precisión.
Sin embargo, las condiciones del mundo real a las que se enfrenta un vehículo autónomo pueden ser impredecibles. El mal tiempo, el desenfoque por movimiento y las señales ocultas pueden hacer que las soluciones de IA de visión de este sector sean complejas. Entrenar modelos de visión por ordenador únicamente con imágenes del mundo real a menudo no es suficiente. Los conjuntos de datos de imágenes para los modelos de los coches autónomos deben ser diversos para que el modelo aprenda a gestionar situaciones inesperadas.
El aumento de datos de imágenes resuelve este problema simulando niebla, ajustando el brillo y distorsionando las formas. Estos cambios ayudan a los modelos a reconocer objetos en distintas condiciones. Como resultado, los modelos se vuelven más inteligentes y fiables.
Con un entrenamiento aumentado, las soluciones de IA de visión para coches autónomos se adaptan mejor y toman decisiones más seguras. Unos resultados más precisos se traducen en menos accidentes y una navegación mejorada.

Fig. 5 Un ejemplo de aumento de datos de imágenes aplicado a coches autónomos.
Los coches autónomos son solo un ejemplo. De hecho, el aumento de datos de imágenes es crucial en una amplia variedad de sectores, desde las imágenes médicas hasta la analítica del comercio minorista. Cualquier aplicación que dependa de la visión por ordenador puede beneficiarse potencialmente del aumento de datos de imágenes.
Conclusiones clave#
Los sistemas de IA de visión deben ser capaces de reconocer objetos en distintas condiciones, pero recopilar infinitas imágenes del mundo real para el entrenamiento puede ser difícil. El aumento de datos de imágenes resuelve este problema creando variaciones de imágenes existentes, lo que ayuda a los modelos a aprender más rápido y rendir mejor en situaciones reales. Mejora la precisión y garantiza que los modelos de IA de visión, como Ultralytics YOLO11, puedan gestionar distintas condiciones de iluminación, ángulos y entornos.
Para las empresas y los desarrolladores, el aumento de datos de imágenes ahorra tiempo y esfuerzo y, al mismo tiempo, hace que los modelos de visión por ordenador sean más fiables. Desde la sanidad hasta los coches autónomos, muchos sectores dependen de él. A medida que la IA de visión siga evolucionando, el aumento de datos continuará siendo una parte esencial de la creación de modelos más inteligentes y adaptables para el futuro.
Únete a nuestra comunidad y visita nuestro repositorio de GitHub para ver la IA en acción. Explora nuestras opciones de licencia y descubre más sobre la IA en la agricultura y la visión por ordenador en la fabricación en nuestras páginas de soluciones.









