Ultralytics YOLO27:
IA visual

5 razones por las que los modelos de visión artificial fallan en producción

Descubre por qué los modelos de visión artificial fallan en producción, desde las discrepancias en los datos hasta la latencia, y cómo pueden los equipos mejorar el rendimiento de los modelos en sistemas de IA para visión del mundo real.

ABAbirami Vina11 min read
Razones por las que los modelos de visión artificial fallan en producción

La visión por ordenador es ahora una tecnología clave de inteligencia artificial que se está adoptando en la mayoría de los sectores, lo que permite a las máquinas interpretar y analizar datos visuales para una amplia variedad de tareas. Estos sistemas permiten numerosas aplicaciones del mundo real, desde la obtención de imágenes médicas y la robótica hasta la fabricación y la automatización del comercio minorista.

Sin embargo, crear un sistema de visión por ordenador no siempre es sencillo. Normalmente implica desarrollar un modelo de IA de visión entrenado para identificar patrones en imágenes y vídeos y realizar tareas como la detección y el seguimiento de objetos.

Un ejemplo de detección y seguimiento de objetos

Fig. 1. Un ejemplo de detección y seguimiento de objetos (Fuente)

Aunque los modelos de visión por ordenador son cada vez más avanzados, todavía pueden comportarse de forma diferente durante el desarrollo que después de su implementación en entornos del mundo real. Esto se debe a que implementar modelos fuera de entornos de desarrollo controlados introduce desafíos nuevos y, a menudo, inesperados.

Factores como la falta de diversidad en los conjuntos de datos, una supervisión deficiente del modelo y las limitaciones de la infraestructura pueden hacer que el mismo modelo se comporte de forma diferente en el mundo real después de su implementación.

En este artículo, analizaremos cinco razones habituales por las que los modelos de visión por ordenador pueden no rendir adecuadamente en producción. ¡Empecemos!

La brecha entre el entrenamiento del modelo y la producción#

El entrenamiento del modelo suele realizarse en un entorno controlado. Durante esta etapa, los desarrolladores de IA trabajan con conjuntos de datos de entrenamiento preparados cuidadosamente.

Estas enormes colecciones de datos visuales incluyen anotaciones bien estructuradas, o etiquetas que describen el contenido de cada imagen. El entrenamiento también se realiza en condiciones constantes, lo que permite que los modelos de IA de visión aprendan patrones visuales de forma eficaz.

Para garantizar que estos patrones se aprendan correctamente, los modelos pueden evaluarse sistemáticamente durante el desarrollo mediante métricas de evaluación estándar y conjuntos de datos de referencia. Al igual que los conjuntos de datos de entrenamiento, estos conjuntos de datos de referencia también se preparan cuidadosamente.

Sin embargo, los datos con los que se encuentran los sistemas de visión por ordenador en el mundo real pueden ser muy diferentes de los datos utilizados durante el entrenamiento y la evaluación. Una vez implementados, estos modelos rara vez funcionan en condiciones controladas.

Pueden acabar procesando imágenes y vídeos de entornos impredecibles, donde la iluminación cambia constantemente, los ángulos de la cámara varían y los fondos cambian con el tiempo. Por ejemplo, un modelo de IA de visión entrenado para detectar tráfico puede tener dificultades para detectar vehículos por la noche si se ha entrenado y evaluado principalmente con imágenes diurnas.

Las imágenes nocturnas siguen siendo difíciles para los modelos entrenados con imágenes diurnas

Fig. 2. Incluso después de mejorarlas, las imágenes nocturnas son difíciles de interpretar para los modelos entrenados con imágenes diurnas. (Fuente)

Esta diferencia entre el desarrollo y la implementación en el mundo real es la brecha entre el entrenamiento y la producción. Debido a esta brecha, muchos fallos del modelo solo se hacen visibles después de la implementación, por lo que ser consciente de ellos desde el principio es esencial para crear sistemas de visión por ordenador más fiables y sólidos.

5 razones habituales por las que los modelos de visión por ordenador fallan en producción#

A continuación, analizaremos más detenidamente cinco razones habituales por las que los modelos de visión por ordenador fallan en producción.

1. Conjuntos de datos de entrenamiento de baja calidad#

Los conjuntos de datos desempeñan un papel fundamental en el entrenamiento de los modelos de visión por ordenador, ya que determinan qué aprende el modelo durante el entrenamiento y cómo responde a las entradas del mundo real después de la implementación. Esto es especialmente importante en el aprendizaje supervisado, donde los modelos aprenden a partir de ejemplos etiquetados que muestran qué representa cada imagen.

Muchos modelos de aprendizaje profundo, incluidas las redes neuronales convolucionales (CNNs), dependen de estos ejemplos etiquetados para reconocer patrones en los datos visuales. Sin embargo, cuando el conjunto de datos de entrenamiento no refleja las condiciones del mundo real, el modelo puede aprender patrones que no representan completamente el aspecto de los objetos fuera de los datos de entrenamiento.

Por ejemplo, un modelo entrenado con un conjunto de datos de defectos causados por grietas grandes podría no detectar un tipo poco frecuente de grieta pequeña en los flujos de trabajo de fabricación del mundo real. Del mismo modo, la calidad de las anotaciones también puede afectar al comportamiento del modelo. Las etiquetas incoherentes o la falta de detalles en los datos etiquetados pueden hacer que el modelo aprenda información incorrecta durante el entrenamiento.

Un vistazo a las anotaciones de imágenes

Fig. 3. Un vistazo a las anotaciones de imágenes (Fuente)

En general, la calidad y la diversidad de los datos de entrenamiento son fundamentales y pueden determinar el rendimiento de un modelo en aplicaciones del mundo real. Cuando los conjuntos de datos son representativos y están etiquetados con precisión, un modelo suele rendir de forma más fiable una vez implementado.

2. Sobreajuste y generalización#

Los modelos de aprendizaje automático, como los modelos de visión, aprenden patrones a partir de conjuntos de datos de entrenamiento. Pero a veces un modelo puede depender demasiado de unos pocos patrones.

En lugar de aprender relaciones visuales más amplias, puede acabar memorizando los patrones limitados de los datos de entrenamiento. Este comportamiento se conoce como sobreajuste.

El sobreajuste suele producirse cuando los conjuntos de datos de entrenamiento son pequeños o carecen de suficiente diversidad. En esos casos, el modelo se vuelve bueno reconociendo imágenes que ya ha visto, pero tiene dificultades para interpretar datos nuevos o entradas desconocidas.

Por este motivo, un modelo puede rendir bien con entradas de prueba (ya que son similares a los datos de entrenamiento), pero comportarse de forma diferente en condiciones nuevas después de la implementación. Por eso es tan importante el concepto de generalización. En pocas palabras, se refiere a lo bien que los modelos pueden aplicar lo aprendido durante el entrenamiento a situaciones nuevas.

Para reducir el sobreajuste, los aficionados a la IA suelen entrenar modelos con conjuntos de datos más diversos y aplicar aumento de datos, un método que modifica ligeramente las imágenes de entrenamiento para crear más variación en los datos. Sin estas consideraciones, el rendimiento del modelo puede disminuir rápidamente cuando el sistema empieza a funcionar en entornos del mundo real.

El aumento de datos crea variaciones de la misma imagen dentro de un conjunto de datos

Fig. 4. El aumento de datos puede ayudar a crear variaciones de la misma imagen dentro de un conjunto de datos. (Fuente)

3. Casos límite ocultos en entornos del mundo real#

Incluso cuando los modelos de visión por ordenador generalizan bien con datos nuevos, los entornos del mundo real pueden introducir casos límite inesperados. Se trata de situaciones inusuales que difieren de los patrones habituales que el modelo aprende durante el entrenamiento.

Muchos de estos escenarios son difíciles de capturar durante el desarrollo porque ocurren pocas veces, son difíciles de recrear o pueden resultar caros de recopilar como datos de entrenamiento. Por ejemplo, los objetos pueden aparecer con formas inusuales, moverse de forma impredecible o quedar parcialmente ocultos detrás de otros objetos.

Los cambios en la iluminación, los ángulos de la cámara o las condiciones del fondo también pueden crear situaciones que dificulten el reconocimiento. Estos casos límite a menudo solo se hacen evidentes después de implementar el sistema en aplicaciones del mundo real.

En la robótica y la automatización de la fabricación, por ejemplo, los artículos pueden colocarse o posicionarse de forma diferente a la prevista, creando situaciones que el modelo no estaba diseñado para gestionar. En última instancia, las predicciones que parecían fiables durante las pruebas pueden volverse menos constantes cuando el sistema funciona en entornos del mundo real.

4. Falta de supervisión y depuración tras la implementación#

Además de desarrollar un modelo de IA de visión, es esencial supervisar y mejorar su rendimiento. Sin embargo, una vez que el sistema está en funcionamiento, el foco suele desplazarse a mantenerlo operativo, en lugar de realizar un seguimiento minucioso de su rendimiento a lo largo del tiempo. Como resultado, los cambios en el comportamiento del modelo pueden pasar desapercibidos.

Al mismo tiempo, factores como los cambios en los datos entrantes, la configuración de las cámaras o los entornos operativos pueden afectar gradualmente a la precisión con la que el modelo detecta o clasifica objetos. Estos cambios no siempre son evidentes y pueden pasar desapercibidos durante el funcionamiento diario.

Supervisar las salidas del modelo y el comportamiento general del sistema puede ayudar a los equipos a identificar estos problemas antes. Las comprobaciones periódicas, las rutinas de validación y los flujos de trabajo de depuración permiten a los equipos investigar resultados inusuales y comprender qué puede estar provocándolos.

En sectores como la fabricación, un modelo podría identificar erróneamente objetos de repente en una cadena de montaje tras un cambio en la configuración de la cámara. Hacer un seguimiento del comportamiento de un sistema de IA de visión implementado facilita responder a estos cambios y mantener un rendimiento estable en entornos del mundo real.

5. Limitaciones de la infraestructura y latencia#

Muchos sistemas de visión por ordenador deben funcionar en tiempo real, lo que puede ejercer una presión considerable sobre el hardware, las redes y las canalizaciones de procesamiento. Cuando los recursos son limitados, pueden producirse retrasos de cálculo o latencia de red, lo que hace que las predicciones lleguen demasiado tarde y afecta al rendimiento general del sistema.

En algunos casos, los modelos avanzados de aprendizaje profundo también pueden generar desafíos de infraestructura. Por ejemplo, las arquitecturas basadas en Transformer están diseñadas para procesar grandes cantidades de datos visuales y aprender relaciones complejas dentro de las imágenes, pero a menudo requieren recursos computacionales considerables. Ejecutar estos modelos puede requerir hardware más potente o caro.

Sin una optimización adecuada, incluso los modelos que funcionan rápidamente durante las pruebas pueden ralentizarse o comportarse de forma incoherente después de la implementación. Para solucionar este problema, los equipos suelen optimizar las canalizaciones, reducir la complejidad del modelo cuando es posible y equilibrar la precisión con la velocidad.

Esto puede implicar comprimir modelos grandes en versiones más ligeras, utilizar arquitecturas más eficientes o procesar imágenes con resoluciones más bajas para que el sistema funcione correctamente en el hardware disponible. En muchos casos, los equipos también eligen modelos ligeros y más rápidos, como Ultralytics YOLO26, para cumplir las limitaciones de la implementación.

Prácticas recomendadas para evitar fallos en los modelos de visión por ordenador#

Estas son algunas prácticas recomendadas que pueden ayudar a reducir los fallos al implementar modelos de visión por ordenador en producción:

  • Utiliza estrategias de implementación por fases: Introduce gradualmente los modelos en producción para que los equipos puedan observar su comportamiento y realizar ajustes cuando sea necesario.
  • Incorpora ciclos de retroalimentación: Recopila imágenes nuevas y revisa las predicciones incorrectas para volver a entrenar los modelos con conjuntos de datos actualizados y mejorar el rendimiento con el tiempo.
  • Documenta las limitaciones del modelo: Registra claramente las situaciones en las que el modelo puede tener dificultades para que los equipos puedan anticipar posibles problemas durante la implementación.
  • Diseña teniendo en cuenta la variabilidad del mundo real: Planificar con antelación las variaciones en la iluminación, los ángulos de la cámara, la colocación de los objetos o las condiciones del fondo puede ayudar a que los modelos sean estables en distintos escenarios operativos.

Conclusiones clave#

Los modelos de visión por ordenador rara vez fallan porque sus algoritmos sean débiles. En la mayoría de los casos, el verdadero desafío proviene de los entornos en los que funcionan estos sistemas. Los modelos que rinden bien durante el entrenamiento suelen encontrarse con condiciones impredecibles del mundo real que pueden afectar a su comportamiento.

Por eso, crear sistemas de IA de visión fiables requiere algo más que entrenar un modelo. También implica preparar cuidadosamente los conjuntos de datos, supervisar el rendimiento del modelo después de la implementación y adaptar continuamente los sistemas a las condiciones del mundo real.

¿Quieres seguir explorando la IA de visión? Únete a nuestra comunidad y descubre aplicaciones como la IA en la automoción y la visión por ordenador en la logística. Consulta nuestras opciones de licencia para empezar con proyectos de visión por ordenador. Visita nuestro repositorio de GitHub para obtener más información.

Explore solutions

Visión por computadora para imágenes aéreas

Visión por computadora para imágenes aéreas

Transforma imágenes de drones y aéreas en información en tiempo real para agricultura, acuicultura, supervisión ambiental, conservación y análisis geoespacial con Ultralytics YOLO.
Más información
Visión artificial en la industria aeroespacial

Visión artificial en la industria aeroespacial

Lleva la IA de visión al monitoreo aéreo con los modelos Ultralytics YOLO. Potencia drones, flujos de trabajo aeroespaciales, conservación ambiental e industrias geoespaciales con soluciones de visión artificial.
Más información
Visión artificial en seguridad

Visión artificial en seguridad

Protege cada sitio con los modelos Ultralytics YOLO. La IA de visión potencia el monitoreo perimetral, la detección de amenazas, el reconocimiento de matrículas y la seguridad laboral.
Más información
Visión artificial en robótica

Visión artificial en robótica

Impulsa máquinas más inteligentes con los modelos de Ultralytics YOLO. La IA de visión en robótica permite la navegación autónoma, la percepción, el seguimiento de objetos y el control en tiempo real.
Más información
Visión artificial en logística

Visión artificial en logística

Optimiza la logística con los modelos de Ultralytics YOLO. La IA de visión permite inspeccionar paquetes, clasificarlos, realizar el seguimiento de vehículos y supervisar la seguridad de los almacenes en tiempo real.
Más información
Visión artificial en comercio minorista

Visión artificial en comercio minorista

Reinventa el comercio minorista con los modelos de Ultralytics YOLO. La IA de visión impulsa el seguimiento del inventario, la supervisión de estanterías, la gestión de colas y un conocimiento más inteligente de los clientes.
Más información
Visión por computador en el sector sanitario

Visión por computador en el sector sanitario

Crea soluciones sanitarias con modelos de Ultralytics YOLO. La IA de visión en el sector sanitario permite obtener imágenes médicas más rápidamente, diagnósticos más inteligentes y supervisar a los pacientes.
Más información
Visión por computador en la fabricación

Visión por computador en la fabricación

Optimiza la fabricación con modelos de Ultralytics YOLO. La IA de visión impulsa el control de calidad, la detección de defectos, el cumplimiento del PPE y la automatización de las líneas de montaje.
Más información
Visión artificial en el sector automovilístico

Visión artificial en el sector automovilístico

Aplica visión artificial en el sector automovilístico con modelos de Ultralytics YOLO. La IA de visión mejora la seguridad vial, la asistencia al conductor y la automatización de vehículos para conseguir carreteras más inteligentes.
Más información
Visión artificial en agricultura

Visión artificial en agricultura

Lleva la IA de visión a la agricultura inteligente con modelos de Ultralytics YOLO. Impulsa la supervisión de cultivos, el seguimiento del ganado y la agricultura de precisión para obtener cosechas mayores e inteligentes.
Más información
Visión por computadora para imágenes aéreas

Visión por computadora para imágenes aéreas

Transforma imágenes de drones y aéreas en información en tiempo real para agricultura, acuicultura, supervisión ambiental, conservación y análisis geoespacial con Ultralytics YOLO.
Más información
Visión artificial en la industria aeroespacial

Visión artificial en la industria aeroespacial

Lleva la IA de visión al monitoreo aéreo con los modelos Ultralytics YOLO. Potencia drones, flujos de trabajo aeroespaciales, conservación ambiental e industrias geoespaciales con soluciones de visión artificial.
Más información
Visión artificial en seguridad

Visión artificial en seguridad

Protege cada sitio con los modelos Ultralytics YOLO. La IA de visión potencia el monitoreo perimetral, la detección de amenazas, el reconocimiento de matrículas y la seguridad laboral.
Más información
Visión artificial en robótica

Visión artificial en robótica

Impulsa máquinas más inteligentes con los modelos de Ultralytics YOLO. La IA de visión en robótica permite la navegación autónoma, la percepción, el seguimiento de objetos y el control en tiempo real.
Más información
Visión artificial en logística

Visión artificial en logística

Optimiza la logística con los modelos de Ultralytics YOLO. La IA de visión permite inspeccionar paquetes, clasificarlos, realizar el seguimiento de vehículos y supervisar la seguridad de los almacenes en tiempo real.
Más información
Visión artificial en comercio minorista

Visión artificial en comercio minorista

Reinventa el comercio minorista con los modelos de Ultralytics YOLO. La IA de visión impulsa el seguimiento del inventario, la supervisión de estanterías, la gestión de colas y un conocimiento más inteligente de los clientes.
Más información
Visión por computador en el sector sanitario

Visión por computador en el sector sanitario

Crea soluciones sanitarias con modelos de Ultralytics YOLO. La IA de visión en el sector sanitario permite obtener imágenes médicas más rápidamente, diagnósticos más inteligentes y supervisar a los pacientes.
Más información
Visión por computador en la fabricación

Visión por computador en la fabricación

Optimiza la fabricación con modelos de Ultralytics YOLO. La IA de visión impulsa el control de calidad, la detección de defectos, el cumplimiento del PPE y la automatización de las líneas de montaje.
Más información
Visión artificial en el sector automovilístico

Visión artificial en el sector automovilístico

Aplica visión artificial en el sector automovilístico con modelos de Ultralytics YOLO. La IA de visión mejora la seguridad vial, la asistencia al conductor y la automatización de vehículos para conseguir carreteras más inteligentes.
Más información
Visión artificial en agricultura

Visión artificial en agricultura

Lleva la IA de visión a la agricultura inteligente con modelos de Ultralytics YOLO. Impulsa la supervisión de cultivos, el seguimiento del ganado y la agricultura de precisión para obtener cosechas mayores e inteligentes.
Más información
Visión por computadora para imágenes aéreas

Visión por computadora para imágenes aéreas

Transforma imágenes de drones y aéreas en información en tiempo real para agricultura, acuicultura, supervisión ambiental, conservación y análisis geoespacial con Ultralytics YOLO.
Más información
Visión artificial en la industria aeroespacial

Visión artificial en la industria aeroespacial

Lleva la IA de visión al monitoreo aéreo con los modelos Ultralytics YOLO. Potencia drones, flujos de trabajo aeroespaciales, conservación ambiental e industrias geoespaciales con soluciones de visión artificial.
Más información
Visión artificial en seguridad

Visión artificial en seguridad

Protege cada sitio con los modelos Ultralytics YOLO. La IA de visión potencia el monitoreo perimetral, la detección de amenazas, el reconocimiento de matrículas y la seguridad laboral.
Más información
Visión artificial en robótica

Visión artificial en robótica

Impulsa máquinas más inteligentes con los modelos de Ultralytics YOLO. La IA de visión en robótica permite la navegación autónoma, la percepción, el seguimiento de objetos y el control en tiempo real.
Más información
Visión artificial en logística

Visión artificial en logística

Optimiza la logística con los modelos de Ultralytics YOLO. La IA de visión permite inspeccionar paquetes, clasificarlos, realizar el seguimiento de vehículos y supervisar la seguridad de los almacenes en tiempo real.
Más información
Visión artificial en comercio minorista

Visión artificial en comercio minorista

Reinventa el comercio minorista con los modelos de Ultralytics YOLO. La IA de visión impulsa el seguimiento del inventario, la supervisión de estanterías, la gestión de colas y un conocimiento más inteligente de los clientes.
Más información
Visión por computador en el sector sanitario

Visión por computador en el sector sanitario

Crea soluciones sanitarias con modelos de Ultralytics YOLO. La IA de visión en el sector sanitario permite obtener imágenes médicas más rápidamente, diagnósticos más inteligentes y supervisar a los pacientes.
Más información
Visión por computador en la fabricación

Visión por computador en la fabricación

Optimiza la fabricación con modelos de Ultralytics YOLO. La IA de visión impulsa el control de calidad, la detección de defectos, el cumplimiento del PPE y la automatización de las líneas de montaje.
Más información
Visión artificial en el sector automovilístico

Visión artificial en el sector automovilístico

Aplica visión artificial en el sector automovilístico con modelos de Ultralytics YOLO. La IA de visión mejora la seguridad vial, la asistencia al conductor y la automatización de vehículos para conseguir carreteras más inteligentes.
Más información
Visión artificial en agricultura

Visión artificial en agricultura

Lleva la IA de visión a la agricultura inteligente con modelos de Ultralytics YOLO. Impulsa la supervisión de cultivos, el seguimiento del ganado y la agricultura de precisión para obtener cosechas mayores e inteligentes.
Más información

¡Construyamos juntos el futuro de la IA!

Comienza tu recorrido hacia el futuro del aprendizaje automático