Image Classification
Explora los fundamentos de la clasificación de imágenes, desde las CNN hasta los usos reales de la IA. Aprende a entrenar y desplegar clasificadores de última generación con Ultralytics YOLO26.
La clasificación de imágenes es una tarea fundamental de la visión artificial (CV) en la que un modelo de aprendizaje automático analiza una imagen completa y le asigna una única etiqueta de un conjunto predefinido de categorías. En esencia, responde a la pregunta: «¿Cuál es el tema principal de esta imagen?». Como componente esencial de la inteligencia artificial (AI), este proceso permite a los sistemas automatizados organizar, categorizar e interpretar datos visuales a gran escala. Aunque al ojo humano pueda parecer sencillo, conseguir que los ordenadores reconozcan patrones requiere sofisticados algoritmos de aprendizaje automático (ML) que establezcan un vínculo entre los píxeles sin procesar y los conceptos significativos.
El mecanismo de la clasificación#
La clasificación de imágenes moderna depende en gran medida de arquitecturas de aprendizaje profundo (DL) conocidas como redes neuronales convolucionales (CNNs). Estas redes están diseñadas para imitar la forma en que la corteza visual biológica procesa la información. Mediante un proceso denominado extracción de características, el modelo aprende a identificar atributos de bajo nivel, como bordes y texturas, en las primeras capas y, finalmente, los combina para reconocer formas y objetos complejos en las capas más profundas.
Para crear un clasificador, los desarrolladores utilizan el aprendizaje supervisado y proporcionan al modelo grandes cantidades de datos de entrenamiento que contienen ejemplos etiquetados. Grandes conjuntos de datos públicos como ImageNet han sido fundamentales para mejorar la precisión de estos sistemas. Durante la fase de inferencia, el modelo produce una puntuación de probabilidad para cada categoría y suele utilizar una función softmax para determinar la clase más probable.
Clasificación frente a otras tareas de visión#
Es importante distinguir la clasificación de imágenes de otras capacidades relacionadas de la visión artificial, ya que la elección de la técnica depende del problema específico:
- Clasificación frente a la detección de objetos: La clasificación asigna una etiqueta a la imagen completa. En cambio, la detección de objetos identifica la ubicación de varios objetos dentro de una escena dibujando un cuadro delimitador alrededor de cada uno.
- Clasificación frente a la segmentación de imágenes: Mientras que la clasificación analiza el contexto global, la segmentación ofrece precisión a nivel de píxel. La segmentación semántica clasifica cada píxel individual, lo que permite delimitar con exactitud los contornos entre los objetos y el fondo.
Aplicaciones en el mundo real#
La clasificación de imágenes impulsa una amplia variedad de aplicaciones de IA en el mundo real en diversos sectores:
Diagnóstico sanitario#
En el ámbito médico, los modelos de clasificación ayudan a los radiólogos analizando exploraciones diagnósticas. Las herramientas de análisis de imágenes médicas pueden categorizar rápidamente radiografías o resonancias magnéticas como «normales» o «anormales», o identificar afecciones específicas, como la detección de tumores, lo que permite agilizar la clasificación y el diagnóstico de los pacientes.
Control de calidad en la fabricación#
Las fábricas utilizan la inspección visual automatizada para mantener los estándares de los productos. Las cámaras de las líneas de montaje capturan imágenes de los componentes y los modelos de clasificación los etiquetan al instante como «aptos» o «no aptos» según los defectos visibles. Este control de calidad automatizado garantiza que solo los artículos sin defectos lleguen a la fase de embalaje.
Agricultura inteligente#
Los agricultores aprovechan la IA en la agricultura para supervisar la salud de los cultivos. Al clasificar imágenes tomadas por drones o smartphones, los sistemas pueden identificar signos de enfermedades, deficiencias nutricionales o infestaciones de plagas, lo que permite aplicar intervenciones específicas de agricultura de precisión.
Implementación de la clasificación con Ultralytics YOLO26#
El framework Ultralytics YOLO26, aunque es conocido por la detección, ofrece un rendimiento de última generación para tareas de clasificación de imágenes. Su arquitectura está optimizada para ofrecer velocidad y precisión, por lo que resulta adecuado para aplicaciones en tiempo real.
Este es un ejemplo conciso de cómo cargar un modelo preentrenado y clasificar una imagen utilizando el paquete de ultralytics para Python:
from ultralytics import YOLO
# Load a pre-trained YOLO26 classification model
model = YOLO("yolo26n-cls.pt")
# Run inference on an image source
results = model("https://ultralytics.com/images/bus.jpg")
# Print the top predicted class name
print(f"Prediction: {results[0].names[results[0].probs.top1]}")Para los equipos que buscan optimizar su flujo de trabajo, Ultralytics Platform simplifica todo el pipeline. Permite a los usuarios gestionar conjuntos de datos de clasificación, realizar entrenamientos en la nube y desplegar modelos en varios formatos, como ONNX o TensorRT, sin necesidad de una infraestructura de programación extensa.









