Accuracy
Explora los fundamentos de la precisión en IA. Aprende a evaluar el rendimiento, evitar la paradoja de la precisión y medir resultados usando YOLO26 de Ultralytics.
La precisión sirve como una métrica fundamental en la evaluación de los sistemas de inteligencia artificial, ya que cuantifica el porcentaje de predicciones correctas que realiza un modelo en relación con el número total de predicciones. En el contexto del machine learning y específicamente del supervised learning, esta métrica proporciona una perspectiva general de cómo un algoritmo se alinea de manera efectiva con el ground truth proporcionado durante el proceso de entrenamiento. Si bien es la medida de rendimiento más intuitiva —al responder a la simple pregunta: "¿Con qué frecuencia acierta el modelo?"—, actúa como un indicador principal de la fiabilidad de un sistema antes de que los desarrolladores profundicen en métricas más granulares.
El matiz de evaluar el rendimiento#
Aunque la precisión es un excelente punto de partida, es más eficaz cuando se aplica a training data equilibrados en los que todas las clases están representadas por igual. Por ejemplo, en una tarea estándar de image classification que distingue entre gatos y perros, si el conjunto de datos contiene 500 imágenes de cada uno, la precisión es una métrica confiable. Sin embargo, surgen desafíos con los imbalanced datasets, lo que da lugar a la "paradoja de la precisión".
Si se entrena un modelo para la fraud detection donde solo el 1 % de las transacciones son fraudulentas, un modelo que simplemente prediga que cada transacción es "legítima" lograría una precisión del 99 % mientras fracasa por completo en su tarea prevista. Para mitigar esto, los ingenieros suelen utilizar la Ultralytics Platform para visualizar la distribución del conjunto de datos y garantizar que los modelos no se limiten a memorizar la clase mayoritaria.
Distinguir la precisión de términos relacionados#
Para comprender completamente el rendimiento del modelo, es crucial diferenciar la precisión de métricas similares:
- Precision: Esto mide la calidad de las predicciones positivas. Plantea la pregunta: "De todas las instancias predichas como positivas, ¿cuántas fueron realmente positivas?"
- Recall: También conocida como sensibilidad, esto mide la capacidad del modelo para encontrar todos los casos relevantes. Plantea la pregunta: "De todas las instancias positivas reales, ¿cuántas identificó correctamente el modelo?"
- F1-Score: Esta es la media armónica de la precisión y el recuerdo, lo que proporciona una única puntuación que equilibra ambas métricas, lo cual es especialmente útil para distribuciones de clases desequilibradas.
Mientras que la precisión ofrece una visión global de la exactitud, la precisión y el recall ofrecen información sobre tipos específicos de errores, como los falsos positivos o los falsos negativos.
Aplicaciones en el mundo real#
La utilidad de la precisión se extiende a diversas industrias, lo que valida la fiabilidad de los modelos de computer vision y predictivos en entornos críticos.
- Diagnóstico médico: En el campo del medical image analysis, los modelos se utilizan para clasificar radiografías o resonancias magnéticas. Un modelo que clasifica las exploraciones como "sanas" o "patológicas" depende de una gran precisión para garantizar que los pacientes reciban diagnósticos correctos. Las innovaciones en la AI in healthcare dependen en gran medida de una validación rigurosa para minimizar los errores automatizados.
- Control de calidad en la fabricación: Los sistemas automatizados en la smart manufacturing utilizan inspección visual para identificar defectos en las líneas de montaje. Una alta precisión garantiza que solo se envíen productos sin defectos, lo que reduce los residuos y los costes de garantía. Al emplear la object detection para detectar fallos, las fábricas mantienen los estándares de producción de forma automática.
Medir la precisión en el código#
En escenarios prácticos que utilizan Python, los desarrolladores pueden medir fácilmente la precisión de un modelo mediante bibliotecas establecidas. El siguiente ejemplo demuestra cómo validar un modelo de clasificación de YOLO26 para obtener su precisión top-1. La precisión top-1 se refiere a la frecuencia con la que la predicción de mayor probabilidad del modelo coincide con la etiqueta correcta.
from ultralytics import YOLO
# Load a pre-trained YOLO26 classification model
model = YOLO("yolo26n-cls.pt")
# Validate the model on a standard dataset (e.g., MNIST)
metrics = model.val(data="mnist")
# Print the Top-1 Accuracy
print(f"Top-1 Accuracy: {metrics.top1:.4f}")Estrategias de mejora#
Cuando un modelo sufre de baja precisión, se pueden emplear varias técnicas para mejorar el rendimiento. Los ingenieros suelen utilizar el data augmentation para aumentar artificialmente la diversidad del conjunto de entrenamiento, evitando que el modelo sufra de overfitting. Además, el hyperparameter tuning, que consiste en ajustar parámetros como la learning rate, puede influir significativamente en la convergencia. Para tareas complejas, el transfer learning permite que un modelo aproveche el conocimiento de un conjunto de datos grande y preentrenado (como ImageNet) para lograr una mayor precisión en un conjunto de datos más pequeño y específico.






