Accuracy
Explora los fundamentos de la precisión en IA. Aprende a evaluar el rendimiento, evitar la paradoja de la precisión y medir los resultados con Ultralytics YOLO26.
La exactitud es un indicador fundamental en la evaluación de sistemas de inteligencia artificial, ya que cuantifica el porcentaje de predicciones correctas que realiza un modelo con respecto al número total de predicciones. En el contexto del aprendizaje automático y, concretamente, del aprendizaje supervisado, esta métrica proporciona una visión general de hasta qué punto un algoritmo se ajusta a la verdad de referencia proporcionada durante el proceso de entrenamiento. Aunque es la medida de rendimiento más intuitiva —responde a la sencilla pregunta «¿Con qué frecuencia acierta el modelo?»—, actúa como indicador principal de la fiabilidad de un sistema antes de que los desarrolladores profundicen en métricas más detalladas.
Los matices de la evaluación del rendimiento#
Aunque la exactitud es un excelente punto de partida, resulta más eficaz cuando se aplica a datos de entrenamiento equilibrados en los que todas las clases están representadas por igual. Por ejemplo, en una tarea estándar de clasificación de imágenes que distingue entre gatos y perros, si el conjunto de datos contiene 500 imágenes de cada uno, la exactitud es una métrica fiable. Sin embargo, surgen dificultades con los conjuntos de datos desequilibrados, lo que da lugar a la «paradoja de la exactitud».
Si un modelo se entrena para la detección de fraude, donde solo el 1 % de las transacciones son fraudulentas, un modelo que simplemente prediga que todas las transacciones son «legítimas» alcanzaría una exactitud del 99 %, aunque fracasaría por completo en la tarea para la que está diseñado. Para mitigar este problema, los ingenieros suelen utilizar la Ultralytics Platform para visualizar la distribución del conjunto de datos y asegurarse de que los modelos no se limitan a memorizar la clase mayoritaria.
Diferencias entre la exactitud y términos relacionados#
Para comprender plenamente el rendimiento de un modelo, es fundamental diferenciar la exactitud de métricas similares:
- Precisión: Mide la calidad de las predicciones positivas. Responde a la pregunta «De todas las instancias predichas como positivas, ¿cuántas eran realmente positivas?»
- Exhaustividad: También conocida como sensibilidad, mide la capacidad del modelo para encontrar todos los casos relevantes. Responde a la pregunta «De todas las instancias realmente positivas, ¿cuántas identificó correctamente el modelo?»
- Puntuación F1: Es la media armónica de la precisión y la exhaustividad, y proporciona una única puntuación que equilibra ambas, lo que resulta especialmente útil para distribuciones de clases desiguales.
Mientras que la exactitud proporciona una visión global de las predicciones correctas, la precisión y la exhaustividad ofrecen información sobre tipos concretos de errores, como los falsos positivos o los falsos negativos.
Aplicaciones en el mundo real#
La utilidad de la exactitud se extiende a diversos sectores, donde valida la fiabilidad de los modelos de visión artificial y predictivos en entornos críticos.
- Diagnóstico médico: En el campo del análisis de imágenes médicas, los modelos se utilizan para clasificar radiografías o exploraciones por resonancia magnética. Un modelo que clasifica las exploraciones como «saludables» o «patológicas» depende de una exactitud elevada para garantizar que los pacientes reciban diagnósticos correctos. Las innovaciones en IA en la atención sanitaria dependen en gran medida de una validación rigurosa para minimizar los errores automatizados.
- Control de calidad en la fabricación: Los sistemas automatizados de la fabricación inteligente utilizan la inspección visual para identificar defectos en las líneas de montaje. Una exactitud elevada garantiza que solo se envíen productos sin defectos, lo que reduce los residuos y los costes de garantía. Mediante el uso de la detección de objetos para localizar fallos, las fábricas mantienen automáticamente los estándares de producción.
Medición de la exactitud en el código#
En situaciones prácticas con Python, los desarrolladores pueden medir fácilmente la exactitud de un modelo utilizando bibliotecas consolidadas. El siguiente ejemplo muestra cómo validar un modelo de clasificación YOLO26 para obtener su exactitud top-1. La exactitud top-1 se refiere a la frecuencia con la que la predicción de mayor probabilidad del modelo coincide con la etiqueta correcta.
from ultralytics import YOLO
# Load a pre-trained YOLO26 classification model
model = YOLO("yolo26n-cls.pt")
# Validate the model on a standard dataset (e.g., MNIST)
metrics = model.val(data="mnist")
# Print the Top-1 Accuracy
print(f"Top-1 Accuracy: {metrics.top1:.4f}")Estrategias de mejora#
Cuando un modelo presenta una exactitud baja, se pueden emplear varias técnicas para mejorar su rendimiento. Los ingenieros suelen utilizar la ampliación de datos para aumentar artificialmente la diversidad del conjunto de entrenamiento y evitar que el modelo sufra sobreajuste. Además, el ajuste de hiperparámetros —modificando configuraciones como la tasa de aprendizaje— puede influir considerablemente en la convergencia. Para tareas complejas, el aprendizaje por transferencia permite que un modelo aproveche los conocimientos de un conjunto de datos grande y preentrenado, como ImageNet, para lograr una mayor exactitud en un conjunto de datos más pequeño y específico.









