Saliency Maps
Descubre cómo los mapas de saliencia explican las decisiones de las redes neuronales. Aprende a visualizar las predicciones de los modelos y a crear una IA transparente con Ultralytics Platform.
Los mapas de saliencia son una potente herramienta visual utilizada en la IA explicable (XAI) para esclarecer los procesos internos de toma de decisiones de las complejas redes neuronales. Al actuar esencialmente como mapas de calor, resaltan los píxeles o regiones específicos de una imagen de entrada que más influyen en la predicción de un modelo. Al revelar «dónde» está mirando un modelo, los mapas de saliencia ayudan a investigadores e ingenieros a interpretar el comportamiento de las redes neuronales convolucionales (CNNs) profundas, garantizando que el sistema aprenda las características correctas en lugar de basarse en artefactos del conjunto de datos o ruido de fondo. Puedes leer más sobre los fundamentos matemáticos de este proceso en la página de Wikipedia sobre mapas de saliencia.
Cómo funcionan los mapas de saliencia#
El enfoque fundamental para generar un mapa de saliencia depende en gran medida de la retropropagación y de los gradientes en las distintas capas de la red. En lugar de utilizar estos gradientes para actualizar los pesos del modelo durante el entrenamiento del modelo, el algoritmo calcula el gradiente de la puntuación de la clase predicha con respecto a la propia imagen de entrada. Como se explica en la documentación de autograd de PyTorch, tomar el máximo absoluto de estos gradientes en los distintos canales de color produce un mapa en el que los valores altos corresponden a píxeles que cambian drásticamente la puntuación de salida si se modifican. Los enfoques modernos incluso amplían esta técnica a la IA generativa, lo que permite crear mapas de saliencia de modelos de difusión para rastrear los gradientes del ruido.
Aplicaciones en el mundo real#
Como proporcionan una verificación visual directa de la lógica de un modelo, los mapas de saliencia son fundamentales en escenarios de visión por computador de alto riesgo:
- Diagnóstico médico: En la IA en sanidad, confirmar que un algoritmo detecta un tumor basándose en anomalías fisiológicas reales del tejido —en lugar de en la marca de agua de un escáner— es crucial para la seguridad del paciente. Los mapas de saliencia proporcionan esta prueba visual, tal como se detalla en estudios recientes sobre la coherencia en la XAI aplicada a imágenes médicas.
- Navegación autónoma: En el caso de vehículos autónomos que predicen ángulos de dirección o identifican señales de stop, analizar los mapas de saliencia ayuda a los ingenieros a depurar fallos al verificar si el modelo se centró correctamente en la carretera en lugar de distraerse con elementos irrelevantes del entorno.
Diferenciación de términos relacionados#
Se recomienda encarecidamente diferenciar los mapas de saliencia de otros conceptos del glosario de IA para comprender su función específica en el aprendizaje profundo (DL):
- Mapas de saliencia frente a Class Activation Mapping (CAM): Mientras que los mapas de saliencia básicos calculan la importancia a nivel de píxel sin procesar, las técnicas CAM, como Grad-CAM, analizan la importancia en el nivel de los mapas de características de alto nivel dentro de la última capa convolucional de la red. Los benchmarks más recientes siguen perfeccionando la forma de evaluar las explicaciones visuales y las CAM en distintos conjuntos de datos.
- Mapas de saliencia frente a interpretabilidad mecanicista: El mapeo de saliencia es una técnica post hoc que simplemente muestra dónde mira un modelo. En cambio, la interpretabilidad mecanicista profundiza para aplicar ingeniería inversa a cómo y por qué determinadas neuronas o circuitos algorítmicos han calculado ese foco de atención.
- Mapas de saliencia frente a IA explicable (XAI): La XAI es la disciplina general dedicada a hacer transparente la IA, mientras que los mapas de saliencia son solo una herramienta específica dentro de ese conjunto, que a menudo se destaca como una técnica fundamental de explicabilidad de Google Cloud. El campo evoluciona rápidamente y avanza desde los píxeles sin procesar hacia una taxonomía de explicaciones alineada con las personas que mapea datos conceptuales.
Extracción de saliencia mediante código#
Comprender cómo una red neuronal atribuye importancia puede hacerse mediante programación utilizando frameworks de aprendizaje profundo como PyTorch. El siguiente fragmento demuestra las matemáticas fundamentales para extraer un mapa de saliencia básico (atribución basada en gradientes) a partir de un modelo preentrenado de clasificación de imágenes.
import torch
from torchvision.models import resnet18
# Load a pre-trained model in evaluation mode
model = resnet18(weights="DEFAULT").eval()
# Create a dummy image tensor and explicitly require gradients
input_image = torch.randn(1, 3, 224, 224, requires_grad=True)
# Forward pass: get predictions for the input image
output = model(input_image)
# Backward pass: compute gradients for the highest scoring class
output[0, output.argmax()].backward()
# Saliency map is the maximum absolute gradient across the 3 color channels
saliency_map, _ = torch.max(input_image.grad.data.abs(), dim=1)
print(f"Generated Saliency Map Shape: {saliency_map.shape}")Para flujos de trabajo de nivel superior relacionados con la detección de objetos o el trazado de cuadros delimitadores, herramientas como la Ultralytics Platform ayudan a los desarrolladores a anotar conjuntos de datos, supervisar experimentos y visualizar sin complicaciones las salidas de modelos como el avanzado Ultralytics YOLO26. Al evaluar continuamente las inferencias visuales junto con el despliegue de modelos, los equipos pueden crear y escalar sistemas de IA mucho más fiables y transparentes.









