Transfer Learning
Explora el aprendizaje por transferencia para entrenar IA de alta precisión con menos datos. Aprende a aprovechar los pesos preentrenados de Ultralytics YOLO26 para acelerar tus proyectos de visión artificial.
El aprendizaje por transferencia es una técnica potente del aprendizaje automático (ML) en la que un modelo desarrollado para una tarea específica se reutiliza como punto de partida para un modelo destinado a una segunda tarea relacionada. En lugar de entrenar una red neuronal desde cero —lo que requiere conjuntos de datos enormes y una potencia computacional considerable—, los desarrolladores aprovechan los conocimientos que una IA ya ha adquirido. Este enfoque imita la forma en que aprenden los seres humanos; por ejemplo, saber tocar el piano facilita mucho aprender a tocar el órgano, porque los conocimientos fundamentales de teoría musical y la destreza de los dedos se transfieren. En el contexto del aprendizaje profundo, esto significa que un modelo puede alcanzar una gran precisión en un problema nuevo con mucha menos cantidad de datos y tiempo.
Cómo funciona el aprendizaje por transferencia#
La eficacia del aprendizaje por transferencia reside en la naturaleza jerárquica de la extracción de características. Los modelos de aprendizaje profundo, especialmente los utilizados en visión artificial, aprenden a reconocer patrones por capas. Las capas iniciales del backbone detectan características simples y universales, como bordes, curvas y texturas. Estas características de bajo nivel son aplicables a casi cualquier tarea visual.
El proceso suele constar de dos fases principales:
-
Preentrenamiento: Se entrena un modelo con un conjunto de datos de referencia a gran escala, como ImageNet, para que aprenda representaciones visuales generales. El resultado es un conjunto de pesos del modelo que ya comprende la estructura visual.
-
Adaptación: A continuación, el modelo preentrenado se adapta a una tarea específica de un ámbito concreto. Esto suele hacerse «congelando» las primeras capas (manteniendo fijos sus pesos) y reentrenando únicamente las capas finales, o la cabeza de detección, con un conjunto de datos personalizado más pequeño.
Aplicaciones en el mundo real#
El aprendizaje por transferencia ha democratizado la IA al permitir crear soluciones especializadas sin disponer de los recursos de las grandes empresas tecnológicas.
- IA en la atención sanitaria: Es difícil reunir millones de imágenes médicas anotadas para cada enfermedad específica. Sin embargo, los investigadores pueden tomar un modelo preentrenado con objetos cotidianos y aplicarlo al análisis de imágenes médicas. El modelo transfiere su capacidad para detectar formas y anomalías con el fin de identificar tumores en radiografías o exploraciones de MRI con una gran precisión.
- IA en la fabricación: En entornos industriales, los sistemas de inspección visual deben adaptarse rápidamente a nuevas líneas de productos. Un modelo generalizado de detección de defectos puede actualizarse con rapidez para detectar fallos en un componente nuevo específico, como un microchip, mediante flujos de trabajo de fabricación inteligente que minimizan el tiempo de inactividad.
Relación con otros conceptos#
Es útil distinguir el aprendizaje por transferencia de términos estrechamente relacionados:
- Frente al ajuste fino: El ajuste fino es un método específico para implementar el aprendizaje por transferencia. Mientras que el aprendizaje por transferencia es el concepto general de reutilizar conocimientos, el ajuste fino hace referencia al proceso mecánico de descongelar partes del modelo y entrenarlas con datos nuevos utilizando una tasa de aprendizaje menor.
- Frente al aprendizaje con cero ejemplos: El aprendizaje por transferencia requiere una fase de entrenamiento con algunos datos etiquetados para la nueva tarea. En cambio, el aprendizaje con cero ejemplos intenta clasificar objetos que el modelo nunca ha visto antes y suele basarse en descripciones semánticas en lugar de ejemplos visuales.
Ejemplo práctico#
El siguiente fragmento de Python demuestra el aprendizaje por transferencia mediante la biblioteca ultralytics. Cargamos el modelo YOLO26, que incluye pesos preentrenados derivados del conjunto de datos COCO. Cuando iniciamos el entrenamiento con un conjunto de datos nuevo, el modelo transfiere automáticamente las características que ha aprendido previamente a la nueva tarea.
from ultralytics import YOLO
# Load a pre-trained YOLO26 model (transferring weights from COCO)
model = YOLO("yolo26n.pt")
# Train the model on a new, smaller dataset to adapt its knowledge
# This leverages the pre-learned backbone for faster convergence
results = model.train(data="coco8.yaml", epochs=5)Para gestionar conjuntos de datos y ejecutar estas sesiones de entrenamiento en la nube, herramientas como Ultralytics Platform agilizan el proceso y permiten a los equipos colaborar en la anotación de datos y desplegar de forma eficiente modelos entrenados mediante aprendizaje por transferencia.
Para profundizar en la teoría académica, las notas de Stanford CS231n ofrecen una excelente visión general, mientras que el tutorial de aprendizaje por transferencia de PyTorch proporciona amplios detalles técnicos para su implementación.









