Ultralytics YOLO27:
AI per la visione

L'apprendimento attivo accelera lo sviluppo della visione artificiale

Scopri come l'apprendimento attivo viene utilizzato nella visione artificiale per ridurre al minimo gli sforzi di annotazione ed esplora le sue applicazioni reali in diversi settori.

ABAbirami Vina10 min read
L'apprendimento attivo accelera lo sviluppo della visione artificiale

Addestrare un modello di computer vision è molto simile a insegnare a un bambino a riconoscere i colori. Per prima cosa, servirebbe una raccolta di oggetti colorati. Poi, guideresti il bambino a identificare correttamente ogni colore, un'attività spesso lunga e ripetitiva.

Proprio come un bambino ha bisogno di molti esempi per imparare, un modello di visione artificiale ha bisogno di un ampio insieme di dati annotati per riconoscere schemi e oggetti nelle immagini. Tuttavia, annotare enormi quantità di dati richiede molto tempo e impegno, oltre a risorse considerevoli. Tecniche come l'apprendimento attivo possono contribuire a semplificare questo processo.

L'apprendimento attivo è un processo graduale in cui i dati più importanti di un ampio dataset vengono selezionati e annotati. Il modello apprende da questi dati annotati, diventando più preciso ed efficace. Concentrarsi solo sui dati di maggior valore riduce la quantità di annotazioni necessarie e accelera lo sviluppo del modello.

In questo articolo vedremo come l'apprendimento attivo contribuisce all'addestramento dei modelli, riduce i costi di annotazione e migliora la precisione complessiva del modello.

I dataset di immagini non sono facili da creare#

I dataset sono la base dei modelli di computer vision e deep learning. Dataset popolari come ImageNet offrono milioni di immagini con categorie di oggetti diverse. Tuttavia, creare e mantenere volumi così enormi di dataset di alta qualità comporta diverse difficoltà.

Ad esempio, raccogliere e annotare i dati richiede tempo, risorse e annotatori qualificati, rendendo il processo complesso a seconda dell'applicazione specifica. Servono soluzioni innovative e più efficienti per stare al passo con la crescente domanda di dataset di immagini, ed è proprio questo il problema che l'apprendimento attivo mira a risolvere.

L'apprendimento attivo offre una soluzione ideale ottimizzando il processo di annotazione dei dati. Selezionando strategicamente i punti dati più informativi da annotare, l'apprendimento attivo massimizza le prestazioni del modello riducendo al minimo il lavoro di annotazione.

Che cos'è l'apprendimento attivo?#

L'apprendimento attivo è una tecnica iterativa di machine learning in cui il modello seleziona i punti dati più importanti da annotare all'interno di un ampio insieme di dati non annotati. I punti dati selezionati vengono annotati manualmente e aggiunti al dataset di addestramento.

Il modello viene quindi riaddestrato sul dataset aggiornato e seleziona il gruppo successivo di punti dati da annotare. Il processo si ripete, mentre il modello migliora continuamente concentrandosi sui punti dati più informativi. Il ciclo continua finché il modello non raggiunge la precisione desiderata o non soddisfa i criteri di annotazione stabiliti in anticipo.

Panoramica dell'apprendimento attivo

Fig. 1 Panoramica dell'apprendimento attivo.

Capire come funziona l'apprendimento attivo#

Potresti chiederti come la tecnica dell'apprendimento attivo decida quali punti dati richiedono un'annotazione manuale e quali annotare successivamente. Vediamo come funziona l'apprendimento attivo paragonandolo alla preparazione di un esame: ti concentri sugli argomenti di cui non sei sicuro e ti assicuri anche di ripassare una varietà di materie per arrivare ben preparato.

Per le fasi iniziali di selezione dei dati, l'apprendimento attivo utilizza strategie come il campionamento dell'incertezza e il campionamento basato sulla diversità. Il campionamento dell'incertezza dà priorità ai punti dati per i quali il modello ha meno fiducia nelle proprie predizioni, con l'obiettivo di migliorare la precisione nei casi complessi. Il campionamento basato sulla diversità seleziona punti dati che coprono un'ampia gamma di caratteristiche, assicurando che il modello generalizzi bene a dati non osservati grazie all'esposizione a esempi diversi.

Campionamento dell'incertezza a sinistra e campionamento basato sulla diversità a destra

Fig. 2 Campionamento dell'incertezza (a sinistra) e campionamento basato sulla diversità (a destra).

Dopo la selezione iniziale dei dati, l'apprendimento attivo utilizza due approcci principali per l'annotazione: il campionamento basato su pool e il campionamento basato su flusso. Sono simili al modo in cui un insegnante aiuta uno studente a concentrarsi su ciò che è più importante.

Nel campionamento basato su pool, il modello analizza un ampio insieme di dati non annotati e seleziona gli esempi più complessi o informativi da annotare, proprio come uno studente dà la priorità alle schede che trova più difficili. Nel campionamento basato su flusso, invece, il modello elabora i dati man mano che arrivano, decidendo se annotarli o ignorarli, in modo simile a uno studente che chiede aiuto solo quando è in difficoltà. In entrambi i casi, i dati annotati vengono aggiunti al set di addestramento e il modello si riaddestra, migliorando costantemente a ogni iterazione.

Esplorare le applicazioni dell'apprendimento attivo#

L'apprendimento attivo svolge un ruolo fondamentale nelle applicazioni di computer vision, come l'imaging medico e la guida autonoma, migliorando la precisione dei modelli e semplificando il processo di annotazione dei dati. Un esempio interessante è rappresentato dai modelli di computer vision utilizzati nelle auto a guida autonoma per rilevare pedoni o oggetti in condizioni di scarsa illuminazione o nebbia. L'apprendimento attivo può migliorare la precisione concentrandosi su scenari di guida diversi e complessi.

In particolare, l'apprendimento attivo può essere utilizzato per identificare dati o fotogrammi incerti provenienti da questi scenari e sottoporli ad annotazione selettiva. Aggiungere questi esempi annotati al set di addestramento permette al modello di riconoscere meglio pedoni e oggetti in ambienti difficili, ad esempio durante condizioni meteorologiche avverse o la guida notturna.

Ad esempio, NVIDIA ha utilizzato l'apprendimento attivo per migliorare il rilevamento dei pedoni di notte nei propri modelli per la guida autonoma. Selezionando strategicamente i dati più informativi per l'addestramento, soprattutto negli scenari complessi, le prestazioni del modello aumentano notevolmente.

Rilevamento di un pedone con un ombrello utilizzando l'apprendimento attivo

Fig. 3 Rilevamento di un pedone con un ombrello utilizzando l'apprendimento attivo.

L'apprendimento attivo può ridurre i costi di annotazione#

Un altro aspetto fondamentale dell'apprendimento attivo è il suo potenziale di ridurre i costi di annotazione. Lo fa concentrandosi solo sui punti dati più importanti, invece di richiedere annotazioni per l'intero dataset. Questo approccio mirato consente di risparmiare tempo, impegno e denaro. Concentrandosi sui campioni incerti o diversi, l'apprendimento attivo riduce il numero di annotazioni necessarie mantenendo comunque un'elevata precisione del modello.

In effetti, la ricerca dimostra che l'apprendimento attivo può ridurre i costi di annotazione del 40-60% senza compromettere le prestazioni. Questo è particolarmente utile in settori come quello sanitario e manifatturiero, dove l'annotazione dei dati è costosa. Semplificando il processo di annotazione, l'apprendimento attivo aiuta le aziende a sviluppare i modelli più rapidamente e a distribuirli in modo più efficiente, mantenendo al contempo la precisione.

Vantaggi dell'apprendimento attivo#

Ecco alcuni degli altri principali vantaggi che l'apprendimento attivo può offrire:

  • Gestione dello sbilanciamento delle classi: l'apprendimento attivo può aiutare a gestire i problemi di sbilanciamento delle classi annotando istanze appartenenti alle classi di dati minoritarie. Il modello può ottenere prestazioni migliori negli scenari rari con dati limitati.
  • Cicli di sviluppo più rapidi: annotare meno dati accelera indirettamente il processo di sviluppo dei modelli di machine learning e computer vision, lasciando più tempo e risorse per ulteriori iterazioni e sperimentazioni.
  • Adattabilità: può migliorare continuamente i dati di addestramento iterando sui campioni incerti o relativi a casi limite, risultando adatto a dataset dinamici o in evoluzione.

L'apprendimento attivo e AutoML possono lavorare insieme#

L'apprendimento automatico (AutoML) si concentra sull'automazione delle attività lunghe e iterative coinvolte nella creazione e nella distribuzione dei modelli di machine learning. Semplifica i flussi di lavoro di machine learning automatizzando attività come la selezione del modello e la valutazione delle prestazioni, riducendo la necessità di interventi manuali.

Quando viene integrato con l'apprendimento attivo, AutoML può accelerare e ottimizzare il ciclo di vita dello sviluppo del modello. Il componente di apprendimento attivo seleziona strategicamente i punti dati più informativi da annotare, mentre AutoML perfeziona il modello automatizzando la scelta dell'architettura, dei parametri e della regolazione.

Flusso di lavoro di AutoML

Fig. 4 Flusso di lavoro di AutoML.

Vediamo questa combinazione di tecnologie con un esempio.

Supponiamo che tu stia cercando di rilevare condizioni rare nell'imaging medico (un caso d'uso in cui i dataset annotati sono limitati e costosi da ottenere). L'apprendimento attivo può identificare e selezionare dati incerti, come variazioni sottili nelle immagini radiografiche, che il modello non riesce a classificare. I dati incerti possono quindi ricevere la priorità per l'annotazione manuale, così da migliorare la comprensione del modello.

Con i dati annotati, AutoML può ottimizzare il modello esplorando diverse architetture, iperparametri e altre tecniche di aumento dei dati. Il processo iterativo accelera lo sviluppo di modelli di visione affidabili come Ultralytics YOLO11, che aiutano gli operatori sanitari a formulare diagnosi accurate.

Le sfide dell'apprendimento attivo#

L'apprendimento attivo e le sue tecniche offrono numerosi vantaggi, ma ci sono alcuni aspetti da tenere presenti quando si implementano queste strategie:

  • Selezione della strategia di interrogazione: l'apprendimento attivo comprende numerose tecniche e la scelta del metodo migliore influisce significativamente sull'efficacia del modello. Selezionare una strategia inappropriata può ridurre le prestazioni del modello per una specifica applicazione.
  • Costi di riaddestramento: la natura iterativa dell'apprendimento attivo richiede risorse computazionali costose, soprattutto per i dataset di grandi dimensioni. Il modello viene riaddestrato dopo ogni ciclo di annotazione, aumentando la complessità.
  • Qualità del modello iniziale: l'efficacia dell'apprendimento attivo dipende dalla qualità del modello iniziale. Un modello iniziale con prestazioni scarse potrebbe non identificare con precisione i punti dati informativi, generando richieste di annotazione di qualità insufficiente e riducendo le prestazioni complessive.

Il futuro dell'apprendimento attivo e di AutoML#

Grazie ai recenti progressi nell'AI e nella computer vision, l'apprendimento attivo si prepara ad affrontare sfide più complesse e a semplificare i flussi di lavoro di machine learning. La combinazione dell'apprendimento attivo con tecniche come l'apprendimento federato e l'apprendimento auto-supervisionato può migliorare ulteriormente l'efficienza e la scalabilità dei modelli di visione.

L'apprendimento federato consente di addestrare un modello su più dispositivi o server con un framework distribuito, senza richiedere che i dati lascino la loro posizione originale. In settori come quello sanitario, dove la privacy dei dati è importante, l'apprendimento federato permette di addestrare il modello direttamente sui dati locali sensibili mantenendoli al sicuro. Invece di condividere i dati grezzi, vengono condivisi solo gli aggiornamenti o gli insight del modello, garantendo la protezione delle informazioni private e contribuendo comunque al processo di addestramento.

Nel frattempo, l'apprendimento auto-supervisionato contribuisce a ridurre la necessità di dati annotati effettuando il pre-addestramento dei modelli su dati non annotati. Questo processo crea una base solida per il modello. L'apprendimento attivo può quindi sviluppare ulteriormente questa base identificando e selezionando i punti dati più importanti per l'annotazione umana, perfezionando ulteriormente il modello.

Dall'apprendimento attivo all'impatto concreto#

L'apprendimento attivo offre un modo pratico per affrontare sfide importanti nella computer vision, come l'elevato costo dell'annotazione dei dati e la necessità di modelli più precisi. Concentrandosi sull'annotazione solo dei punti dati più preziosi, riduce l'impegno richiesto alle persone migliorando al contempo le prestazioni del modello.

Se combinato con tecnologie come AutoML, l'apprendimento attivo semplifica lo sviluppo dei modelli automatizzando le attività lunghe. Con il proseguire dei progressi, l'apprendimento attivo è destinato a diventare uno strumento essenziale per creare sistemi di computer vision più intelligenti ed efficienti.

Esplora il nostro repository GitHub e unisciti alla nostra community per saperne di più sull'AI e sui modelli di computer vision. Scopri altre applicazioni della computer vision nella produzione e nella sanità nelle nostre pagine dedicate alle soluzioni. Puoi anche consultare le nostre opzioni di licenza per iniziare oggi stesso il tuo percorso nell'AI per la visione.

Explore solutions

Visione artificiale per immagini aeree

Visione artificiale per immagini aeree

Traduci immagini di droni e aeree in informazioni in tempo reale per agricoltura, acquacoltura, monitoraggio ambientale, conservazione e analisi geospaziale con Ultralytics YOLO.
Scopri di più
Computer vision nel settore aerospaziale

Computer vision nel settore aerospaziale

Porta la visione artificiale al monitoraggio aereo con i modelli Ultralytics YOLO. Potenzia droni, flussi di lavoro aerospaziali, conservazione ambientale e industrie geospaziali con soluzioni di computer vision.
Scopri di più

Proteggi ogni sito con i modelli Ultralytics YOLO. La visione artificiale alimenta il monitoraggio del perimetro, il rilevamento delle minacce, il riconoscimento delle targhe e la sicurezza sul lavoro.
Scopri di più
Computer vision nella robotica

Computer vision nella robotica

Potenzia macchine più intelligenti con i modelli Ultralytics YOLO. La Vision AI nella robotica abilita la navigazione autonoma, la percezione, il tracciamento degli oggetti e il controllo in tempo reale.
Scopri di più
Computer vision nella logistica

Computer vision nella logistica

Semplifica la logistica con i modelli Ultralytics YOLO. La Vision AI abilita l'ispezione dei pacchi, lo smistamento, il tracciamento dei veicoli e il monitoraggio della sicurezza nei magazzini in tempo reale.
Scopri di più
Computer vision nel commercio al dettaglio

Computer vision nel commercio al dettaglio

Reinventa il commercio al dettaglio con i modelli Ultralytics YOLO. La Vision AI potenzia il tracciamento dell'inventario, il monitoraggio degli scaffali, la gestione delle code e analisi più intelligenti dei clienti.
Scopri di più
Computer vision nel settore sanitario

Computer vision nel settore sanitario

Crea soluzioni sanitarie con i modelli Ultralytics YOLO. La Vision AI nel settore sanitario abilita imaging medico più rapido, diagnosi più intelligenti e monitoraggio dei pazienti.
Scopri di più
Computer vision nella produzione

Computer vision nella produzione

Ottimizza la produzione con i modelli Ultralytics YOLO. La Vision AI supporta il controllo qualità, il rilevamento dei difetti, la conformità ai DPI e l'automazione delle linee di assemblaggio.
Scopri di più
Computer vision nel settore automobilistico

Computer vision nel settore automobilistico

Applica la computer vision al settore automobilistico con i modelli Ultralytics YOLO. La vision AI migliora la sicurezza stradale, i sistemi di assistenza alla guida e l'automazione dei veicoli per strade più intelligenti.
Scopri di più
Computer vision in agricoltura

Computer vision in agricoltura

Porta la vision AI nell'agricoltura intelligente con i modelli Ultralytics YOLO. Abilita il monitoraggio delle colture, il tracciamento del bestiame e l'agricoltura di precisione per raccolti più abbondanti e intelligenti.
Scopri di più
Visione artificiale per immagini aeree

Visione artificiale per immagini aeree

Traduci immagini di droni e aeree in informazioni in tempo reale per agricoltura, acquacoltura, monitoraggio ambientale, conservazione e analisi geospaziale con Ultralytics YOLO.
Scopri di più
Computer vision nel settore aerospaziale

Computer vision nel settore aerospaziale

Porta la visione artificiale al monitoraggio aereo con i modelli Ultralytics YOLO. Potenzia droni, flussi di lavoro aerospaziali, conservazione ambientale e industrie geospaziali con soluzioni di computer vision.
Scopri di più

Proteggi ogni sito con i modelli Ultralytics YOLO. La visione artificiale alimenta il monitoraggio del perimetro, il rilevamento delle minacce, il riconoscimento delle targhe e la sicurezza sul lavoro.
Scopri di più
Computer vision nella robotica

Computer vision nella robotica

Potenzia macchine più intelligenti con i modelli Ultralytics YOLO. La Vision AI nella robotica abilita la navigazione autonoma, la percezione, il tracciamento degli oggetti e il controllo in tempo reale.
Scopri di più
Computer vision nella logistica

Computer vision nella logistica

Semplifica la logistica con i modelli Ultralytics YOLO. La Vision AI abilita l'ispezione dei pacchi, lo smistamento, il tracciamento dei veicoli e il monitoraggio della sicurezza nei magazzini in tempo reale.
Scopri di più
Computer vision nel commercio al dettaglio

Computer vision nel commercio al dettaglio

Reinventa il commercio al dettaglio con i modelli Ultralytics YOLO. La Vision AI potenzia il tracciamento dell'inventario, il monitoraggio degli scaffali, la gestione delle code e analisi più intelligenti dei clienti.
Scopri di più
Computer vision nel settore sanitario

Computer vision nel settore sanitario

Crea soluzioni sanitarie con i modelli Ultralytics YOLO. La Vision AI nel settore sanitario abilita imaging medico più rapido, diagnosi più intelligenti e monitoraggio dei pazienti.
Scopri di più
Computer vision nella produzione

Computer vision nella produzione

Ottimizza la produzione con i modelli Ultralytics YOLO. La Vision AI supporta il controllo qualità, il rilevamento dei difetti, la conformità ai DPI e l'automazione delle linee di assemblaggio.
Scopri di più
Computer vision nel settore automobilistico

Computer vision nel settore automobilistico

Applica la computer vision al settore automobilistico con i modelli Ultralytics YOLO. La vision AI migliora la sicurezza stradale, i sistemi di assistenza alla guida e l'automazione dei veicoli per strade più intelligenti.
Scopri di più
Computer vision in agricoltura

Computer vision in agricoltura

Porta la vision AI nell'agricoltura intelligente con i modelli Ultralytics YOLO. Abilita il monitoraggio delle colture, il tracciamento del bestiame e l'agricoltura di precisione per raccolti più abbondanti e intelligenti.
Scopri di più
Visione artificiale per immagini aeree

Visione artificiale per immagini aeree

Traduci immagini di droni e aeree in informazioni in tempo reale per agricoltura, acquacoltura, monitoraggio ambientale, conservazione e analisi geospaziale con Ultralytics YOLO.
Scopri di più
Computer vision nel settore aerospaziale

Computer vision nel settore aerospaziale

Porta la visione artificiale al monitoraggio aereo con i modelli Ultralytics YOLO. Potenzia droni, flussi di lavoro aerospaziali, conservazione ambientale e industrie geospaziali con soluzioni di computer vision.
Scopri di più

Proteggi ogni sito con i modelli Ultralytics YOLO. La visione artificiale alimenta il monitoraggio del perimetro, il rilevamento delle minacce, il riconoscimento delle targhe e la sicurezza sul lavoro.
Scopri di più
Computer vision nella robotica

Computer vision nella robotica

Potenzia macchine più intelligenti con i modelli Ultralytics YOLO. La Vision AI nella robotica abilita la navigazione autonoma, la percezione, il tracciamento degli oggetti e il controllo in tempo reale.
Scopri di più
Computer vision nella logistica

Computer vision nella logistica

Semplifica la logistica con i modelli Ultralytics YOLO. La Vision AI abilita l'ispezione dei pacchi, lo smistamento, il tracciamento dei veicoli e il monitoraggio della sicurezza nei magazzini in tempo reale.
Scopri di più
Computer vision nel commercio al dettaglio

Computer vision nel commercio al dettaglio

Reinventa il commercio al dettaglio con i modelli Ultralytics YOLO. La Vision AI potenzia il tracciamento dell'inventario, il monitoraggio degli scaffali, la gestione delle code e analisi più intelligenti dei clienti.
Scopri di più
Computer vision nel settore sanitario

Computer vision nel settore sanitario

Crea soluzioni sanitarie con i modelli Ultralytics YOLO. La Vision AI nel settore sanitario abilita imaging medico più rapido, diagnosi più intelligenti e monitoraggio dei pazienti.
Scopri di più
Computer vision nella produzione

Computer vision nella produzione

Ottimizza la produzione con i modelli Ultralytics YOLO. La Vision AI supporta il controllo qualità, il rilevamento dei difetti, la conformità ai DPI e l'automazione delle linee di assemblaggio.
Scopri di più
Computer vision nel settore automobilistico

Computer vision nel settore automobilistico

Applica la computer vision al settore automobilistico con i modelli Ultralytics YOLO. La vision AI migliora la sicurezza stradale, i sistemi di assistenza alla guida e l'automazione dei veicoli per strade più intelligenti.
Scopri di più
Computer vision in agricoltura

Computer vision in agricoltura

Porta la vision AI nell'agricoltura intelligente con i modelli Ultralytics YOLO. Abilita il monitoraggio delle colture, il tracciamento del bestiame e l'agricoltura di precisione per raccolti più abbondanti e intelligenti.
Scopri di più

Costruiamo insieme il futuro dell'AI!

Inizia il tuo percorso verso il futuro del machine learning