YOLO Vision 2026:
AI per la visione

Tipi di tecniche di apprendimento dell’AI utilizzate nella computer vision

Esplora i diversi tipi di tecniche di machine learning e deep learning utilizzati nelle applicazioni di computer vision, dal supervised learning al transfer learning.

ABAbirami Vina4 min read
Tipi di tecniche di apprendimento dell’AI utilizzate nella computer vision

Il machine learning è un tipo di intelligenza artificiale (AI) che aiuta i computer ad apprendere dai dati, consentendo loro di prendere decisioni autonomamente, senza dover programmare dettagliatamente ogni attività. Comprende la creazione di modelli algoritmici in grado di identificare schemi nei dati. Identificando gli schemi nei dati e apprendendo da essi, questi algoritmi possono migliorare gradualmente le proprie prestazioni nel tempo.

Un ambito in cui il machine learning svolge un ruolo cruciale è la computer vision, un settore dell'IA che si concentra sui dati visivi. La computer vision utilizza il machine learning per aiutare i computer a rilevare e riconoscere schemi in immagini e video. Grazie ai progressi nel machine learning, si stima che il valore del mercato globale della computer vision raggiungerà circa 175,72 miliardi di dollari entro il 2032.

In questo articolo esamineremo i diversi tipi di machine learning utilizzati nella computer vision, tra cui l'apprendimento supervisionato, non supervisionato, per rinforzo e per trasferimento, e il ruolo che ciascuno svolge in diverse applicazioni. Iniziamo!

Panoramica del machine learning nella computer vision#

La computer vision si basa sul machine learning, in particolare su tecniche come il deep learning e le reti neurali, per interpretare e analizzare le informazioni visive. Questi metodi consentono ai computer di eseguire attività di computer vision, come rilevare oggetti nelle immagini, classificare le immagini per categoria e riconoscere i volti. Il machine learning è inoltre essenziale per le applicazioni di computer vision in tempo reale, come il [controllo qualità](https://ultralytics-translation-7.invalid nella produzione e l'imaging medico nel settore sanitario. In questi casi, le reti neurali aiutano i computer a interpretare dati visivi complessi, ad esempio analizzando scansioni cerebrali per rilevare tumori.

Infatti, molti modelli avanzati di computer vision, come Ultralytics YOLO11, sono basati su reti neurali.

Segmentazione di scansioni cerebrali con Ultralytics YOLO11

Fig. 1. Segmentazione di scansioni cerebrali con Ultralytics YOLO11.

Esistono diversi metodi di apprendimento nel machine learning, come l'apprendimento supervisionato, non supervisionato, per trasferimento e per rinforzo, che ampliano i limiti di ciò che è possibile fare nella computer vision. Nelle sezioni seguenti esamineremo ciascuno di questi tipi per capire come contribuiscono alla computer vision.

Esplorazione dell'apprendimento supervisionato#

L'apprendimento supervisionato è il tipo di machine learning più utilizzato. Nell'apprendimento supervisionato, i modelli vengono addestrati utilizzando dati etichettati. Ogni input è associato all'output corretto, aiutando il modello ad apprendere. Come uno studente che impara da un insegnante, questi dati etichettati fungono da guida o supervisore.

Durante l'addestramento, al modello vengono forniti sia i dati di input (le informazioni da elaborare) sia i dati di output (le risposte corrette). Questa configurazione aiuta il modello ad apprendere la relazione tra input e output. L'obiettivo principale dell'apprendimento supervisionato è consentire al modello di scoprire una regola o uno schema che colleghi accuratamente ogni input al rispettivo output corretto. Grazie a questa mappatura, il modello può effettuare previsioni accurate quando incontra nuovi dati. Ad esempio, il riconoscimento facciale nella computer vision si basa sull'apprendimento supervisionato per identificare i volti in base agli schemi appresi.

Un'applicazione comune consiste nello sbloccare il tuo smartphone tramite il riconoscimento facciale. Il modello viene addestrato su immagini etichettate del tuo volto, così quando provi a sbloccare il telefono confronta l'immagine acquisita in tempo reale con ciò che ha appreso. Se rileva una corrispondenza, il telefono si sblocca.

Riconoscimento facciale utilizzato per sbloccare il tuo smartphone

Fig. 2. Il riconoscimento facciale può essere utilizzato per sbloccare il tuo smartphone.

Come funziona l'apprendimento non supervisionato nell'IA?#

L'apprendimento non supervisionato è un tipo di machine learning che utilizza dati non etichettati: durante l'addestramento il modello non riceve indicazioni né risposte corrette. Impara invece a scoprire autonomamente schemi e informazioni utili.

L'apprendimento non supervisionato identifica gli schemi utilizzando tre metodi principali:

  • Clustering: raggruppa insieme punti dati simili. È utile per attività come la segmentazione dei clienti, in cui i clienti simili possono essere raggruppati in base ai loro comportamenti o attributi.
  • Associazione: viene utilizzata per identificare le relazioni tra gli elementi, aiutando a scoprire i collegamenti all'interno dei dati, ad esempio individuando i prodotti acquistati spesso insieme nell'analisi del carrello della spesa.
  • Riduzione della dimensionalità: semplifica i dataset rimuovendo le caratteristiche ridondanti, facilitando la visualizzazione e l'elaborazione.

Un'applicazione chiave dell'apprendimento non supervisionato è la compressione delle immagini, in cui tecniche come il clustering k-means riducono le dimensioni dell'immagine senza comprometterne la qualità visiva. I pixel vengono raggruppati in cluster e ogni cluster viene rappresentato da un colore medio, producendo un'immagine con meno colori e dimensioni del file ridotte.

Un esempio di compressione non supervisionata delle immagini

Fig. 3. Un esempio di compressione non supervisionata delle immagini.

Tuttavia, l'apprendimento non supervisionato presenta alcune limitazioni. In assenza di risposte predefinite, può avere difficoltà in termini di accuratezza e valutazione delle prestazioni. Spesso richiede un intervento manuale per interpretare i risultati ed etichettare i gruppi, ed è sensibile a problemi come valori mancanti e rumore, che possono influire sulla qualità dei risultati.

Spiegazione dell'apprendimento per rinforzo#

A differenza dell'apprendimento supervisionato e non supervisionato, l'apprendimento per rinforzo non si basa sui dati di addestramento. Utilizza invece agenti basati su reti neurali che interagiscono con un ambiente per raggiungere un obiettivo specifico.

Il processo comprende tre componenti principali:

  • Agente: colui che apprende o prende le decisioni.
  • Ambiente: tutto ciò con cui l'agente interagisce, in forma reale o virtuale.
  • Segnale di ricompensa: un valore numerico assegnato dopo ogni azione, che guida l'agente verso l'obiettivo.

Quando l'agente compie delle azioni, influisce sull'ambiente, che risponde fornendo un feedback. Il feedback aiuta l'agente a valutare le proprie scelte e ad adeguare il proprio comportamento. Il segnale di ricompensa aiuta l'agente a capire quali azioni lo avvicinano al raggiungimento dell'obiettivo.

L'apprendimento per rinforzo è fondamentale per casi d'uso come la guida autonoma e la robotica. Nella guida autonoma, attività come il controllo del veicolo, il rilevamento degli oggetti e l'evitamento apprendono in base al feedback. I modelli vengono addestrati utilizzando agenti basati su reti neurali per rilevare pedoni o altri oggetti e intraprendere azioni appropriate per evitare le collisioni. Analogamente, nella robotica, l'apprendimento per rinforzo consente attività come la manipolazione degli oggetti e il controllo dei movimenti.

Un ottimo esempio concreto di apprendimento per rinforzo è un progetto di OpenAI, in cui i ricercatori hanno addestrato agenti di IA a giocare al popolare videogioco multiplayer Dota 2. Utilizzando reti neurali, questi agenti elaboravano enormi quantità di informazioni provenienti dall'ambiente di gioco per prendere decisioni rapide e strategiche. Grazie al feedback continuo, gli agenti hanno appreso e migliorato le proprie prestazioni nel tempo, raggiungendo infine un livello di abilità sufficiente a battere alcuni dei migliori giocatori del gioco.

Interpretazione umana rispetto a quella dell'IA della Dota Matrix

Fig. 4. Interpretazione umana rispetto a quella dell'IA della Dota Matrix.

Comprendere le basi del transfer learning#

Il transfer learning è diverso dagli altri tipi di apprendimento. Invece di addestrare un modello da zero, utilizza un modello preaddestrato su un grande dataset e lo sottopone a fine-tuning per un'attività nuova, ma correlata. Le conoscenze acquisite durante l'addestramento iniziale vengono utilizzate per migliorare le prestazioni nella nuova attività. Il transfer learning riduce il tempo necessario per l'addestramento di una nuova attività, a seconda della sua complessità. Funziona mantenendo i livelli iniziali del modello, che catturano le caratteristiche generali, e sostituendo i livelli finali con quelli specifici della nuova attività.

Il trasferimento dello stile artistico è un'interessante applicazione del transfer learning nella computer vision. Questa tecnica consente a un modello di trasformare un'immagine per adattarla allo stile di diverse opere d'arte. A tale scopo, una rete neurale viene prima addestrata su un grande dataset di immagini abbinate ai rispettivi stili artistici. Attraverso questo processo, il modello impara a identificare le caratteristiche generali delle immagini e gli schemi stilistici.

Una volta addestrato, il modello può essere sottoposto a fine-tuning per applicare lo stile di un dipinto specifico a una nuova immagine. La rete si adatta alla nuova immagine preservando le caratteristiche stilistiche apprese, consentendole di creare un risultato unico che combina il contenuto originale con lo stile artistico selezionato. Ad esempio, potresti prendere una foto di una catena montuosa e applicarvi lo stile de L'urlo di Edvard Munch, ottenendo un'immagine che rappresenta la scena con lo stile audace ed espressivo del dipinto.

Un esempio di trasferimento dello stile artistico tramite transfer learning

Fig. 5. Un esempio di trasferimento dello stile artistico tramite transfer learning.

Uno sguardo alle differenze tra i tipi di machine learning#

Ora che abbiamo illustrato i principali tipi di machine learning, esaminiamoli più da vicino per aiutarti a capire quale sia più adatto alle diverse applicazioni.

  • Apprendimento supervisionato: questo tipo è molto accurato quando lavora con dati etichettati, ma richiede una grande quantità di dati e può essere sensibile al rumore.
  • Apprendimento non supervisionato: è utile per esplorare dati non etichettati e trovare schemi nascosti, anche se i risultati possono essere meno precisi e più difficili da interpretare.
  • Apprendimento per rinforzo: addestra gli agenti a prendere decisioni passo dopo passo in ambienti complessi, ma spesso richiede una notevole potenza di calcolo.
  • Transfer learning: questo approccio utilizza modelli preaddestrati per accelerare l'addestramento e migliorare le prestazioni nelle nuove attività, soprattutto quando i dati sono limitati.

Confronto tra tutti i tipi di machine learning

Fig. 6. Confronto tra tutti i tipi di machine learning. Immagine dell'autore.

La scelta del tipo di machine learning più adatto dipende da diversi fattori. L'apprendimento supervisionato funziona bene se disponi di molti dati etichettati e di un'attività ben definita. L'apprendimento non supervisionato è utile per esplorare i dati o quando gli esempi etichettati sono pochi. L'apprendimento per rinforzo è ideale per attività complesse che richiedono decisioni passo dopo passo, mentre il transfer learning è ottimo quando i dati sono limitati o le risorse scarseggiano. Considerando questi fattori, puoi selezionare l'approccio più adatto al tuo progetto di computer vision.

Conclusioni#

Le tecniche di machine learning possono affrontare una grande varietà di sfide, soprattutto in ambiti come la computer vision. Comprendendo i diversi tipi, ovvero l'apprendimento supervisionato, non supervisionato, per rinforzo e per trasferimento, puoi scegliere l'approccio migliore per le tue esigenze.

L'apprendimento supervisionato è ideale per le attività che richiedono elevata accuratezza e dati etichettati, mentre quello non supervisionato è adatto a trovare schemi nei dati non etichettati. L'apprendimento per rinforzo funziona bene in contesti complessi basati sulle decisioni, mentre il transfer learning è utile quando vuoi basarti su modelli preaddestrati con una quantità limitata di dati.

Ogni metodo presenta punti di forza e applicazioni unici, dal riconoscimento facciale alla robotica fino al trasferimento dello stile artistico. La scelta del tipo giusto può aprire nuove possibilità in settori come quello sanitario, automobilistico e dell'intrattenimento.

Per saperne di più, visita il nostro repository GitHub e partecipa alla nostra community. Scopri le applicazioni dell'AI nelle auto a guida autonoma e nell'agricoltura nelle nostre pagine dedicate alle soluzioni. 🚀

Explore solutions

Real-time AI that works with your team

Computer vision nella robotica

Potenzia macchine più intelligenti con i modelli Ultralytics YOLO. La Vision AI nella robotica abilita la navigazione autonoma, la percezione, il tracciamento degli oggetti e il controllo in tempo reale.
Scopri di più
Real-time AI that works with your team

Computer vision nella logistica

Semplifica la logistica con i modelli Ultralytics YOLO. La Vision AI abilita l'ispezione dei pacchi, lo smistamento, il tracciamento dei veicoli e il monitoraggio della sicurezza nei magazzini in tempo reale.
Scopri di più
Real-time AI that works with your team

Computer vision nel commercio al dettaglio

Reinventa il commercio al dettaglio con i modelli Ultralytics YOLO. La Vision AI potenzia il tracciamento dell'inventario, il monitoraggio degli scaffali, la gestione delle code e analisi più intelligenti dei clienti.
Scopri di più
Real-time AI that works with your team

Computer vision nel settore sanitario

Crea soluzioni sanitarie con i modelli Ultralytics YOLO. La Vision AI nel settore sanitario abilita imaging medico più rapido, diagnosi più intelligenti e monitoraggio dei pazienti.
Scopri di più
Real-time AI that works with your team

Computer vision nella produzione

Ottimizza la produzione con i modelli Ultralytics YOLO. La Vision AI supporta il controllo qualità, il rilevamento dei difetti, la conformità ai DPI e l'automazione delle linee di assemblaggio.
Scopri di più
Real-time AI that works with your operation

Computer vision nel settore automobilistico

Applica la computer vision al settore automobilistico con i modelli Ultralytics YOLO. La vision AI migliora la sicurezza stradale, i sistemi di assistenza alla guida e l'automazione dei veicoli per strade più intelligenti.
Scopri di più
Real-time AI tailored to your operation

Computer vision in agricoltura

Porta la vision AI nell'agricoltura intelligente con i modelli Ultralytics YOLO. Abilita il monitoraggio delle colture, il tracciamento del bestiame e l'agricoltura di precisione per raccolti più abbondanti e intelligenti.
Scopri di più
Real-time AI that works with your team

Computer vision nella robotica

Potenzia macchine più intelligenti con i modelli Ultralytics YOLO. La Vision AI nella robotica abilita la navigazione autonoma, la percezione, il tracciamento degli oggetti e il controllo in tempo reale.
Scopri di più
Real-time AI that works with your team

Computer vision nella logistica

Semplifica la logistica con i modelli Ultralytics YOLO. La Vision AI abilita l'ispezione dei pacchi, lo smistamento, il tracciamento dei veicoli e il monitoraggio della sicurezza nei magazzini in tempo reale.
Scopri di più
Real-time AI that works with your team

Computer vision nel commercio al dettaglio

Reinventa il commercio al dettaglio con i modelli Ultralytics YOLO. La Vision AI potenzia il tracciamento dell'inventario, il monitoraggio degli scaffali, la gestione delle code e analisi più intelligenti dei clienti.
Scopri di più
Real-time AI that works with your team

Computer vision nel settore sanitario

Crea soluzioni sanitarie con i modelli Ultralytics YOLO. La Vision AI nel settore sanitario abilita imaging medico più rapido, diagnosi più intelligenti e monitoraggio dei pazienti.
Scopri di più
Real-time AI that works with your team

Computer vision nella produzione

Ottimizza la produzione con i modelli Ultralytics YOLO. La Vision AI supporta il controllo qualità, il rilevamento dei difetti, la conformità ai DPI e l'automazione delle linee di assemblaggio.
Scopri di più
Real-time AI that works with your operation

Computer vision nel settore automobilistico

Applica la computer vision al settore automobilistico con i modelli Ultralytics YOLO. La vision AI migliora la sicurezza stradale, i sistemi di assistenza alla guida e l'automazione dei veicoli per strade più intelligenti.
Scopri di più
Real-time AI tailored to your operation

Computer vision in agricoltura

Porta la vision AI nell'agricoltura intelligente con i modelli Ultralytics YOLO. Abilita il monitoraggio delle colture, il tracciamento del bestiame e l'agricoltura di precisione per raccolti più abbondanti e intelligenti.
Scopri di più
Real-time AI that works with your team

Computer vision nella robotica

Potenzia macchine più intelligenti con i modelli Ultralytics YOLO. La Vision AI nella robotica abilita la navigazione autonoma, la percezione, il tracciamento degli oggetti e il controllo in tempo reale.
Scopri di più
Real-time AI that works with your team

Computer vision nella logistica

Semplifica la logistica con i modelli Ultralytics YOLO. La Vision AI abilita l'ispezione dei pacchi, lo smistamento, il tracciamento dei veicoli e il monitoraggio della sicurezza nei magazzini in tempo reale.
Scopri di più
Real-time AI that works with your team

Computer vision nel commercio al dettaglio

Reinventa il commercio al dettaglio con i modelli Ultralytics YOLO. La Vision AI potenzia il tracciamento dell'inventario, il monitoraggio degli scaffali, la gestione delle code e analisi più intelligenti dei clienti.
Scopri di più
Real-time AI that works with your team

Computer vision nel settore sanitario

Crea soluzioni sanitarie con i modelli Ultralytics YOLO. La Vision AI nel settore sanitario abilita imaging medico più rapido, diagnosi più intelligenti e monitoraggio dei pazienti.
Scopri di più
Real-time AI that works with your team

Computer vision nella produzione

Ottimizza la produzione con i modelli Ultralytics YOLO. La Vision AI supporta il controllo qualità, il rilevamento dei difetti, la conformità ai DPI e l'automazione delle linee di assemblaggio.
Scopri di più
Real-time AI that works with your operation

Computer vision nel settore automobilistico

Applica la computer vision al settore automobilistico con i modelli Ultralytics YOLO. La vision AI migliora la sicurezza stradale, i sistemi di assistenza alla guida e l'automazione dei veicoli per strade più intelligenti.
Scopri di più
Real-time AI tailored to your operation

Computer vision in agricoltura

Porta la vision AI nell'agricoltura intelligente con i modelli Ultralytics YOLO. Abilita il monitoraggio delle colture, il tracciamento del bestiame e l'agricoltura di precisione per raccolti più abbondanti e intelligenti.
Scopri di più

Costruiamo insieme il futuro dell'AI!

Inizia il tuo percorso verso il futuro del machine learning