Tutto ciò che devi sapere sull'AI spiegabile (XAI)
Scopri come l'AI spiegabile (XAI) crea fiducia rendendo le previsioni dell'AI trasparenti e affidabili nel settore sanitario, nella sicurezza, nella guida autonoma e non solo.

Hai mai visto una risposta fornita da uno strumento di intelligenza artificiale (AI) come ChatGPT e ti sei chiesto come sia arrivato a quella conclusione? In tal caso, hai incontrato il problema della “scatola nera” dell'AI. È un termine che indica la mancanza di chiarezza sul modo in cui i modelli di AI elaborano e analizzano i dati. Persino gli ingegneri e gli scienziati dell'AI che lavorano regolarmente con algoritmi di AI all'avanguardia possono avere difficoltà a comprenderne appieno il funzionamento interno. Infatti, solo il 22% dei professionisti IT comprende davvero le capacità degli strumenti di AI.
L'incertezza sul modo in cui i modelli di AI prendono decisioni può essere rischiosa, soprattutto in ambiti critici come la computer vision nel settore sanitario e l'AI nel settore finanziario. Tuttavia, si stanno compiendo progressi significativi per affrontare queste sfide e migliorare la trasparenza.
In particolare, l'intelligenza artificiale spiegabile (XAI) si concentra esclusivamente sulla risoluzione di questo problema. In parole semplici, consiste in un insieme di processi e metodi che aiutano gli utenti umani a comprendere e a fidarsi dei risultati o degli output forniti da complessi algoritmi di machine learning.
La XAI può aiutare gli sviluppatori ad assicurarsi che i sistemi di AI funzionino come previsto. Può inoltre aiutare le aziende di AI a soddisfare gli standard normativi. In questo articolo esploreremo l'intelligenza artificiale spiegabile e la sua vasta gamma di casi d'uso. Cominciamo!
L'importanza dell'intelligenza artificiale spiegabile#
La spiegabilità è fondamentale quando si lavora con l'AI. Ciò è particolarmente vero per il sottocampo dell'AI noto come computer vision, ampiamente utilizzato in applicazioni di settori come quello sanitario. Quando si utilizzano modelli di visione in settori così sensibili, è importante che il funzionamento del modello sia trasparente e interpretabile per tutti.
L'interpretabilità nei modelli di computer vision aiuta gli utenti a comprendere meglio come è stata effettuata una predizione e la logica alla base di essa. La trasparenza contribuisce a sua volta a rendere chiaro a tutti il funzionamento del modello, illustrandone chiaramente i limiti e garantendo che i dati siano utilizzati in modo etico. Per esempio, la computer vision può aiutare i radiologi a identificare in modo efficiente le complicazioni per la salute nelle immagini radiografiche.

Fig. 1. Radiografie del torace analizzate con l'AI per la visione artificiale, che mostrano classificazioni di tubercolosi sana, malata, attiva e latente.
Tuttavia, un sistema di visione semplicemente accurato non è sufficiente. Il sistema deve anche essere in grado di spiegare le proprie decisioni. Supponiamo che il sistema possa mostrare quali parti dell'immagine hanno portato alle sue conclusioni: in tal caso, qualsiasi output sarebbe più chiaro. Un simile livello di trasparenza aiuterebbe i professionisti sanitari a verificare i propri risultati e ad assicurarsi che l'assistenza ai pazienti soddisfi gli standard medici.
Un altro motivo per cui la spiegabilità è essenziale è che rende le aziende di AI responsabili e crea fiducia negli utenti. Un'AI affidabile fa sentire gli utenti sicuri del fatto che le innovazioni dell'AI funzionino in modo affidabile, prendano decisioni eque e gestiscano i dati in modo responsabile.
Principali tecniche di intelligenza artificiale spiegabile nella computer vision#
Ora che abbiamo discusso dell'importanza della spiegabilità nella computer vision, esaminiamo le principali tecniche di XAI utilizzate nell'AI per la visione artificiale.
Mappe di salienza#
Le reti neurali sono modelli ispirati al cervello umano, progettati per riconoscere schemi e prendere decisioni elaborando dati attraverso strati interconnessi di nodi (neuroni). Possono essere utilizzate per risolvere problemi complessi di computer vision con elevata accuratezza. Nonostante questa accuratezza, per progettazione restano scatole nere.
Le mappe di salienza sono una tecnica di XAI che può essere utilizzata per comprendere ciò che le reti neurali rilevano quando analizzano le immagini. Possono inoltre essere utilizzate per eseguire il troubleshooting dei modelli nel caso in cui non funzionino come previsto.
Le mappe di salienza funzionano concentrandosi sulle parti di un'immagine (pixel) che determinano le predizioni di un modello. Questo processo è molto simile alla retropropagazione, in cui il modello risale dalle predizioni all'input. Tuttavia, invece di aggiornare i pesi del modello in base agli errori, osserviamo semplicemente quanto ogni pixel "conti" per la predizione. Le mappe di salienza sono molto utili per attività di computer vision come la classificazione delle immagini.
Per esempio, se un modello di classificazione delle immagini predice che un'immagine raffigura un cane, possiamo osservare la sua mappa di salienza per capire perché il modello ritiene che sia un cane. Questo ci aiuta a identificare quali pixel influenzano maggiormente l'output. La mappa di salienza evidenzierebbe tutti i pixel che hanno contribuito alla predizione finale dell'immagine come cane.

Fig. 2. Vista affiancata delle immagini di input e delle relative mappe di salienza.
Mappatura delle attivazioni delle classi (CAM)#
La mappatura delle attivazioni delle classi è un'altra tecnica di XAI utilizzata per comprendere su quali parti di un'immagine si concentra una rete neurale quando effettua predizioni di classificazione delle immagini. Funziona in modo simile alle mappe di salienza, ma si concentra sull'identificazione delle caratteristiche importanti dell'immagine invece che su pixel specifici. Le caratteristiche sono schemi o dettagli, come forme o texture, che il modello rileva nell'immagine.
Metodi come la mappatura delle attivazioni delle classi pesata per il gradiente (Grad-CAM) e Grad-CAM++ si basano sulla stessa idea, apportando alcuni miglioramenti.
Ecco come funziona la CAM:
- Prima che la rete neurale prenda la decisione finale, utilizza un passaggio chiamato pooling medio globale (GAP) per semplificare le informazioni. Il GAP combina tutti i pixel di uno schema rilevato in un singolo valore medio, creando un riepilogo per ogni mappa delle caratteristiche (una rappresentazione visiva degli schemi rilevati).
- A ogni mappa delle caratteristiche viene quindi assegnato un peso che indica quanto sia importante per predire una determinata classe (come "uccello" o "gatto").
- Tuttavia, una limitazione della CAM è che potrebbe essere necessario riaddestrare il modello per calcolare questi pesi, un'operazione che può richiedere molto tempo.
Grad-CAM migliora questo approccio utilizzando i gradienti, che sono come segnali che mostrano quanto ogni mappa delle caratteristiche influenzi la predizione finale. Questo metodo evita la necessità del GAP e rende più facile vedere su cosa si concentra il modello senza riaddestrarlo. Grad-CAM++ fa un ulteriore passo avanti concentrandosi solo sulle influenze positive, rendendo i risultati ancora più chiari.

Fig. 3. Confronto tra CAM, Grad-CAM e Grad-CAM++.
Spiegazioni controfattuali#
Le spiegazioni controfattuali sono un elemento importante dell'intelligenza artificiale spiegabile. Una spiegazione controfattuale consiste nel descrivere una situazione o un risultato considerando scenari o eventi alternativi che non si sono verificati, ma avrebbero potuto verificarsi. Può dimostrare come i cambiamenti in specifiche variabili di input portino a risultati diversi, come in: “Se X non fosse accaduto, Y non si sarebbe verificato.”
Nel contesto dell'AI e della computer vision, una spiegazione controfattuale identifica il cambiamento minimo necessario in un input (come un'immagine o un dato) affinché un modello di AI produca un risultato diverso e specifico. Per esempio, modificare il colore di un oggetto in un'immagine potrebbe cambiare la predizione di un modello di classificazione delle immagini da "gatto" a "cane".
Un altro valido esempio consiste nel cambiare l'angolazione o l'illuminazione in un sistema di riconoscimento facciale. Ciò potrebbe indurre il modello a identificare un'altra persona, mostrando come piccoli cambiamenti nell'input possano influenzare le predizioni del modello.
Il modo più semplice per creare queste spiegazioni è procedere per tentativi: puoi modificare casualmente parti dell'input (come caratteristiche dell'immagine o dati) finché il modello di AI non fornisce il risultato desiderato. Altri metodi includono approcci indipendenti dal modello, che utilizzano tecniche di ottimizzazione e ricerca per trovare le modifiche, e approcci specifici del modello, che si basano su impostazioni interne o calcoli per identificare le modifiche necessarie.
Applicazioni dell'intelligenza artificiale spiegabile nella computer vision#
Ora che abbiamo esplorato cos'è la XAI e le sue tecniche principali, possiamo vedere come viene utilizzata nella vita reale. La XAI ha applicazioni diverse in numerosi settori. Esaminiamo alcuni casi d'uso che ne evidenziano il potenziale:
- Sistemi di sicurezza: la XAI può essere utilizzata per migliorare i sistemi di sicurezza rilevando immagini alterate nei documenti di identità, come passaporti e patenti di guida. Ciò garantisce l'autenticità delle immagini, rafforza i processi di verifica dell'identità e previene attività fraudolente nelle applicazioni sensibili.

Fig. 4. Come funziona la XAI per rilevare immagini alterate.
-
Guida autonoma: comprendere le capacità e i limiti del sistema di AI per la visione artificiale a bordo di un'auto a guida autonoma può essere una parte fondamentale dei test del veicolo prima della sua introduzione sulle strade reali. La XAI può aiutare le aziende automobilistiche a identificare e affrontare i problemi più chiaramente.
-
Sistemi giudiziari: i sistemi di analisi dei documenti dotati di visione artificiale vengono utilizzati sempre più spesso nel processo decisionale giudiziario. La XAI favorisce risultati equi e consente di esaminare attentamente le decisioni automatizzate. Aiuta inoltre i professionisti del settore legale a comprendere come un modello di AI giunga alle proprie decisioni.
-
Monitoraggio della fauna selvatica: le fototrappole vengono spesso utilizzate per monitorare la fauna selvatica e raccogliere dati sulle specie animali. La XAI può essere utilizzata per spiegare come l'AI classifichi queste specie nelle immagini. In questo modo, gli interventi di conservazione possono diventare più affidabili e accurati.
Punti chiave sull'intelligenza artificiale spiegabile#
L'intelligenza artificiale spiegabile facilita la comprensione del funzionamento dei sistemi di AI e del motivo per cui prendono determinate decisioni. La trasparenza sui modelli di AI crea fiducia e responsabilità. La conoscenza è potere e aiuta a utilizzare le innovazioni dell'AI in modo più responsabile. In ambiti critici come la sanità, la sicurezza, la guida autonoma e i sistemi giudiziari, la XAI può aiutare sviluppatori e utenti a comprendere le predizioni dell'AI, identificare gli errori e garantire un utilizzo equo ed etico. Rendendo l'AI più trasparente, la XAI colma il divario tra tecnologia e fiducia umana, rendendola più sicura e affidabile per le applicazioni nel mondo reale.
Per saperne di più, visita il nostro repository GitHub e partecipa alla nostra community. Scopri le applicazioni dell'AI nelle auto a guida autonoma e nell'agricoltura nelle nostre pagine dedicate alle soluzioni. 🚀









