Tutto quello che devi sapere sull'Explainable AI (XAI)
Scopri come l'Explainable AI (XAI) crea fiducia rendendo le previsioni dell'IA trasparenti e affidabili nell'assistenza sanitaria, nella sicurezza, nella guida autonoma e altro ancora.

Hai mai visto una risposta da uno strumento di intelligenza artificiale (IA) come ChatGPT e ti sei chiesto come sia arrivato a quella conclusione? Allora hai incontrato il problema della "scatola nera" dell'IA. È un termine che si riferisce alla mancanza di chiarezza su come i modelli di IA elaborano e analizzano i dati. Anche gli ingegneri e gli scienziati dell'IA che lavorano regolarmente con algoritmi di IA all'avanguardia possono trovare difficile comprendere appieno il loro funzionamento interno. Infatti, solo il 22% dei professionisti IT comprende veramente le capacità degli strumenti di IA.
L'incertezza su come i modelli di IA prendono decisioni può essere rischiosa, specialmente in aree critiche come la visione artificiale nella sanità e l'IA nella finanza. Tuttavia, si stanno facendo notevoli progressi per affrontare queste sfide e migliorare la trasparenza.
In particolare, l'IA spigabile (XAI) si concentra esclusivamente sulla risoluzione di questo problema. In parole semplici, è un insieme di processi e metodi che aiuta gli utenti umani a comprendere e affidarsi ai risultati o agli output forniti da complessi algoritmi di apprendimento automatico.
La XAI può aiutare gli sviluppatori a garantire che i sistemi di IA funzionino come previsto. Può anche aiutare le aziende di IA a soddisfare gli standard normativi. In questo articolo esploreremo l'intelligenza artificiale spiegabile e la sua vasta gamma di casi d'uso. Cominciamo!
L'importanza dell'intelligenza artificiale spiegabile#
La spiegabilità è fondamentale quando si lavora con l'IA. Questo è particolarmente vero quando si parla del sottocampo dell'IA, la visione artificiale, ampiamente utilizzata in applicazioni in settori come la sanità. Quando si utilizzano modelli di visione in settori così delicati, è importante che il funzionamento del modello sia trasparente e interpretabile per tutti.
L'interpretabilità nei modelli di visione artificiale aiuta gli utenti a comprendere meglio come è stata fatta una previsione e la logica alla base. La trasparenza contribuisce a rendere chiaro a tutti il funzionamento del modello, delineandone chiaramente i limiti e garantendo che i dati siano utilizzati in modo etico. Ad esempio, la visione artificiale può aiutare i radiologi a identificare in modo efficiente le complicazioni di salute nelle immagini a raggi X.

Fig 1. Radiografie toraciche analizzate tramite IA visiva che mostrano classificazioni di tubercolosi sana, malata, attiva e latente.
Tuttavia, un sistema di visione che sia semplicemente accurato non basta. Il sistema deve anche essere in grado di spiegare le sue decisioni. Supponiamo che il sistema possa mostrare quali parti dell'immagine hanno portato alle sue conclusioni: in questo modo, qualsiasi output sarebbe più chiaro. Un tale livello di trasparenza aiuterebbe i professionisti medici a ricontrollare i loro risultati e ad assicurarsi che la cura del paziente soddisfi gli standard medici.
Un altro motivo per cui la spiegabilità è essenziale è che rende le aziende di IA responsabili e crea fiducia negli utenti. Un'IA affidabile porta gli utenti a sentirsi sicuri del fatto che le innovazioni dell'IA funzionino in modo affidabile, prendano decisioni eque e gestiscano i dati in modo responsabile.
Tecniche chiave di intelligenza artificiale spiegabile nella visione artificiale#
Ora che abbiamo discusso del perché la spiegabilità è importante nella visione artificiale, diamo un'occhiata alle principali tecniche di XAI utilizzate nella visione artificiale.
Mappe di salienza#
Le reti neurali sono modelli ispirati al cervello umano, progettati per riconoscere pattern e prendere decisioni elaborando i dati attraverso strati interconnessi di nodi (neuroni). Possono essere utilizzate per risolvere problemi complessi di visione artificiale con elevata precisione. Anche con questa precisione, rimangono comunque scatole nere per progettazione.
Le mappe di salienza sono una tecnica di XAI che può essere utilizzata per aiutare a comprendere ciò che le reti neurali vedono quando analizzano le immagini. Possono anche essere utilizzate per risolvere problemi dei modelli nel caso in cui non stiano funzionando come previsto.
Le mappe di salienza funzionano concentrandosi su quali parti di un'immagine (pixel) definiscono le previsioni di un modello. Questo processo è molto simile alla retropropagazione, in cui il modello risale dalle previsioni all'input. Ma invece di aggiornare i pesi del modello in base agli errori, stiamo semplicemente guardando quanto ogni pixel "conta" per la previsione. Le mappe di salienza sono molto utili per attività di visione artificiale come la classificazione delle immagini.
Ad esempio, se un modello di classificazione delle immagini prevede che un'immagine raffiguri un cane, possiamo esaminare la sua mappa di salienza per capire perché il modello pensa che sia un cane. Questo ci aiuta a identificare quali pixel influenzano maggiormente l'output. La mappa di salienza evidenzierebbe tutti i pixel che hanno contribuito alla previsione finale dell'immagine come cane.

Fig 2. Una vista affiancata delle immagini di input e delle relative mappe di salienza.
Class Activation Mapping (CAM)#
La Class Activation Mapping è un'altra tecnica di XAI utilizzata per capire su quali parti di un'immagine si concentra una rete neurale quando effettua previsioni di classificazione delle immagini. Funziona in modo simile alle mappe di salienza, ma si concentra sull'identificazione di caratteristiche importanti nell'immagine anziché su specifici pixel. Le caratteristiche sono pattern o dettagli, come forme o texture, che il modello rileva nell'immagine.
Metodi come Gradient Weighted Class Activation Mapping (Grad-CAM) e Grad-CAM++ si basano sulla stessa idea, con alcuni miglioramenti.
Ecco come funziona CAM:
- Prima che la rete neurale prenda la sua decisione finale, utilizza un passaggio chiamato global average pooling (GAP) per semplificare le informazioni. GAP combina tutti i pixel in uno schema rilevato in un singolo valore medio, creando un riepilogo per ogni mappa di caratteristiche (una rappresentazione visiva degli schemi rilevati).
- A ogni mappa di caratteristiche viene quindi assegnato un peso che mostra quanto sia importante per prevedere una certa classe (come "uccello" o "gatto").
- Tuttavia, una limitazione di CAM è che potrebbe essere necessario riaddestrare il modello per calcolare questi pesi, il che può richiedere molto tempo.
Grad-CAM migliora questo aspetto utilizzando i gradienti, che sono come segnali che mostrano quanto ogni mappa delle caratteristiche influenzi la previsione finale. Questo metodo evita la necessità di GAP e rende più facile vedere su cosa si concentra il modello senza riaddestramento. Grad-CAM++ fa un ulteriore passo avanti concentrandosi solo sulle influenze positive, rendendo i risultati ancora più chiari.

Fig 3. Confronto tra CAM, Grad-CAM e Grad-CAM++.
Spiegazioni controfattuali#
Le spiegazioni controfattuali sono un elemento importante dell'intelligenza artificiale spiegabile. Una spiegazione controfattuale consiste nel descrivere una situazione o un risultato considerando scenari alternativi o eventi che non sono accaduti ma che avrebbero potuto accadere. Può dimostrare come i cambiamenti in specifiche variabili di input portino a risultati diversi, come: "Se X non fosse accaduto, Y non si sarebbe verificato".
Quando si parla di IA e visione artificiale, una spiegazione controfattuale identifica il minimo cambiamento richiesto in un input (come un'immagine o dei dati) per fare in modo che un modello di IA produca un risultato diverso e specifico. Ad esempio, alterare il colore di un oggetto in un'immagine potrebbe cambiare la previsione di un modello di classificazione di immagini da "gatto" a "cane".
Un altro buon esempio sarebbe cambiare l'angolazione o l'illuminazione in un sistema di riconoscimento facciale. Ciò potrebbe indurre il modello a identificare un individuo diverso, mostrando come piccoli cambiamenti nell'input possano influenzare le previsioni del modello.
Il modo più semplice per creare queste spiegazioni è per tentativi ed errori: puoi cambiare casualmente parti dell'input (come caratteristiche dell'immagine o dei dati) finché il modello di IA non ti fornisce il risultato desiderato. Altri metodi includono approcci agnostici rispetto al modello, che utilizzano tecniche di ottimizzazione e ricerca per trovare i cambiamenti, e approcci specifici per il modello, che si affidano a impostazioni interne o calcoli per identificare i cambiamenti necessari.
Applicazioni dell'intelligenza artificiale spiegabile nella visione artificiale#
Ora che abbiamo esplorato cos'è la XAI e le sue tecniche chiave, possiamo vedere come viene utilizzata nella vita reale. La XAI ha diverse applicazioni in molti campi. Immergiamoci in alcuni casi d'uso che ne evidenziano il potenziale:
- Sistemi di sicurezza: la XAI può essere utilizzata per migliorare i sistemi di sicurezza rilevando immagini manipolate in documenti di identificazione come passaporti e patenti di guida. Ciò garantisce l'autenticità delle immagini, rafforza i processi di verifica dell'identità e previene attività fraudolente in applicazioni sensibili.

Fig 4. Come funziona la XAI per rilevare immagini manipolate.
-
Guida autonoma: comprendere le capacità e i limiti del sistema di IA di visione di bordo di un'auto a guida autonoma può essere una parte fondamentale dei test dell'auto prima che venga distribuita sulle strade del mondo reale. La XAI può aiutare le aziende automobilistiche a identificare e risolvere i problemi in modo più chiaro.
-
Sistemi legali: i sistemi di analisi dei documenti abilitati alla visione vengono utilizzati sempre più spesso nel processo decisionale giudiziario. La XAI supporta risultati equi e consente di esaminare i giudizi automatizzati. Aiuta inoltre i professionisti legali a capire come un modello di IA arriva alle sue decisioni.
-
Monitoraggio della fauna selvatica: le fototrappole vengono spesso utilizzate per monitorare la fauna selvatica e raccogliere dati sulle specie animali. La XAI può essere utilizzata per spiegare come l'IA classifica queste specie nelle immagini. In questo modo, gli sforzi di conservazione possono essere più affidabili e accurati.
Punti chiave sull'intelligenza artificiale spiegabile#
L'intelligenza artificiale spiegabile rende più facile capire come funzionano i sistemi di IA e perché prendono determinate decisioni. La trasparenza sui modelli di IA crea fiducia e responsabilità. La conoscenza è potere e aiuta a utilizzare le innovazioni dell'IA in modo più responsabile. In settori critici come l'assistenza sanitaria, la sicurezza, la guida autonoma e i sistemi legali, la XAI può essere utilizzata per aiutare gli sviluppatori e gli utenti a comprendere le previsioni dell'IA, identificare gli errori e garantire un uso equo ed etico. Rendendo l'IA più trasparente, la XAI colma il divario tra tecnologia e fiducia umana, rendendola più sicura e affidabile per le applicazioni del mondo reale.
Per saperne di più, visita il nostro repository GitHub e interagisci con la nostra community. Esplora le applicazioni dell'IA nelle auto a guida autonoma e nell'agricoltura sulle nostre pagine delle soluzioni. 🚀






