Comprendere il rilevamento dei bordi nell'elaborazione delle immagini
Rilevamento dei bordi nell'elaborazione delle immagini. Scopri gli algoritmi di rilevamento dei bordi Sobel, Canny e altri per rilevare con precisione i bordi e ottenere un riconoscimento robusto.

Come esseri umani, riconosciamo naturalmente i bordi degli oggetti, ne seguiamo le curve e notiamo le texture sulle loro superfici quando osserviamo un'immagine. Per un computer, invece, la comprensione inizia a livello dei singoli pixel.
Un pixel, la più piccola unità di un'immagine digitale, memorizza il colore e la luminosità in un singolo punto. Monitorando le variazioni nei valori dei pixel all'interno di un'immagine, un computer può rilevare pattern che rivelano dettagli fondamentali.
In particolare, l'elaborazione delle immagini utilizza i dati dei pixel per enfatizzare le caratteristiche essenziali e rimuovere gli elementi di disturbo. Una tecnica comune di elaborazione delle immagini è il rilevamento dei bordi, che identifica i punti in cui la luminosità o il colore cambiano bruscamente per delineare gli oggetti, segnare i confini e aggiungere struttura.
Questo consente ai computer di separare le forme, misurare le dimensioni e interpretare il modo in cui le parti di una scena sono connesse. Il rilevamento dei bordi è spesso il primo passaggio nell'analisi delle immagini avanzata.

Fig. 1. Esempio che mostra l'immagine originale affiancata agli output di diversi metodi di rilevamento dei bordi. (Fonte)
In questo articolo vedremo cos'è il rilevamento dei bordi, come funziona e quali sono le sue applicazioni nel mondo reale. Iniziamo!
Concetti del rilevamento dei bordi#
Il rilevamento dei bordi si concentra sull'individuazione dei punti di un'immagine in cui la luminosità o il colore cambiano sensibilmente da un punto a quello successivo. Se il cambiamento è ridotto, l'area appare uniforme. Se il cambiamento è brusco, spesso indica il confine tra due regioni diverse.
Ecco alcuni motivi per cui si verificano questi cambiamenti nei pixel:
- Discontinuità della normale alla superficie: quando due superfici si incontrano formando un angolo, come nel caso dello spigolo di una parete o del bordo di una scatola, questo brusco cambiamento di orientamento produce un confine evidente nell'immagine.
- Discontinuità di profondità: compaiono quando gli oggetti si trovano a distanze diverse dalla fotocamera, producendo una separazione visibile che aiuta il sistema a distinguerli.
- Cambiamenti nel colore o nella texture della superficie: si verificano quando un'area ha un colore o una texture diversi rispetto all'area adiacente, creando una separazione visibile.
- Cambiamenti di illuminazione: derivano da variazioni nell'illuminazione, comprese ombre o riflessi sulle superfici, e creano separazioni visibili anche quando le superfici sono lisce o continue.

Fig. 2. Diversi tipi di discontinuità dei bordi nelle immagini. (Fonte)
Come funziona il riconoscimento tramite rilevamento dei bordi#
Il rilevamento dei bordi inizia solitamente convertendo un'immagine a colori in un'immagine in scala di grigi, in modo che ogni punto mostri solo la luminosità. Questo facilita il lavoro dell'algoritmo, che può concentrarsi sulle differenze tra chiaro e scuro invece che sul colore.
Successivamente, filtri speciali possono analizzare l'immagine per trovare i punti in cui la luminosità cambia improvvisamente. Questi filtri calcolano quanto rapidamente varia la luminosità, un valore chiamato gradiente. Un gradiente più elevato è causato da una differenza maggiore tra punti vicini e spesso segnala un bordo.
L'algoritmo continua quindi a perfezionare l'immagine, rimuovendo i dettagli minori e conservando solo le linee e le forme più importanti. Il risultato è un contorno nitido e un'immagine di output utilizzabile per ulteriori analisi.
Evoluzione del rilevamento dei bordi e dell'elaborazione delle immagini#
Prima di analizzare più nel dettaglio il rilevamento dei bordi, vediamo come si è sviluppato nel tempo.
L'elaborazione delle immagini è iniziata con metodi semplici basati su regole, come il thresholding e il filtraggio, per ripulire e migliorare le immagini. Nell'era analogica, ciò significava lavorare con fotografie o pellicole utilizzando filtri ottici, ingranditori o trattamenti chimici per mettere in risalto i dettagli.
Tecniche come la regolazione del contrasto, la riduzione del rumore, la regolazione dell'intensità dell'immagine e il rilevamento dei bordi di base contribuivano a rendere più nitide le immagini in ingresso e a evidenziare forme e texture. Negli anni '60 e '70, il passaggio dall'elaborazione analogica a quella digitale ha aperto la strada all'analisi moderna in settori come l'astronomia, l'imaging medico e il monitoraggio satellitare.
Negli anni '80 e '90, computer più veloci resero possibili attività più complesse, come l'estrazione delle caratteristiche, il rilevamento delle forme e il riconoscimento di base degli oggetti. Algoritmi come l'operatore Sobel e Canny offrivano un rilevamento dei bordi più preciso, mentre il riconoscimento dei pattern trovava applicazioni in ambiti che andavano dall'automazione industriale alla lettura del testo stampato tramite il riconoscimento ottico dei caratteri.
Rilevamento dei bordi e visione artificiale nel XXI secolo#
Oggi, i continui progressi tecnologici hanno portato allo sviluppo della visione artificiale. L'IA per la visione, o visione artificiale, è un ramo dell'IA che si concentra sull'insegnamento alle macchine dell'interpretazione e della comprensione delle informazioni visive.
Mentre l'elaborazione tradizionale delle immagini, come il double thresholding (che rende le immagini più nitide conservando i bordi forti e rimuovendo quelli deboli) e il rilevamento dei bordi, seguiva regole fisse e poteva gestire solo attività specifiche, la visione artificiale utilizza modelli basati sui dati, capaci di apprendere dagli esempi e adattarsi a nuove situazioni.
Oggi, i sistemi di imaging vanno ben oltre il semplice miglioramento delle immagini o il rilevamento dei bordi. Possono riconoscere gli oggetti, monitorare i movimenti e comprendere il contesto di un'intera scena.
Una delle tecniche chiave che rendono tutto questo possibile è la convoluzione. Un'operazione di convoluzione è un processo in cui piccoli filtri (chiamati anche kernel) analizzano un'immagine per trovare pattern importanti come bordi, angoli e texture. Questi pattern diventano gli elementi costitutivi che i modelli di visione artificiale utilizzano per riconoscere e comprendere gli oggetti.
Per esempio, i modelli di visione artificiale come Ultralytics YOLO11 utilizzano queste caratteristiche basate sulla convoluzione per eseguire attività avanzate come la segmentazione delle istanze. Questo è strettamente collegato al rilevamento dei bordi, perché la segmentazione delle istanze richiede di delineare con precisione i confini di ogni oggetto in un'immagine.
Mentre il rilevamento dei bordi si concentra sull'individuazione dei cambiamenti di intensità nei pixel del bordo per contrassegnare i bordi degli oggetti, la segmentazione delle istanze sviluppa questa idea per rilevare i bordi, classificare e separare ogni oggetto nella propria regione.

Fig. 3. Uno sguardo all'uso di Ultralytics YOLO11 e della segmentazione delle istanze. (Fonte)
Algoritmi e approcci per il rilevamento dei bordi#
Nonostante la crescita della visione artificiale, l'elaborazione delle immagini è ancora una parte importante di molte applicazioni. Questo perché la visione artificiale si basa spesso su passaggi di preprocessing di base delle immagini.
Prima di rilevare gli oggetti o comprendere una scena, i sistemi ripuliscono solitamente l'immagine, riducono il rumore e individuano i bordi per mettere in risalto i dettagli fondamentali. Questi passaggi rendono i modelli avanzati più accurati ed efficienti.
Vediamo ora alcuni degli algoritmi di elaborazione delle immagini più comuni utilizzati per rilevare i bordi e il loro funzionamento.
Rilevamento dei bordi con Sobel#
Il rilevamento dei bordi con Sobel è un metodo fondamentale per individuare i contorni degli oggetti in un'immagine. Invece di analizzare subito ogni dettaglio, si concentra sulle aree in cui la luminosità cambia bruscamente da un pixel a quello adiacente.
Questi cambiamenti improvvisi indicano solitamente il punto in cui finisce un oggetto e ne inizia un altro, oppure il punto in cui un oggetto incontra lo sfondo. Isolando questi bordi, Sobel trasforma un'immagine complessa in un contorno più pulito, più facile da elaborare per altri sistemi in attività come il monitoraggio dei movimenti, il rilevamento delle forme o il riconoscimento degli oggetti.
Puoi considerare il rilevamento dei bordi con Sobel come un rilevatore di gradienti che misura come cambia l'intensità all'interno di un'immagine. Alla base, il funzionamento prevede un'operazione di convoluzione: piccole matrici, chiamate kernel, scorrono sull'immagine e calcolano somme pesate dei valori dei pixel vicini.
Questi kernel sono progettati per enfatizzare i cambiamenti di luminosità nelle direzioni orizzontale e verticale. A differenza dei modelli di deep learning, in cui i kernel vengono appresi dai dati, Sobel utilizza kernel fissi per evidenziare i bordi in modo efficiente senza richiedere addestramento.
Vediamo più da vicino come funziona il metodo di rilevamento dei bordi con Sobel:
- Uso di due filtri 3×3: questo metodo utilizza due piccole griglie 3×3, chiamate filtri. Puoi immaginarle come stencil che scorrono sull'immagine nelle direzioni orizzontale (direzione x) e verticale (direzione y). Una griglia è progettata per trovare i bordi orizzontali, l'altra quelli verticali.
- Calcolo del gradiente: ogni filtro individua la rapidità con cui cambia la luminosità e la direzione del gradiente. Un cambiamento ampio indica un possibile bordo.
- Combinazione dei risultati: i risultati orizzontali e verticali vengono combinati per determinare la forza e la direzione complessive del bordo in ogni pixel.
- Rilevamento dei bordi: i pixel con un modulo del gradiente elevato vengono contrassegnati come bordi forti.
- Delineazione dei confini: questi bordi aiutano a definire le forme degli oggetti e a separare le diverse regioni dell'immagine.

Fig. 4. Il rilevamento dei bordi con Sobel può evidenziare i contorni principali di un'immagine in ingresso e produrre una mappa dei bordi. (Fonte)
Rilevamento dei bordi con Canny#
Il rilevamento dei bordi con Canny è un altro metodo diffuso per individuare i bordi in un'immagine. È noto per produrre contorni nitidi e precisi. A differenza delle tecniche di base per il rilevamento dei bordi, segue una serie di passaggi progettati con cura per filtrare il rumore, rendere più definiti i confini e concentrarsi sui bordi più importanti.
Ecco una breve panoramica del funzionamento di un rilevatore di bordi Canny:
- Smoothing dell'immagine: l'immagine viene prima sfocata con un filtro gaussiano, una tecnica di smoothing che riduce il rumore e i piccoli dettagli che potrebbero essere scambiati per bordi.
- Rilevamento dei cambiamenti di luminosità: l'algoritmo analizza quindi i cambiamenti bruschi nella luminosità, utilizzando il calcolo del gradiente per misurarne la forza e la direzione.
- Assottigliamento dei bordi: vengono conservati solo i punti più forti lungo ogni linea rilevata, mentre quelli più deboli vengono rimossi, producendo bordi netti e puliti.
- Classificazione dei bordi: ogni pixel viene etichettato come bordo forte, debole o assente, in base ai valori soglia del cambiamento di luminosità.
- Pulizia finale: vengono conservati i bordi deboli collegati a quelli forti; tutti gli altri vengono scartati, lasciando solo confini chiari e connessi.

Fig. 5. Immagine originale e relativo output dopo l'uso del rilevatore di bordi Canny. (Fonte)
Poiché offre risultati accurati filtrando al contempo il rumore, il rilevamento dei bordi con Canny è ampiamente utilizzato nei settori in cui la precisione è importante. Per esempio, viene impiegato in ambiti come l'imaging medico, la mappatura satellitare, la scansione di documenti e la visione robotica.
Rilevamento dei bordi basato sul gradiente rispetto a quello basato sul filtro gaussiano#
Finora abbiamo esaminato due esempi di rilevamento dei bordi: Sobel e Canny. Sebbene entrambi mirino a individuare i bordi, affrontano il problema in modo diverso.
I metodi basati sul gradiente (come Sobel, Prewitt e Scharr) rilevano i bordi cercando cambiamenti bruschi nella luminosità, noti come gradiente. Analizzano l'immagine e contrassegnano i punti in cui questo cambiamento è più forte. Questi metodi sono semplici, veloci e funzionano bene quando le immagini sono nitide. Tuttavia, sono sensibili al rumore: piccole variazioni di luminosità possono essere scambiate per bordi.
I metodi basati sul filtro gaussiano (come Canny o il Laplaciano del gaussiano) aggiungono un passaggio per gestire questo problema: sfocano prima l'immagine. Questo smoothing, spesso eseguito con un filtro gaussiano, riduce le piccole variazioni che potrebbero creare bordi falsi. Dopo lo smoothing, questi metodi continuano a cercare cambiamenti bruschi nella luminosità, ma producono risultati più puliti e accurati per immagini rumorose o di bassa qualità.

Fig. 6. Rilevamento dei bordi basato sul gradiente rispetto a quello basato sul filtro gaussiano. Immagine dell'autore.
Applicazioni del rilevamento dei bordi nel mondo reale#
Ora che comprendiamo meglio come funziona il rilevamento dei bordi, vediamo come viene applicato in situazioni reali.
Utilizzare il rilevamento dei bordi per identificare le crepe#
Ispezionare grandi strutture in calcestruzzo, come ponti e grattacieli, è spesso un'attività complessa e pericolosa. Queste strutture possono estendersi per lunghe distanze o raggiungere altezze considerevoli, rendendo le ispezioni tradizionali lente, costose e rischiose. In genere, queste ispezioni richiedono anche impalcature, accesso su fune, misurazioni manuali ravvicinate o fotografie.
Nel 2019 è stato studiato un approccio interessante, quando alcuni ricercatori hanno testato un metodo più sicuro e rapido che utilizzava droni dotati di fotocamere ad alta risoluzione per acquisire immagini dettagliate delle superfici in calcestruzzo. Queste immagini sono state poi elaborate con diverse tecniche di rilevamento dei bordi per identificare automaticamente le crepe.
Lo studio ha mostrato che questo metodo riduceva significativamente la necessità di accesso umano diretto alle aree pericolose e velocizzava le ispezioni. Tuttavia, la sua accuratezza dipendeva ancora da fattori come le condizioni di illuminazione, la nitidezza delle immagini e la stabilità del drone durante il funzionamento. In alcuni casi era ancora necessaria una revisione umana per eliminare i falsi positivi.
Applicare il rilevamento dei bordi nell'imaging medico#
Le radiografie e le risonanze magnetiche spesso contengono disturbi visivi noti come rumore, che possono rendere più difficile distinguere i dettagli fini. Questo rappresenta una sfida per i medici quando cercano di individuare i bordi di un tumore, tracciare il contorno di un organo o monitorare cambiamenti sottili nel tempo.
Un recente studio di imaging medico ha testato l'efficacia dei comuni metodi di rilevamento dei bordi, come Sobel, Canny, Prewitt e Laplaciano, nella gestione di immagini rumorose. I ricercatori hanno aggiunto diversi tipi e livelli di rumore alle immagini e verificato con quale accuratezza ciascun metodo riuscisse a delineare le caratteristiche importanti.
Canny ha generalmente prodotto i bordi più puliti, anche in presenza di molto rumore, ma non era il migliore in ogni situazione. Alcuni metodi funzionavano meglio con determinati pattern di rumore, quindi non esiste un'unica soluzione perfetta.

Fig. 7. Canny (d–f) fornisce bordi più nitidi di Sobel (g–i) all'aumentare del rumore. (Fonte)
Questo evidenzia l'importanza di tecnologie come la visione artificiale. Combinando algoritmi avanzati e modelli di IA per la visione, queste soluzioni possono andare oltre il semplice rilevamento dei bordi e offrire risultati più accurati e affidabili anche in condizioni difficili.
Vantaggi del rilevamento dei bordi#
Ecco alcuni vantaggi dell'utilizzo del rilevamento dei bordi e dell'elaborazione delle immagini:
- Migliore compressione dei dati: il rilevamento dei bordi consente di rappresentare le immagini utilizzando solo le caratteristiche fondamentali, riducendo le dimensioni dei file e mantenendo al contempo le informazioni essenziali. Questo rende più efficiente l'archiviazione e la trasmissione.
- Localizzazione più precisa degli oggetti: identificando accuratamente i confini degli oggetti, il rilevamento dei bordi migliora la capacità dei sistemi di localizzare e monitorare gli oggetti, a vantaggio di applicazioni come l'IA nella robotica per la visione e i veicoli autonomi.
- Rilevamento delle caratteristiche a più scale: le tecniche di rilevamento dei bordi possono analizzare le immagini a scale diverse, catturando sia i piccoli dettagli sia le forme più grandi. Questa flessibilità è utile in numerose attività, dall'analisi delle texture alla comprensione delle scene.
Limiti dell'utilizzo dell'elaborazione delle immagini per il rilevamento dei bordi#
Sebbene il rilevamento dei bordi nell'elaborazione delle immagini offra molti vantaggi, comporta anche alcune difficoltà. Ecco alcuni dei principali limiti da considerare:
- Problemi con le texture complesse: nelle immagini con pattern intricati o ripetitivi, il rilevamento dei bordi produce spesso numerosi bordi falsi o irrilevanti, complicando l'analisi successiva e riducendo l'affidabilità.
- Sensibilità all'illuminazione: le variazioni di luminosità, le ombre e i riflessi possono indurre i rilevatori di bordi a interpretare erroneamente i cambiamenti di illuminazione come confini degli oggetti, causando risultati incoerenti.
- Nessuna identificazione degli oggetti: sebbene i bordi evidenzino dove iniziano e finiscono gli oggetti, non mostrano cosa siano. È necessaria un'elaborazione aggiuntiva per attribuire un significato o un'etichetta ai bordi rilevati.
Quando utilizzare la visione artificiale per il rilevamento dei bordi#
Il rilevamento dei bordi trae ispirazione dal modo in cui occhi e cervello collaborano per dare senso al mondo. Per quanto riguarda la visione umana, i neuroni specializzati nella corteccia visiva sono altamente sensibili a bordi, linee e confini.
Questi segnali visivi ci aiutano a determinare rapidamente dove finisce un oggetto e ne inizia un altro. Ecco perché anche un semplice disegno al tratto può essere riconosciuto istantaneamente: il nostro cervello si affida molto ai bordi per identificare forme e oggetti.
La visione artificiale mira a imitare questa capacità, ma si spinge oltre. Modelli come Ultralytics YOLO11 vanno oltre la semplice evidenziazione dei bordi e il miglioramento delle immagini. Possono rilevare gli oggetti, delinearli con precisione e monitorare i movimenti in tempo reale. Questo livello più profondo di comprensione li rende essenziali negli scenari in cui il solo rilevamento dei bordi non è sufficiente.
Utilizzare Ultralytics YOLO11 per rilevare i bordi con maggiore accuratezza#
Ecco alcune attività chiave di visione artificiale supportate da Ultralytics YOLO11 che sviluppano e superano il rilevamento dei bordi:
- Rilevamento degli oggetti: identifica e localizza più oggetti in un'immagine o in un video tracciando riquadri di delimitazione attorno a ciascuno di essi, offrendo una visione chiara di cosa è presente e della posizione di ogni oggetto.
- Segmentazione delle istanze: consiste nel scomporre gli oggetti fino al livello dei pixel, producendo contorni nitidi e precisi anche quando gli oggetti si sovrappongono o hanno forme irregolari.
- Stima della posa: l'obiettivo è determinare la posizione, l'orientamento o la postura di un oggetto o di una persona, facilitando il monitoraggio dei movimenti o il rilevamento di cambiamenti strutturali nel tempo.
- Tracciamento degli oggetti: questa attività segue un oggetto mentre si muove attraverso i fotogrammi di un video, garantendone un'identificazione coerente per un'osservazione accurata a lungo termine.
- Classificazione delle immagini: assegna etichette agli oggetti o a intere immagini in base alle loro caratteristiche visive, semplificando l'organizzazione e l'interpretazione di grandi quantità di dati.
Rilevamento dei bordi nelle infrastrutture con la visione artificiale#
Un buon esempio di come la visione artificiale possa migliorare un'applicazione che tradizionalmente si basava sul rilevamento dei bordi è il rilevamento delle crepe nelle infrastrutture e nei beni industriali. I modelli di visione artificiale come Ultralytics YOLO11 possono essere addestrati per identificare con precisione le crepe su strade, ponti e condutture. La stessa tecnica può essere applicata anche alla manutenzione degli aeromobili, alle ispezioni degli edifici e al controllo qualità nella produzione, contribuendo ad accelerare le ispezioni e a migliorare la sicurezza.

Fig. 8. Un esempio dell'uso di YOLO11 per la segmentazione delle crepe. (Fonte)
Punti chiave#
Il rilevamento dei bordi ha fatto molta strada, dai primi metodi semplici alle tecniche avanzate in grado di individuare anche i contorni più sottili in immagini complesse. Aiuta a mettere in risalto i dettagli importanti, evidenziare le aree chiave e preparare le immagini per analisi più approfondite, diventando così una componente fondamentale dell'elaborazione delle immagini.
Nella visione artificiale, il rilevamento dei bordi svolge un ruolo importante nella definizione delle forme, nella separazione degli oggetti e nell'estrazione di informazioni utili. Viene utilizzato in molti ambiti, come l'imaging medico, le ispezioni industriali, la guida autonoma e la sicurezza, per fornire una comprensione visiva accurata e affidabile.
Unisciti alla nostra community ed esplora il nostro repository GitHub per scoprire di più sull'AI. Se vuoi avviare un tuo progetto di visione artificiale, dai un'occhiata alle nostre opzioni di licenza. Scopri di più su applicazioni come l'AI nel settore sanitario e la visione artificiale nel commercio al dettaglio visitando le nostre pagine dedicate alle soluzioni.









