Ultralytics YOLO27:
AI per la visione

Esplorare la computer vision nelle applicazioni di navigazione

Scopri come la computer vision nelle soluzioni di navigazione migliori la mappatura in tempo reale, il riconoscimento degli oggetti e la realtà aumentata per esperienze di viaggio più intelligenti e sicure.

ABAbirami Vina11 min read
Computer vision nelle applicazioni di navigazione

Oggi, prendere il telefono, digitare una destinazione e seguire indicazioni passo passo per arrivare a destinazione sembra semplicissimo. È qualcosa che richiede solo pochi secondi. Ma questa comodità quotidiana è il risultato di anni di progresso tecnologico. La navigazione ha fatto molta strada, dalle mappe cartacee e dalle bussole ai sistemi intelligenti in grado di comprendere e rispondere al mondo in tempo reale.

Una delle tecnologie alla base di questo cambiamento è la computer vision, un ramo dell'intelligenza artificiale (AI) che consente alle macchine di interpretare le informazioni visive come fanno gli esseri umani. Gli strumenti di navigazione all'avanguardia utilizzano ora immagini in tempo reale provenienti da satelliti, dashcam e sensori a livello stradale per migliorare la precisione delle mappe, monitorare le condizioni stradali e guidare gli utenti attraverso ambienti complessi.

In questo articolo esploreremo come la computer vision stia potenziando la navigazione migliorando le mappe GPS, offrendo aggiornamenti sul traffico in tempo reale e supportando tecnologie come la navigazione in realtà aumentata e i veicoli autonomi.

Sistemi di navigazione AI con mappatura 3D immersiva#

Utilizzare strumenti come Google Maps per orientarsi nella vita quotidiana è diventato molto comune, sia che tu debba attraversare la città sia che stia cercando un bar nelle vicinanze. Con la diffusione delle tecnologie AI, assistiamo a funzionalità sempre più avanzate come Immersive View, introdotta nel 2023 da Google Maps, che consente agli utenti di visualizzare in anteprima parti del proprio percorso in un ambiente 3D. Tutto ciò è possibile grazie alla combinazione di AI, fotogrammetria e computer vision.

Google Maps’ Immersive View

Fig 1. Immersive View di Google Maps.

Tutto inizia con miliardi di immagini ad alta risoluzione acquisite da una vasta gamma di apparecchiature specializzate. Tra queste ci sono le auto di Street View, veicoli dotati di telecamere a 360 gradi che percorrono le città, e i dispositivi Trekker, zaini indossabili con telecamere montate, utilizzati per acquisire immagini in luoghi che i veicoli non possono raggiungere, come sentieri escursionistici o vicoli stretti.

Queste immagini vengono allineate ai dati cartografici tramite la fotogrammetria, una tecnica che unisce foto 2D scattate da angolazioni diverse per creare modelli 3D accurati di strade, edifici e terreni.

La computer vision viene quindi utilizzata per analizzare questi modelli tramite il rilevamento degli oggetti e la segmentazione delle immagini, così da identificare ed etichettare elementi importanti come segnali stradali, marciapiedi, attraversamenti pedonali e ingressi degli edifici.

Immersive View using segmentation to segment objects on a street

Fig 2. Immersive View utilizza la segmentazione per segmentare gli oggetti presenti su una strada.

I dati etichettati vengono utilizzati per addestrare sistemi AI in grado di riconoscere come gli indizi visivi cambino da una regione all'altra. Ad esempio, il sistema può distinguere facilmente tra un segnale “SLOW” negli Stati Uniti, che in genere è un rombo giallo o arancione, e un segnale simile in Giappone, che solitamente è un triangolo rosso e bianco. Questo livello di comprensione rende l'esperienza di navigazione più accurata e consapevole delle differenze culturali.

Infine, Immersive View sovrappone i percorsi di navigazione in tempo reale all'ambiente 3D, offrendo un'esperienza fluida e intuitiva che mostra esattamente verso quale direzione ti stai dirigendo.

La realtà aumentata nelle soluzioni di navigazione#

Probabilmente è capitato a tutti di girare su se stessi cercando di capire in quale direzione ci stesse indicando Google Maps. È proprio questo il problema che la navigazione in realtà aumentata (AR), una tecnologia che sovrappone informazioni digitali alla visuale della fotocamera del mondo reale, mira a risolvere. Sta cambiando il modo in cui le persone si orientano in luoghi affollati come le strade cittadine o le grandi aree al chiuso.

Le mappe tradizionali possono essere difficili da seguire, soprattutto quando i segnali GPS sono deboli o non funzionano bene. La navigazione AR affronta questo problema mostrando indicazioni digitali, frecce ed etichette direttamente sulla visuale live della fotocamera del mondo reale. In questo modo gli utenti vedono indicazioni coerenti con le strade e gli edifici circostanti, rendendo molto più semplice capire dove andare.

Come viene utilizzata la realtà aumentata nella navigazione#

La navigazione AR si basa su modelli di computer vision per comprendere l'ambiente attraverso la fotocamera di un dispositivo. Ciò comprende diverse attività, come la localizzazione delle immagini, che rileva elementi quali i bordi degli edifici o i segnali stradali e li confronta con una mappa archiviata. La localizzazione e mappatura simultanee (SLAM) creano una mappa dell'ambiente monitorando al contempo la posizione del dispositivo in tempo reale.

Ad esempio, l'aeroporto di Zurigo è stato il primo a implementare Live View di Google Maps per la navigazione al chiuso. I passeggeri possono utilizzare la fotocamera del telefono per vedere frecce e indicazioni sovrapposte all'ambiente reale, che li guidano attraverso i terminal fino ai gate, ai negozi e ai servizi. Questo migliora l'esperienza dei passeggeri rendendo più semplice la navigazione in spazi interni complessi.

Zurich Airport using computer vision and AR to guide passengers indoors

Fig 3. L'aeroporto di Zurigo utilizza la computer vision e l'AR per guidare i passeggeri al chiuso.

Migliorare la sicurezza stradale con i sistemi di navigazione AI#

Le strade cittadine diventano ogni giorno più trafficate. Con più auto sulla strada, marciapiedi affollati e attività costante, mantenere il traffico fluido e sicuro è una sfida sempre più grande. Per contribuire a gestire il caos, molte città si affidano all'AI e alla computer vision.

Le telecamere intelligenti e i sensori installati agli incroci e lungo le strade acquisiscono un flusso costante di dati visivi. Queste immagini vengono elaborate in tempo reale per rilevare incidenti, monitorare il flusso del traffico, individuare buche e rilevare comportamenti come il parcheggio illegale o condotte rischiose da parte dei pedoni.

Un esempio interessante è la Smart Airport Expressway di Hangzhou, in Cina. Questa autostrada di 20 chilometri, che collega il centro di Hangzhou all'aeroporto internazionale di Xiaoshan, è stata potenziata con telecamere ad alta risoluzione e radar a onde millimetriche. Questi dispositivi raccolgono continuamente dati video e dei sensori, che vengono poi analizzati utilizzando la computer vision.

Invece di limitarsi a registrare le immagini, il sistema interpreta ciò che accade sulla strada. Gli algoritmi di computer vision rilevano le collisioni tra veicoli, riconoscono le violazioni del codice stradale e identificano persino pedoni o movimenti insoliti vicino alle uscite dell'autostrada. Ciò consente alle autorità del traffico di rispondere agli incidenti nel giro di pochi secondi, senza dover essere fisicamente sul posto.

I dati confluiscono inoltre in un gemello digitale: un modello virtuale 3D e aggiornato in tempo reale dell'autostrada, che mostra le condizioni del traffico, i dettagli dei veicoli e la congestione emergente. Gli agenti del traffico monitorano questa interfaccia visiva per gestire il flusso, inviare avvisi intelligenti e rispondere agli incidenti in modo rapido e accurato.

Mobilità autonoma abilitata dalla computer vision nella navigazione#

Oggi la navigazione va ben oltre il semplice spostamento dal punto A al punto B. È ormai una componente fondamentale dei sistemi intelligenti che trasportano persone, gestiscono merci e prendono decisioni in tempo reale, sia su strada sia all'interno dei magazzini.

Al centro di molti di questi sistemi c'è la computer vision, che consente alle macchine di interpretare i dati visivi e rispondere istantaneamente all'ambiente circostante. Vediamo alcuni esempi per capire come questa tecnologia stia trasformando la navigazione in ambienti diversi.

Robot di magazzino che navigano con la computer vision#

I robot stanno diventando essenziali per il futuro della logistica, soprattutto nelle operazioni di magazzino su larga scala. Con la crescita della domanda dell'e-commerce, le aziende si affidano sempre più a macchine basate sulla computer vision per navigare in ambienti complessi, smistare gli articoli e gestire l'inventario con rapidità e precisione.

Prendiamo ad esempio i centri logistici di Amazon, dove oltre 750.000 robot lavorano insieme alle persone per mantenere efficienti le operazioni. Questi robot si affidano ampiamente alla computer vision per muoversi nei movimentati spazi dei magazzini, identificare gli articoli e prendere decisioni rapide e accurate.

Uno di questi sistemi è Sequoia, una piattaforma robotica progettata per velocizzare la gestione dell'inventario. Utilizza una computer vision avanzata per scansionare, contare e organizzare i prodotti in arrivo, contribuendo a semplificare i processi di stoccaggio e prelievo.

Analogamente, Vulcan, un braccio robotico, utilizza telecamere e analisi delle immagini per prelevare in sicurezza gli articoli dagli scaffali, regolando la presa in base alla forma e alla posizione di ciascun oggetto e riconoscendo persino quando è necessario l'intervento umano. Nel frattempo, Cardinal, un altro robot dotato di sistemi di visione, è specializzato nello smistamento: scansiona pile miste di pacchi e li colloca con precisione nei corretti carrelli per la spedizione.

Cardinal lifting up packages precisely from a pile

Fig 4. Cardinal solleva con precisione i pacchi da una pila.

La computer vision nella navigazione dei veicoli autonomi#

Finora abbiamo visto come la computer vision aiuti persone e robot a muoversi nei rispettivi ambienti. Ma è altrettanto fondamentale per i sistemi autonomi, come le auto a guida autonoma, la cui navigazione dipende interamente da ciò che il veicolo riesce a vedere e comprendere in tempo reale.

Un buon esempio è il sistema Tesla Vision. Tesla ha adottato un approccio alla guida autonoma basato esclusivamente sulle telecamere, eliminando radar e altri sensori a favore di una rete di telecamere che fornisce una visuale completa a 360 gradi dell'ambiente circostante l'auto. Queste telecamere inviano i dati visivi al computer Full Self-Driving (FSD), che utilizza reti neurali profonde per interpretare l'ambiente e prendere decisioni di guida in una frazione di secondo.

In base a ciò che vede, il sistema decide quando sterzare, accelerare, frenare o cambiare corsia, proprio come farebbe un conducente umano, ma interamente tramite input visivi. Tesla migliora continuamente questo sistema raccogliendo e apprendendo da enormi quantità di dati di guida del mondo reale provenienti dalla sua flotta.

Tesla using computer vision for autonomous navigation

Fig 5. Tesla utilizza la computer vision per una navigazione sicura e autonoma (Fonte: Tesla).

Vantaggi e svantaggi della computer vision nella navigazione#

Ecco alcuni dei principali vantaggi dell'utilizzo della computer vision nella navigazione, soprattutto nei sistemi in cui precisione, sicurezza e processo decisionale in tempo reale sono essenziali:

  • Riduce il consumo di carburante: aiutando i conducenti a evitare il traffico e i percorsi caratterizzati da continue fermate e ripartenze, la computer vision può ridurre il consumo complessivo di carburante e i tempi di viaggio, rendendo più efficienti gli spostamenti quotidiani.
  • Rileva l'usura stradale e i problemi infrastrutturali: le soluzioni basate sulla visione possono rilevare buche, segnaletica orizzontale sbiadita, segnali danneggiati e infrastrutture deteriorate, fornendo alle squadre di manutenzione dati affidabili e in tempo reale.
  • Si integra perfettamente con altri strumenti AI: la computer vision può essere combinata con assistenti vocali, modelli di previsione comportamentale o algoritmi di ottimizzazione dei percorsi per creare un'esperienza di navigazione altamente intelligente e personalizzata.

Sebbene la computer vision offra numerosi vantaggi alla navigazione, presenta anche alcune importanti limitazioni da considerare quando si implementano soluzioni di questo tipo. Ecco alcune sfide fondamentali da tenere a mente:

  • Mancanza di generalizzazione: i modelli addestrati in ambienti o scenari specifici spesso incontrano difficoltà quando vengono implementati in contesti nuovi o mutevoli senza un nuovo addestramento.
  • Limitazioni legate all'illuminazione: i sistemi di visione dipendono da una buona illuminazione e da condizioni meteorologiche limpide per funzionare correttamente. In presenza di nebbia, pioggia intensa o oscurità, le loro prestazioni diminuiscono se non vengono combinati con sensori come LiDAR o radar.
  • Rischi per la privacy: i sistemi di navigazione che utilizzano telecamere possono acquisire immagini di persone e proprietà private senza consenso. Ciò solleva problemi di privacy che devono essere affrontati con attenzione durante lo sviluppo e l'implementazione.

Punti chiave#

La computer vision sta reinventando la navigazione, rendendo le mappe più dinamiche, i sistemi del traffico più intelligenti e la mobilità più accessibile. Quelli che un tempo erano percorsi statici sono ora esperienze interattive in tempo reale, alimentate da anteprime 3D immersive, indicazioni guidate dall'AR e tecnologie di trasporto autonomo.

Con il progresso della tecnologia, è probabile che l'attenzione si sposti verso sistemi più inclusivi, adattivi e responsabili. I continui progressi dipenderanno dal miglioramento della precisione in ambienti diversi, dal mantenimento di prestazioni affidabili e dalla protezione della privacy degli utenti. Il futuro della computer vision nella navigazione risiede nella creazione di soluzioni non solo intelligenti, ma anche attente nella progettazione e nel loro impatto.

Unisciti alla nostra community in crescita! Esplora il nostro repository GitHub per saperne di più sull'AI e consulta le nostre opzioni di licenza per iniziare i tuoi progetti di AI per la visione. Ti interessano innovazioni come l'AI nel retail e la computer vision nell'agricoltura? Visita le nostre pagine dedicate alle soluzioni per scoprire di più!

Explore solutions

Visione artificiale per immagini aeree

Visione artificiale per immagini aeree

Traduci immagini di droni e aeree in informazioni in tempo reale per agricoltura, acquacoltura, monitoraggio ambientale, conservazione e analisi geospaziale con Ultralytics YOLO.
Scopri di più
Computer vision nel settore aerospaziale

Computer vision nel settore aerospaziale

Porta la visione artificiale al monitoraggio aereo con i modelli Ultralytics YOLO. Potenzia droni, flussi di lavoro aerospaziali, conservazione ambientale e industrie geospaziali con soluzioni di computer vision.
Scopri di più

Proteggi ogni sito con i modelli Ultralytics YOLO. La visione artificiale alimenta il monitoraggio del perimetro, il rilevamento delle minacce, il riconoscimento delle targhe e la sicurezza sul lavoro.
Scopri di più
Computer vision nella robotica

Computer vision nella robotica

Potenzia macchine più intelligenti con i modelli Ultralytics YOLO. La Vision AI nella robotica abilita la navigazione autonoma, la percezione, il tracciamento degli oggetti e il controllo in tempo reale.
Scopri di più
Computer vision nella logistica

Computer vision nella logistica

Semplifica la logistica con i modelli Ultralytics YOLO. La Vision AI abilita l'ispezione dei pacchi, lo smistamento, il tracciamento dei veicoli e il monitoraggio della sicurezza nei magazzini in tempo reale.
Scopri di più
Computer vision nel commercio al dettaglio

Computer vision nel commercio al dettaglio

Reinventa il commercio al dettaglio con i modelli Ultralytics YOLO. La Vision AI potenzia il tracciamento dell'inventario, il monitoraggio degli scaffali, la gestione delle code e analisi più intelligenti dei clienti.
Scopri di più
Computer vision nel settore sanitario

Computer vision nel settore sanitario

Crea soluzioni sanitarie con i modelli Ultralytics YOLO. La Vision AI nel settore sanitario abilita imaging medico più rapido, diagnosi più intelligenti e monitoraggio dei pazienti.
Scopri di più
Computer vision nella produzione

Computer vision nella produzione

Ottimizza la produzione con i modelli Ultralytics YOLO. La Vision AI supporta il controllo qualità, il rilevamento dei difetti, la conformità ai DPI e l'automazione delle linee di assemblaggio.
Scopri di più
Computer vision nel settore automobilistico

Computer vision nel settore automobilistico

Applica la computer vision al settore automobilistico con i modelli Ultralytics YOLO. La vision AI migliora la sicurezza stradale, i sistemi di assistenza alla guida e l'automazione dei veicoli per strade più intelligenti.
Scopri di più
Computer vision in agricoltura

Computer vision in agricoltura

Porta la vision AI nell'agricoltura intelligente con i modelli Ultralytics YOLO. Abilita il monitoraggio delle colture, il tracciamento del bestiame e l'agricoltura di precisione per raccolti più abbondanti e intelligenti.
Scopri di più
Visione artificiale per immagini aeree

Visione artificiale per immagini aeree

Traduci immagini di droni e aeree in informazioni in tempo reale per agricoltura, acquacoltura, monitoraggio ambientale, conservazione e analisi geospaziale con Ultralytics YOLO.
Scopri di più
Computer vision nel settore aerospaziale

Computer vision nel settore aerospaziale

Porta la visione artificiale al monitoraggio aereo con i modelli Ultralytics YOLO. Potenzia droni, flussi di lavoro aerospaziali, conservazione ambientale e industrie geospaziali con soluzioni di computer vision.
Scopri di più

Proteggi ogni sito con i modelli Ultralytics YOLO. La visione artificiale alimenta il monitoraggio del perimetro, il rilevamento delle minacce, il riconoscimento delle targhe e la sicurezza sul lavoro.
Scopri di più
Computer vision nella robotica

Computer vision nella robotica

Potenzia macchine più intelligenti con i modelli Ultralytics YOLO. La Vision AI nella robotica abilita la navigazione autonoma, la percezione, il tracciamento degli oggetti e il controllo in tempo reale.
Scopri di più
Computer vision nella logistica

Computer vision nella logistica

Semplifica la logistica con i modelli Ultralytics YOLO. La Vision AI abilita l'ispezione dei pacchi, lo smistamento, il tracciamento dei veicoli e il monitoraggio della sicurezza nei magazzini in tempo reale.
Scopri di più
Computer vision nel commercio al dettaglio

Computer vision nel commercio al dettaglio

Reinventa il commercio al dettaglio con i modelli Ultralytics YOLO. La Vision AI potenzia il tracciamento dell'inventario, il monitoraggio degli scaffali, la gestione delle code e analisi più intelligenti dei clienti.
Scopri di più
Computer vision nel settore sanitario

Computer vision nel settore sanitario

Crea soluzioni sanitarie con i modelli Ultralytics YOLO. La Vision AI nel settore sanitario abilita imaging medico più rapido, diagnosi più intelligenti e monitoraggio dei pazienti.
Scopri di più
Computer vision nella produzione

Computer vision nella produzione

Ottimizza la produzione con i modelli Ultralytics YOLO. La Vision AI supporta il controllo qualità, il rilevamento dei difetti, la conformità ai DPI e l'automazione delle linee di assemblaggio.
Scopri di più
Computer vision nel settore automobilistico

Computer vision nel settore automobilistico

Applica la computer vision al settore automobilistico con i modelli Ultralytics YOLO. La vision AI migliora la sicurezza stradale, i sistemi di assistenza alla guida e l'automazione dei veicoli per strade più intelligenti.
Scopri di più
Computer vision in agricoltura

Computer vision in agricoltura

Porta la vision AI nell'agricoltura intelligente con i modelli Ultralytics YOLO. Abilita il monitoraggio delle colture, il tracciamento del bestiame e l'agricoltura di precisione per raccolti più abbondanti e intelligenti.
Scopri di più
Visione artificiale per immagini aeree

Visione artificiale per immagini aeree

Traduci immagini di droni e aeree in informazioni in tempo reale per agricoltura, acquacoltura, monitoraggio ambientale, conservazione e analisi geospaziale con Ultralytics YOLO.
Scopri di più
Computer vision nel settore aerospaziale

Computer vision nel settore aerospaziale

Porta la visione artificiale al monitoraggio aereo con i modelli Ultralytics YOLO. Potenzia droni, flussi di lavoro aerospaziali, conservazione ambientale e industrie geospaziali con soluzioni di computer vision.
Scopri di più

Proteggi ogni sito con i modelli Ultralytics YOLO. La visione artificiale alimenta il monitoraggio del perimetro, il rilevamento delle minacce, il riconoscimento delle targhe e la sicurezza sul lavoro.
Scopri di più
Computer vision nella robotica

Computer vision nella robotica

Potenzia macchine più intelligenti con i modelli Ultralytics YOLO. La Vision AI nella robotica abilita la navigazione autonoma, la percezione, il tracciamento degli oggetti e il controllo in tempo reale.
Scopri di più
Computer vision nella logistica

Computer vision nella logistica

Semplifica la logistica con i modelli Ultralytics YOLO. La Vision AI abilita l'ispezione dei pacchi, lo smistamento, il tracciamento dei veicoli e il monitoraggio della sicurezza nei magazzini in tempo reale.
Scopri di più
Computer vision nel commercio al dettaglio

Computer vision nel commercio al dettaglio

Reinventa il commercio al dettaglio con i modelli Ultralytics YOLO. La Vision AI potenzia il tracciamento dell'inventario, il monitoraggio degli scaffali, la gestione delle code e analisi più intelligenti dei clienti.
Scopri di più
Computer vision nel settore sanitario

Computer vision nel settore sanitario

Crea soluzioni sanitarie con i modelli Ultralytics YOLO. La Vision AI nel settore sanitario abilita imaging medico più rapido, diagnosi più intelligenti e monitoraggio dei pazienti.
Scopri di più
Computer vision nella produzione

Computer vision nella produzione

Ottimizza la produzione con i modelli Ultralytics YOLO. La Vision AI supporta il controllo qualità, il rilevamento dei difetti, la conformità ai DPI e l'automazione delle linee di assemblaggio.
Scopri di più
Computer vision nel settore automobilistico

Computer vision nel settore automobilistico

Applica la computer vision al settore automobilistico con i modelli Ultralytics YOLO. La vision AI migliora la sicurezza stradale, i sistemi di assistenza alla guida e l'automazione dei veicoli per strade più intelligenti.
Scopri di più
Computer vision in agricoltura

Computer vision in agricoltura

Porta la vision AI nell'agricoltura intelligente con i modelli Ultralytics YOLO. Abilita il monitoraggio delle colture, il tracciamento del bestiame e l'agricoltura di precisione per raccolti più abbondanti e intelligenti.
Scopri di più

Costruiamo insieme il futuro dell'AI!

Inizia il tuo percorso verso il futuro del machine learning