YOLO Vision 2026:
Torna al glossario Ultralytics

Linear Attention

Scopri come la linear attention ottimizza i modelli di deep learning riducendo la complessità dei Transformer a O(N). Impara come scala l'efficienza per le applicazioni AI.

L'attenzione lineare è una tecnica di ottimizzazione fondamentale progettata per migliorare drasticamente l'efficienza computazionale dei moderni modelli di deep learning (DL). Nelle tradizionali architetture Transformer, i meccanismi di attenzione standard elaborano le sequenze confrontando ogni singolo token con tutti gli altri. Questo crea un grave collo di bottiglia computazionale e di memoria noto come complessità temporale quadratica, o O(N quadrato), dove N è la lunghezza della sequenza. L'attenzione lineare modifica questa operazione matematica sottostante in modo che cresca in modo lineare, ovvero O(N). Questa svolta consente ai modelli di intelligenza artificiale (IA) di elaborare enormi set di dati, come interi libri o immagini gigapixel, senza esaurire la memoria dell'hardware.

Come funziona la Linear Attention#

Nell'attenzione standard, le reti neurali elaborano tre vettori principali: Query (Q), Chiavi (K) e Valori (V). La formula classica calcola la similitudine tra tutte le Query e le Chiavi utilizzando una funzione softmax, generando un'enorme matrice N x N prima di moltiplicarla per i Valori.

L'attenzione lineare evita la generazione di questa massiccia matrice intermedia. Invece, si basa sulla proprietà associativa della moltiplicazione di matrici. Scartando o approssimando il livello softmax tramite funzioni di kernel specializzate, il modello raggruppa la moltiplicazione in modo diverso. Moltiplica prima le Chiavi e i Valori insieme per creare una matrice di contesto di dimensioni fisse, e poi moltiplica le Query per questa nuova matrice compressa. Questo semplice riordinamento riduce significativamente la complessità computazionale, liberando hardware come una GPU (Graphics Processing Unit) per gestire input molto più lunghi in modo nativo.

Sviluppi recenti e DeltaNet#

La comunità di ricerca sull'IA, guidata da istituzioni come la Stanford University e giganti tecnologici come Google DeepMind, innova continuamente sulle formulazioni lineari per aumentare la precisione. Nel 2024 e nel 2025, i ricercatori hanno introdotto DeltaNet, una nuova architettura che sostituisce i normali aggiornamenti additivi nei transformer lineari con una "Regola Delta". Ciò consente alla rete di aggiornare la sua memoria interna rispetto a ciò che è già memorizzato, anziché calcolare valori assoluti da zero.

Successivi progressi, come le architetture Gated DeltaNet, introducono tassi di decadimento per canale, consentendo ai modelli di dimenticare selettivamente o mantenere caratteristiche chiave specifiche nel tempo. Queste innovazioni efficienti dal punto di vista hardware colmano il divario di prestazioni tra i transformer lineari e la tradizionale attenzione softmax, in particolare in complesse attività di recupero in-context.

Linear Attention rispetto ad altri meccanismi di attenzione#

Comprendere come questa tecnica differisca dai concetti correlati all'interno della più ampia famiglia del meccanismo di attenzione è fondamentale per gli ingegneri dell'IA che ottimizzano le proprie reti:

  • Self-Attention: Il meccanismo fondamentale che utilizza l'intera e costosa matrice softmax O(N quadrato) per catturare un contesto globale perfetto.
  • Flash Attention: Un'ottimizzazione consapevole dell'I/O che accelera la matematica esatta del self-Attention O(N quadrato) spostando in modo efficiente i dati tra i livelli di memoria della GPU. A differenza dell'attenzione lineare, Flash Attention non modifica la formula matematica sottostante.
  • Sparse Attention: Un metodo che fa risparmiare memoria costringendo la rete a guardare solo a una finestra localizzata di token vicini, mentre l'attenzione lineare comprime matematicamente l'intera vista globale in uno stato fisso.

Applicazioni nel mondo reale#

Superando la barriera della lunghezza della sequenza, la scalabilità lineare sblocca potenti funzionalità in molteplici domini AI:

Esempio di codice#

I framework moderni come PyTorch e TensorFlow rendono semplice l'implementazione di questi concetti matematici. Di seguito è riportato uno snippet concettuale di PyTorch che mostra come l'attenzione lineare cambi l'ordine della moltiplicazione di matrici per ottenere un'efficienza O(N).

import torch
import torch.nn as nn
import torch.nn.functional as F


class SimpleLinearAttention(nn.Module):
    def __init__(self, dim):
        super().__init__()
        self.qkv = nn.Linear(dim, dim * 3)

    def forward(self, x):
        # x shape: (Batch, Sequence Length, Channels)
        q, k, v = self.qkv(x).chunk(3, dim=-1)

        # Apply an activation function as a kernel approximation (replaces softmax)
        q = F.elu(q) + 1.0
        k = F.elu(k) + 1.0

        # Associative trick: Multiply Key and Value first (O(N) complexity)
        # k^T @ v yields a fixed (Batch, Channels, Channels) matrix
        kv_context = torch.matmul(k.transpose(-2, -1), v)

        # Multiply Query by the fixed context matrix to get the final output
        return torch.matmul(q, kv_context)


# Example: Processing a sequence of 1024 tokens
model = SimpleLinearAttention(dim=64)
dummy_input = torch.randn(1, 1024, 64)
output = model(dummy_input)
print(f"Output shape: {output.shape}")

Sebbene i modelli di comunità sperimentali possano incorporare vari livelli di attenzione lineare o sparsa, spesso possono soffrire di velocità CPU ridotte o instabilità di addestramento. Per distribuzioni di computer vision robuste e pronte per la produzione, Ultralytics YOLO26 è lo standard consigliato. Presenta un'architettura altamente ottimizzata e nativamente end-to-end che massimizza velocità e precisione per attività critiche come il rilevamento di oggetti senza fare affidamento su pesanti livelli di attenzione. Gli sviluppatori possono annotare dataset, eseguire l'addestramento, distribuire e monitorare questi modelli di alto livello senza problemi utilizzando la completa Ultralytics Platform.

Explore solutions

Real-time AI that works with your team

AI nella Robotica

Potenzia macchine più intelligenti con i modelli Ultralytics YOLO. La Vision AI nella robotica guida la navigazione autonoma, la percezione, il tracciamento degli oggetti e il controllo in tempo reale.
Scopri di più
Real-time AI that works with your team

IA nella logistica

Semplifica la logistica con i modelli Ultralytics YOLO. La Vision AI abilita l'ispezione dei pacchi, lo smistamento, il tracciamento dei veicoli e il monitoraggio della sicurezza in magazzino in tempo reale.
Scopri di più
Real-time AI that works with your team

AI nel settore Retail

Reimmagina il retail con i modelli Ultralytics YOLO. La Vision AI alimenta il tracciamento dell'inventario, il monitoraggio degli scaffali, la gestione delle code e insight più intelligenti sui clienti.
Scopri di più
Real-time AI that works with your team

IA nel settore sanitario

Crea soluzioni sanitarie con i modelli Ultralytics YOLO. La vision AI nella sanità potenzia l'imaging medico più rapido, diagnosi più intelligenti e il monitoraggio dei pazienti.
Scopri di più
Real-time AI that works with your team

IA nella produzione

Ottimizza la produzione con i modelli Ultralytics YOLO. La Vision AI guida il controllo qualità, il rilevamento dei difetti, la conformità ai DPI e l'automazione della linea di assemblaggio.
Scopri di più
Real-time AI that works with your operation

AI nel settore automobilistico

Applica la computer vision al settore automobilistico con i modelli Ultralytics YOLO. La vision AI migliora la sicurezza stradale, l'assistenza alla guida e l'automazione dei veicoli per strade più intelligenti.
Scopri di più
Real-time AI tailored to your operation

AI in Agricoltura

Porta la vision AI nell'agricoltura intelligente con i modelli Ultralytics YOLO. Potenzia il monitoraggio delle colture, il tracciamento del bestiame e l'agricoltura di precisione per rese più elevate e intelligenti.
Scopri di più
Real-time AI that works with your team

AI nella Robotica

Potenzia macchine più intelligenti con i modelli Ultralytics YOLO. La Vision AI nella robotica guida la navigazione autonoma, la percezione, il tracciamento degli oggetti e il controllo in tempo reale.
Scopri di più
Real-time AI that works with your team

IA nella logistica

Semplifica la logistica con i modelli Ultralytics YOLO. La Vision AI abilita l'ispezione dei pacchi, lo smistamento, il tracciamento dei veicoli e il monitoraggio della sicurezza in magazzino in tempo reale.
Scopri di più
Real-time AI that works with your team

AI nel settore Retail

Reimmagina il retail con i modelli Ultralytics YOLO. La Vision AI alimenta il tracciamento dell'inventario, il monitoraggio degli scaffali, la gestione delle code e insight più intelligenti sui clienti.
Scopri di più
Real-time AI that works with your team

IA nel settore sanitario

Crea soluzioni sanitarie con i modelli Ultralytics YOLO. La vision AI nella sanità potenzia l'imaging medico più rapido, diagnosi più intelligenti e il monitoraggio dei pazienti.
Scopri di più
Real-time AI that works with your team

IA nella produzione

Ottimizza la produzione con i modelli Ultralytics YOLO. La Vision AI guida il controllo qualità, il rilevamento dei difetti, la conformità ai DPI e l'automazione della linea di assemblaggio.
Scopri di più
Real-time AI that works with your operation

AI nel settore automobilistico

Applica la computer vision al settore automobilistico con i modelli Ultralytics YOLO. La vision AI migliora la sicurezza stradale, l'assistenza alla guida e l'automazione dei veicoli per strade più intelligenti.
Scopri di più
Real-time AI tailored to your operation

AI in Agricoltura

Porta la vision AI nell'agricoltura intelligente con i modelli Ultralytics YOLO. Potenzia il monitoraggio delle colture, il tracciamento del bestiame e l'agricoltura di precisione per rese più elevate e intelligenti.
Scopri di più
Real-time AI that works with your team

AI nella Robotica

Potenzia macchine più intelligenti con i modelli Ultralytics YOLO. La Vision AI nella robotica guida la navigazione autonoma, la percezione, il tracciamento degli oggetti e il controllo in tempo reale.
Scopri di più
Real-time AI that works with your team

IA nella logistica

Semplifica la logistica con i modelli Ultralytics YOLO. La Vision AI abilita l'ispezione dei pacchi, lo smistamento, il tracciamento dei veicoli e il monitoraggio della sicurezza in magazzino in tempo reale.
Scopri di più
Real-time AI that works with your team

AI nel settore Retail

Reimmagina il retail con i modelli Ultralytics YOLO. La Vision AI alimenta il tracciamento dell'inventario, il monitoraggio degli scaffali, la gestione delle code e insight più intelligenti sui clienti.
Scopri di più
Real-time AI that works with your team

IA nel settore sanitario

Crea soluzioni sanitarie con i modelli Ultralytics YOLO. La vision AI nella sanità potenzia l'imaging medico più rapido, diagnosi più intelligenti e il monitoraggio dei pazienti.
Scopri di più
Real-time AI that works with your team

IA nella produzione

Ottimizza la produzione con i modelli Ultralytics YOLO. La Vision AI guida il controllo qualità, il rilevamento dei difetti, la conformità ai DPI e l'automazione della linea di assemblaggio.
Scopri di più
Real-time AI that works with your operation

AI nel settore automobilistico

Applica la computer vision al settore automobilistico con i modelli Ultralytics YOLO. La vision AI migliora la sicurezza stradale, l'assistenza alla guida e l'automazione dei veicoli per strade più intelligenti.
Scopri di più
Real-time AI tailored to your operation

AI in Agricoltura

Porta la vision AI nell'agricoltura intelligente con i modelli Ultralytics YOLO. Potenzia il monitoraggio delle colture, il tracciamento del bestiame e l'agricoltura di precisione per rese più elevate e intelligenti.
Scopri di più

Costruiamo insieme il futuro dell'AI!

Inizia il tuo viaggio con il futuro del machine learning