YOLO Vision 2026:
Guias

O que é a EfficientNet? Uma visão geral rápida

Compreende a arquitetura EfficientNet e a sua magia de escala composta! Explora a EfficientNet B0-B7 para uma eficiência de topo em classificação e segmentação de imagem.

ABAbirami Vina6 min read
Uma visão geral da arquitetura EfficientNet

Em 2019, investigadores da Google AI introduziram o EfficientNet, um modelo de computer vision de última geração criado para reconhecer objetos e padrões em imagens. Foi concebido principalmente para a classificação de imagens, o que envolve atribuir uma imagem a uma de várias categorias pré-definidas. No entanto, hoje em dia, o EfficientNet também serve de base (backbone) para tarefas mais complexas, tais como a deteção de objetos, a segmentação e a aprendizagem por transferência (transfer learning).

Antes do EfficientNet, esses modelos de aprendizado de máquina e visão computacional tentavam melhorar a precisão adicionando mais camadas ou aumentando o tamanho dessas camadas. Camadas são as etapas em um modelo de rede neural (um tipo de modelo de aprendizado profundo inspirado no cérebro humano) que processam dados para aprender padrões e melhorar a precisão.

Essas mudanças criaram um compromisso (trade-off), tornando os modelos de IA tradicionais maiores e mais lentos, enquanto o ganho extra de precisão era frequentemente mínimo em comparação com o aumento significativo no poder computacional necessário.

O EfficientNet adotou uma abordagem diferente. Aumentou a profundidade (número de camadas), a largura (número de unidades em cada camada) e a resolução da imagem (o nível de detalhe das imagens de entrada) em conjunto de forma equilibrada. Este método, denominado escala composta (compound scaling), utiliza de forma fiável toda a capacidade de processamento disponível. O resultado final é um modelo mais pequeno e rápido que pode ter um desempenho superior ao de modelos mais antigos como o ResNet ou o DenseNet.

Atualmente, os modelos de visão computacional mais recentes, como o Ultralytics YOLO11, oferecem maior precisão, velocidade e eficiência. Ainda assim, o EfficientNet continua a ser um marco importante que influenciou o design de muitas arquiteturas avançadas.

Neste artigo, vamos analisar o EfficientNet em cinco minutos, cobrindo como ele funciona, o que o torna único e por que ele ainda é importante na visão computacional. Vamos começar!

O que é o EfficientNet?#

Antes de o EfficientNet ser projetado, a maioria dos modelos de reconhecimento de imagem melhorava a precisão ajustando suas camadas ou aumentando o tamanho da imagem de entrada para capturar mais detalhes. Embora essas estratégias melhorassem os resultados, elas também tornavam os modelos mais pesados e exigentes. Isso significava que eles precisavam de mais memória e de hardware melhor.

Em vez de alterar camadas individuais, o EfficientNet escala a profundidade, a largura e a resolução da imagem em conjunto usando um método chamado dimensionamento composto. Essa abordagem permite que o modelo cresça de forma eficiente sem sobrecarregar nenhum aspecto individual.

A arquitetura do EfficientNet processa imagens através de uma série de blocos, cada um construído a partir de módulos menores. O número de módulos em cada bloco depende do tamanho do modelo.

The building blocks of EfficientNet

Fig 1. Os blocos de construção do EfficientNet. (Source)

Versões menores usam menos módulos, enquanto versões maiores repetem módulos com mais frequência. Esse design flexível permite que o EfficientNet ofereça alta precisão e eficiência em uma ampla gama de aplicações, de dispositivos móveis a sistemas de grande escala.

Como o dimensionamento composto funciona#

O método de dimensionamento composto expande a profundidade, a largura e a resolução da imagem de um modelo, mas mantém tudo em equilíbrio. Isso torna possível usar o poder computacional de forma eficiente. A série começa com um modelo base menor chamado EfficientNet-B0, que serve como a base para todas as outras versões.

A partir do B0, os modelos aumentam para variantes maiores chamadas de EfficientNet-B1 a EfficientNet-B7. A cada passo, a rede ganha camadas adicionais, aumenta o número de canais (unidades usadas para processamento) e lida com imagens de entrada de maior resolução. A quantidade de crescimento em cada etapa é determinada por um parâmetro chamado coeficiente composto, que garante que profundidade, largura e resolução aumentem em proporções fixas, em vez de independentemente.

Compound scaling increases a model’s width, depth, and image resolution

Fig 2. A escala composta aumenta a largura, a profundidade e a resolução da imagem de um modelo. (Source)

Arquitetura do EfficientNet#

A seguir, vamos dar uma olhada na arquitetura do EfficientNet.

Ele se baseia no MobileNetV2, um modelo de visão computacional leve otimizado para dispositivos móveis e embarcados. Em seu núcleo está o bloco Mobile Inverted Bottleneck Convolution (MBConv), uma camada especial que processa dados de imagem como uma convolução padrão, mas com menos cálculos. Esse bloco torna o modelo rápido e mais eficiente em termos de memória.

Dentro de cada um dos blocos MBConv há um módulo squeeze-and-excitation (SE). Este módulo ajusta a força de diferentes canais na rede. Ele aumenta a força de canais essenciais e reduz a força de outros. O módulo ajuda a rede a se concentrar nas características mais importantes em uma imagem, ignorando o resto. O modelo EfficientNet também usa uma função de ativação Swish (uma função matemática que ajuda a rede a aprender padrões), que a ajuda a detectar padrões em imagens melhor do que métodos antigos.

Além disso, ele usa DropConnect, onde algumas conexões dentro da rede são desligadas aleatoriamente durante o treinamento. Este método de regularização estocástica (uma técnica de randomização para impedir que o modelo memorize os dados de treinamento em vez de generalizar) reduz o sobreajuste (overfitting) ao forçar a rede a aprender representações de características mais robustas (padrões mais fortes e gerais nos dados) que são melhor transferidas para dados inéditos.

Architecture of EfficientNet-B0

Fig 3. Arquitetura do EfficientNet-B0 (Source)

Uma breve visão geral das variantes de modelo do EfficientNet#

Agora que temos uma compreensão melhor de como os modelos EfficientNet funcionam, vamos discutir as diferentes variantes de modelos.

Os modelos EfficientNet escalam de B0 a B7, começando com o B0 como a base que equilibra velocidade e precisão. Cada versão aumenta a profundidade, a largura e a resolução da imagem, melhorando a precisão. No entanto, elas também exigem mais poder computacional, desde o B1 e B2 até o B6 e B7 de alto desempenho.

Enquanto os modelos EfficientNet-B3 e EfficientNet-B4 atingem um equilíbrio para imagens maiores, o B5 é frequentemente escolhido para conjuntos de dados complexos que exigem precisão. Além desses modelos, o modelo mais recente, EfficientNet V2, pode melhorar a velocidade de treinamento, lidar melhor com conjuntos de dados pequenos e está otimizado para hardware moderno.

Aplicações do EfficientNet#

O EfficientNet pode produzir resultados precisos usando menos memória e poder de processamento do que muitos outros modelos. Isso o torna útil em muitos campos, da pesquisa científica a produtos que as pessoas usam diariamente.

Análise de imagens médicas#

As imagens médicas, tais como as TACs dos pulmões, contêm frequentemente detalhes subtis que são fundamentais para um diagnóstico preciso. Os modelos de IA podem ajudar a analisar estas imagens para detetar padrões que possam ser difíceis de detetar pelos humanos. Uma adaptação do EfficientNet para este propósito é o MONAI (Medical Open Network for AI) EfficientNet, que foi especificamente concebido para a medical image analysis.

Com base na arquitetura do EfficientNet, os investigadores também desenvolveram o Lung-EffNet, um modelo que classifica TACs pulmonares para detetar tumores. Consegue categorizar os tumores como benignos, malignos ou normais, alcançando uma precisão reportada superior a 99% em ambientes experimentais.

Image classification of tumors using Lung-EffNet

Fig 4. Classificação de imagens de tumores utilizando o Lung-EffNet. (Source)

Detecção de objetos em tempo real#

A Object detection é o processo de encontrar objetos numa imagem e determinar as suas localizações. É uma parte fundamental de aplicações como sistemas de segurança, carros autónomos e drones.

O EfficientNet tornou-se importante nesta área porque oferecia uma forma muito eficiente de extrair caraterísticas de imagens. O seu método de dimensionamento da profundidade, largura e resolução mostrou como os modelos podiam ser precisos sem serem demasiado pesados ou lentos. É por isso que muitos sistemas de deteção, como o EfficientDet, utilizam o EfficientNet como a sua base.

Modelos mais novos, como o Ultralytics YOLO11, compartilham o mesmo objetivo de combinar velocidade com precisão. Essa tendência em direção a modelos eficientes foi fortemente influenciada por ideias de arquiteturas como o EfficientNet.

Prós e contras do EfficientNet#

Aqui estão alguns benefícios de usar o EfficientNet em projetos de visão computacional:

  • Alta precisão com menos parâmetros: O EfficientNet pode oferecer precisão semelhante ou melhor do que modelos antigos como ResNet ou DenseNet. No entanto, ele usa menos parâmetros, tornando-o mais rápido para treinar e mais fácil de implantar.
  • Família de modelos escaláveis: Indo de B0 a B7, você pode escolher uma versão que corresponda aos seus requisitos de hardware e precisão sem alterar a rede base.
  • Bom para aprendizagem por transferência: O EfficientNet pode proporcionar um desempenho de modelo fiável para a aprendizagem por transferência, que é o processo de re-treinar um modelo pré-treinado para uma tarefa personalizada. Pode funcionar como base para uma variedade de tarefas de visão computacional. Também tem mostrado resultados fortes quando é realizado o ajuste fino (fine-tuning). Por exemplo, alcançou uma precisão de última geração no CIFAR-100, um conjunto de dados de image classification amplamente utilizado, com significativamente menos parâmetros do que os modelos anteriores.

Embora existam muitos benefícios relacionados ao uso do EfficientNet, aqui estão algumas das limitações do EfficientNet que você deve ter em mente:

  • Requer mais memória: Versões como o EfficientNet-B6 e o EfficientNet-B7 exigem muita memória GPU.
  • Dimensionamento ajustado para o ImageNet: As definições de dimensionamento foram concebidas para o conjunto de dados ImageNet, pelo que o desempenho pode diminuir em conjuntos de dados muito diferentes sem um ajuste fino. Isto é especialmente verdade para conjuntos de dados pequenos, uma vez que a arquitetura e o dimensionamento do EfficientNet foram concebidos para um conjunto de dados grande e diversificado como o ImageNet, que fornece dados suficientes para justificar a sua profundidade e largura.
  • Mais lento em alguns hardwares: O EfficientNet usa camadas chamadas MBConv que são projetadas para eficiência em hardwares modernos. Em GPUs ou CPUs mais antigas, essas camadas podem ser executadas mais lentamente.

Principais pontos#

O EfficientNet mudou a forma como os modelos de visão computacional crescem ao manter a profundidade, a largura e a resolução da imagem em equilíbrio. Ele ainda é um modelo importante e influenciou arquiteturas mais novas também. Em particular, ele ocupa um lugar significativo na história da visão computacional.

Junta-te à nossa community e ao GitHub repository para explorar mais sobre IA. Consulta as nossas páginas de soluções para ler sobre AI in healthcare e computer vision in automotive. Descobre our licensing opções e começa a construir com visão computacional hoje mesmo!

Explore solutions

Real-time AI that works with your team

IA em robótica

Potencialize máquinas mais inteligentes com modelos Ultralytics YOLO. A IA de visão em robótica impulsiona a navegação autônoma, percepção, rastreamento de objetos e controle em tempo real.
Sabe mais
Real-time AI that works with your team

IA na Logística

Otimize a logística com modelos Ultralytics YOLO. A IA de visão permite a inspeção de pacotes, triagem, rastreamento de veículos e monitoramento de segurança em armazéns em tempo real.
Sabe mais
Real-time AI that works with your team

IA no varejo

Reinvente o varejo com modelos Ultralytics YOLO. A IA de visão impulsiona o rastreamento de inventário, monitoramento de prateleiras, gerenciamento de filas e percepções mais inteligentes sobre o cliente.
Sabe mais
Real-time AI that works with your team

IA na Saúde

Constrói soluções de saúde com modelos Ultralytics YOLO. A visão AI na saúde impulsiona imagens médicas mais rápidas, diagnósticos mais inteligentes e monitorização do paciente.
Sabe mais
Real-time AI that works with your team

IA na Fabricação

Otimize a fabricação com modelos Ultralytics YOLO. A IA de visão impulsiona o controle de qualidade, detecção de defeitos, conformidade com EPI e automação de linhas de montagem.
Sabe mais
Real-time AI that works with your operation

IA no Setor Automóvel

Aplica visão computacional no setor automóvel com modelos Ultralytics YOLO. A visão AI eleva a segurança rodoviária, a assistência ao condutor e a automação de veículos para estradas mais inteligentes.
Sabe mais
Real-time AI tailored to your operation

IA na Agricultura

Leva a visão AI para a agricultura inteligente com os modelos Ultralytics YOLO. Potencia a monitorização de culturas, o seguimento de gado e a agricultura de precisão para colheitas maiores e mais inteligentes.
Sabe mais
Real-time AI that works with your team

IA em robótica

Potencialize máquinas mais inteligentes com modelos Ultralytics YOLO. A IA de visão em robótica impulsiona a navegação autônoma, percepção, rastreamento de objetos e controle em tempo real.
Sabe mais
Real-time AI that works with your team

IA na Logística

Otimize a logística com modelos Ultralytics YOLO. A IA de visão permite a inspeção de pacotes, triagem, rastreamento de veículos e monitoramento de segurança em armazéns em tempo real.
Sabe mais
Real-time AI that works with your team

IA no varejo

Reinvente o varejo com modelos Ultralytics YOLO. A IA de visão impulsiona o rastreamento de inventário, monitoramento de prateleiras, gerenciamento de filas e percepções mais inteligentes sobre o cliente.
Sabe mais
Real-time AI that works with your team

IA na Saúde

Constrói soluções de saúde com modelos Ultralytics YOLO. A visão AI na saúde impulsiona imagens médicas mais rápidas, diagnósticos mais inteligentes e monitorização do paciente.
Sabe mais
Real-time AI that works with your team

IA na Fabricação

Otimize a fabricação com modelos Ultralytics YOLO. A IA de visão impulsiona o controle de qualidade, detecção de defeitos, conformidade com EPI e automação de linhas de montagem.
Sabe mais
Real-time AI that works with your operation

IA no Setor Automóvel

Aplica visão computacional no setor automóvel com modelos Ultralytics YOLO. A visão AI eleva a segurança rodoviária, a assistência ao condutor e a automação de veículos para estradas mais inteligentes.
Sabe mais
Real-time AI tailored to your operation

IA na Agricultura

Leva a visão AI para a agricultura inteligente com os modelos Ultralytics YOLO. Potencia a monitorização de culturas, o seguimento de gado e a agricultura de precisão para colheitas maiores e mais inteligentes.
Sabe mais
Real-time AI that works with your team

IA em robótica

Potencialize máquinas mais inteligentes com modelos Ultralytics YOLO. A IA de visão em robótica impulsiona a navegação autônoma, percepção, rastreamento de objetos e controle em tempo real.
Sabe mais
Real-time AI that works with your team

IA na Logística

Otimize a logística com modelos Ultralytics YOLO. A IA de visão permite a inspeção de pacotes, triagem, rastreamento de veículos e monitoramento de segurança em armazéns em tempo real.
Sabe mais
Real-time AI that works with your team

IA no varejo

Reinvente o varejo com modelos Ultralytics YOLO. A IA de visão impulsiona o rastreamento de inventário, monitoramento de prateleiras, gerenciamento de filas e percepções mais inteligentes sobre o cliente.
Sabe mais
Real-time AI that works with your team

IA na Saúde

Constrói soluções de saúde com modelos Ultralytics YOLO. A visão AI na saúde impulsiona imagens médicas mais rápidas, diagnósticos mais inteligentes e monitorização do paciente.
Sabe mais
Real-time AI that works with your team

IA na Fabricação

Otimize a fabricação com modelos Ultralytics YOLO. A IA de visão impulsiona o controle de qualidade, detecção de defeitos, conformidade com EPI e automação de linhas de montagem.
Sabe mais
Real-time AI that works with your operation

IA no Setor Automóvel

Aplica visão computacional no setor automóvel com modelos Ultralytics YOLO. A visão AI eleva a segurança rodoviária, a assistência ao condutor e a automação de veículos para estradas mais inteligentes.
Sabe mais
Real-time AI tailored to your operation

IA na Agricultura

Leva a visão AI para a agricultura inteligente com os modelos Ultralytics YOLO. Potencia a monitorização de culturas, o seguimento de gado e a agricultura de precisão para colheitas maiores e mais inteligentes.
Sabe mais

Vamos construir o futuro da IA juntos!

Começa a tua jornada com o futuro da aprendizagem automática