Ultralytics YOLO27:
Guias

O guia definitivo para o aumento de dados em 2025

Descobre como o aumento de dados de imagem ajuda os modelos de IA de visão a aprender melhor, melhorar a precisão e ter um desempenho mais eficaz em situações do mundo real.

ABAbirami Vina13 min read
Aumento de dados de imagem a criar variações diversificadas para o treino de IA de visão

Devido ao boom da IA, fenómenos como robôs a trabalhar em fábricas e carros autónomos a circular pelas ruas aparecem cada vez mais nas notícias. A IA está a mudar a forma como as máquinas interagem com o mundo, desde a melhoria da imagiologia médica até ao apoio no controlo de qualidade em linhas de produção.

Grande parte deste progresso deve-se à visão computacional, um ramo da IA que permite às máquinas compreender e interpretar imagens. Tal como os humanos aprendem a reconhecer objetos e padrões ao longo do tempo, os modelos de IA para visão, como o Ultralytics YOLO11, precisam de ser treinados com grandes quantidades de dados de imagem para desenvolver a sua compreensão visual.

No entanto, recolher uma quantidade tão vasta de dados visuais nem sempre é fácil. Embora a comunidade de visão computacional tenha criado muitos datasets grandes, estes podem ainda não incluir determinadas variações, como imagens com objetos em condições de pouca luz, itens parcialmente ocultos ou elementos vistos de diferentes ângulos. Estas diferenças podem confundir os modelos de visão computacional treinados apenas em condições específicas.

O aumento de dados de imagem é uma técnica que resolve este problema ao introduzir novas variações nos dados existentes. Ao fazer alterações às imagens, como ajustar cores, rodar ou mudar a perspetiva, o dataset torna-se mais diversificado, ajudando os modelos de IA para visão a reconhecer melhor os objetos em situações do mundo real.

Neste artigo, vamos explorar como funciona o aumento de dados de imagem e o impacto que pode ter nas aplicações de visão computacional.

O que é o aumento de dados de imagem?#

Imagina que estás a tentar reconhecer um amigo no meio de uma multidão, mas ele está a usar óculos de sol ou está numa zona com sombra. Mesmo com estas pequenas alterações na aparência, continuas a saber quem ele é. Por outro lado, um modelo de IA para visão pode ter dificuldade com estas variações, a menos que tenha sido treinado para reconhecer objetos em diferentes contextos.

O aumento de dados de imagem melhora o desempenho dos modelos de visão computacional ao adicionar versões modificadas de imagens existentes aos dados de treino, em vez de recolher milhares de imagens novas.

Alterações às imagens, como inverter, rodar, ajustar o brilho ou adicionar pequenas distorções, expõem os modelos de IA para visão a uma gama mais ampla de condições. Em vez de dependerem de datasets enormes, os modelos podem aprender eficazmente com datasets de treino mais pequenos que contenham imagens aumentadas.

Exemplos de imagens aumentadas de um carro

Fig. 1. Exemplos de imagens aumentadas de um carro.

A importância do aumento de dados na visão computacional#

Eis algumas das principais razões pelas quais o aumento de dados é essencial para a visão computacional:

  • Reduz os requisitos de dados: Recolher grandes datasets de imagens exige tempo e recursos. O aumento de dados pode ser utilizado para treinar modelos eficazmente sem a necessidade de datasets enormes.
  • Previne o sobreajuste: Um modelo treinado com poucos exemplos pode memorizar detalhes em vez de reconhecer padrões gerais. Adicionar variedade através do aumento de dados garante que os modelos de IA para visão aprendem de uma forma aplicável a dados novos e não vistos.
  • Imita imagens imperfeitas: As imagens dos datasets são frequentemente demasiado perfeitas, mas as fotografias do mundo real podem estar desfocadas, obstruídas ou distorcidas. Aumentar as imagens com ruído, oclusões ou outras variações torna-as mais realistas.
  • Aumenta a robustez dos modelos: Treinar com uma variedade de imagens ajuda a IA a lidar com alterações do mundo real, tornando-a mais fiável em diferentes ambientes, condições de iluminação e situações.

Quando deves utilizar o aumento de dados de imagem?#

O aumento de dados de imagem é particularmente útil quando um modelo de visão computacional precisa de reconhecer objetos em diferentes situações, mas não dispõe de imagens variadas suficientes.

Por exemplo, se investigadores estiverem a treinar um modelo de IA para visão para identificar espécies subaquáticas raras que são fotografadas muito poucas vezes, o dataset pode ser pequeno ou ter pouca variedade. Ao aumentar as imagens — ajustando as cores para simular diferentes profundidades da água, adicionando ruído para imitar condições de água turva ou alterando ligeiramente as formas para ter em conta o movimento natural — o modelo pode aprender a detetar objetos subaquáticos com maior precisão.

Eis outras situações em que o aumento de dados faz uma grande diferença:

  • Equilibrar o dataset: Alguns objetos podem aparecer com menos frequência nos dados de treino, tornando os modelos de IA para visão tendenciosos. O aumento de dados ajuda a criar mais exemplos de objetos raros para que o modelo reconheça todas as categorias de forma justa.
  • Adaptar-se a diferentes câmaras: As imagens podem ter um aspeto diferente consoante o dispositivo. O aumento de dados ajuda os modelos de IA para visão a obter bons resultados com fotografias de diferentes resoluções, condições de iluminação e qualidade.
  • Corrigir pequenos erros de anotação: Pequenas translações, recortes ou rotações ajudam os modelos de visão computacional a reconhecer corretamente os objetos, mesmo quando as anotações originais não estão perfeitamente alinhadas.

Como funciona o aumento de dados de imagem#

Nos primórdios da visão computacional, o aumento de dados de imagem envolvia principalmente técnicas básicas de processamento de imagem, como inverter, rodar e recortar, para aumentar a diversidade do dataset. À medida que a IA evoluiu, foram introduzidos métodos mais avançados, como ajustar cores (transformações do espaço de cor), tornar as imagens mais nítidas ou desfocá-las (filtros de kernel) e combinar várias imagens (mistura de imagens) para melhorar a aprendizagem.

O aumento de dados pode ocorrer antes e durante o treino do modelo. Antes do treino, podem ser adicionadas imagens modificadas ao dataset para proporcionar mais variedade. Durante o treino, as imagens podem ser alteradas aleatoriamente em tempo real, ajudando os modelos de IA para visão a adaptarem-se a diferentes condições.

Estas alterações são efetuadas através de transformações matemáticas. Por exemplo, a rotação inclina uma imagem, o recorte remove partes para imitar diferentes perspetivas e as alterações de brilho simulam variações de iluminação. O desfoque suaviza as imagens, a nitidez torna os detalhes mais claros e a mistura de imagens combina partes de imagens diferentes. Frameworks de IA para visão e ferramentas como OpenCV, TensorFlow e PyTorch podem automatizar estes processos, tornando o aumento de dados rápido e eficaz.

Principais técnicas de aumento de dados de imagem#

Agora que explicámos o que é o aumento de dados de imagem, vamos analisar mais detalhadamente algumas técnicas fundamentais de aumento de dados de imagem utilizadas para melhorar os dados de treino.

Ajuste da orientação e da posição#

Os modelos de visão computacional, como o YOLO11, precisam frequentemente de reconhecer objetos a partir de vários ângulos e pontos de vista. Para ajudar neste processo, as imagens podem ser invertidas horizontal ou verticalmente, para que o modelo de IA aprenda a reconhecer objetos a partir de diferentes pontos de vista.

Da mesma forma, rodar ligeiramente as imagens altera o seu ângulo, permitindo ao modelo identificar objetos a partir de várias perspetivas. Além disso, deslocar as imagens em diferentes direções (translação) ajuda os modelos a adaptarem-se a pequenas alterações de posição. Estas transformações garantem que os modelos generalizam melhor para condições do mundo real, nas quais a posição dos objetos numa imagem é imprevisível.

Diferentes métodos de aumento relacionados com a orientação e a posição

Fig. 2. Diferentes métodos de aumento relacionados com a orientação e a posição.

Redimensionamento e recorte#

No contexto de soluções de visão computacional do mundo real, os objetos nas imagens podem aparecer a distâncias e com tamanhos diferentes. Os modelos de IA para visão têm de ser suficientemente robustos para os detetar independentemente dessas diferenças.

Para melhorar a adaptabilidade, podem ser utilizados os seguintes métodos de aumento de dados:

  • Escalonamento: O redimensionamento altera o tamanho da imagem, mantendo as suas proporções, permitindo aos modelos de IA detetar objetos a diferentes distâncias.
  • Recorte: Remove partes desnecessárias de uma imagem, ajudando o modelo a concentrar-se nas áreas principais e reduzindo as distrações do fundo.
  • Cisalhamento: Inclinar ligeiramente uma imagem simula uma aparência inclinada ou esticada, ajudando a IA a reconhecer objetos a partir de diferentes ângulos.

Estes ajustes ajudam os modelos de visão computacional a reconhecer objetos mesmo quando o seu tamanho ou forma sofre pequenas alterações.

Ajustes de perspetiva e distorção#

Os objetos nas imagens podem ter um aspeto diferente consoante o ângulo da câmara, dificultando o seu reconhecimento pelos modelos de visão computacional. Para ajudar os modelos a lidar com estas variações, as técnicas de aumento de dados podem ajustar a forma como os objetos são apresentados nas imagens.

Por exemplo, as transformações de perspetiva podem alterar o ângulo de visão, fazendo com que um objeto pareça ser visto de uma posição diferente. Isto permite aos modelos de IA para visão reconhecer objetos mesmo quando estão inclinados ou foram captados a partir de um ponto de vista invulgar.

Outro exemplo é uma transformação elástica, que estica, dobra ou deforma as imagens para simular distorções naturais, fazendo com que os objetos tenham o aspeto que teriam em reflexos ou sob pressão.

Modificações de cor e iluminação#

As condições de iluminação e as diferenças de cor podem ter um impacto significativo na forma como os modelos de IA para visão interpretam as imagens. Como os objetos podem ter um aspeto diferente sob várias condições de iluminação, as seguintes técnicas de aumento de dados podem ajudar a lidar com estas situações:

  • Ajustes de brilho e contraste: Simular diferentes condições de iluminação ajuda os modelos de IA para visão a reconhecer objetos em ambientes claros e escuros.
  • Variação de cor: Alterar aleatoriamente a tonalidade, a saturação e o equilíbrio de cores torna os modelos de visão computacional mais adaptáveis a diferentes câmaras e condições de iluminação.
  • Conversão para escala de cinzentos: Converter as imagens para preto e branco incentiva os modelos de IA para visão a concentrarem-se nas formas e texturas, em vez da cor.

Exemplos de aumentos relacionados com variações de cor

Fig. 3. Exemplos de aumentos relacionados com variações de cor.

Técnicas avançadas de aumento de dados de imagem#

Até agora, explorámos apenas técnicas de aumento que modificam uma única imagem. No entanto, alguns métodos avançados envolvem a combinação de várias imagens para melhorar a aprendizagem da IA.

Por exemplo, o MixUp combina duas imagens, ajudando os modelos de visão computacional a compreender as relações entre objetos e melhorando a sua capacidade de generalizar em diferentes cenários. O CutMix vai mais longe ao substituir uma secção de uma imagem por uma parte de outra, permitindo aos modelos aprender com vários contextos dentro da mesma imagem. Entretanto, o CutOut funciona de forma diferente, removendo partes aleatórias de uma imagem e treinando os modelos de IA para visão para reconhecer objetos mesmo quando estão parcialmente ocultos ou obstruídos.

Técnicas avançadas de aumento de dados de imagem, como MixUp, CutMix e CutOut

Fig. 4. Técnicas avançadas de aumento de dados de imagem.

O papel da IA generativa no aumento de dados de imagem#

A IA generativa está a ganhar força em muitos setores e aplicações do dia a dia. É provável que já te tenhas deparado com ela em imagens geradas por IA, vídeos deepfake ou aplicações que criam avatares realistas. Mas, para além da criatividade e do entretenimento, a IA generativa desempenha um papel crucial no treino de modelos de IA para visão ao gerar novas imagens a partir de imagens existentes.

Em vez de simplesmente inverter ou rodar fotografias, pode criar variações realistas, alterando expressões faciais, estilos de roupa ou até simulando diferentes condições meteorológicas. Estas variações ajudam os modelos de visão computacional a tornarem-se mais adaptáveis e precisos em diversos cenários do mundo real. Modelos avançados de IA generativa, como as redes generativas adversariais (GANs) e os modelos de difusão, também podem preencher detalhes em falta ou criar imagens sintéticas de alta qualidade.

Limitações do aumento de dados de imagem#

Embora o aumento de dados melhore os datasets de treino, também existem algumas limitações a considerar. Eis alguns dos principais desafios relacionados com o aumento de dados de imagem:

  • Diversidade limitada dos dados: As imagens aumentadas provêm de dados existentes e não conseguem introduzir padrões completamente novos ou perspetivas raras.
  • Potencial distorção dos dados: Transformações excessivas podem tornar as imagens irrealistas, reduzindo potencialmente a precisão do modelo em cenários do mundo real.
  • Aumento da computação: O aumento de dados em tempo real que ocorre durante o treino do modelo pode exigir bastante poder de processamento, tornando o treino mais lento e aumentando a utilização de memória.
  • O desequilíbrio entre classes mantém-se: O aumento de dados não cria amostras totalmente novas, pelo que as categorias sub-representadas podem continuar a originar uma aprendizagem tendenciosa.

Uma aplicação real do aumento de dados de imagem#

Uma aplicação interessante do aumento de dados de imagem encontra-se nos carros autónomos, nos quais são cruciais as decisões tomadas em frações de segundo pelos modelos de visão computacional, como o Ultralytics YOLO11. O modelo tem de conseguir detetar estradas, pessoas e outros objetos com precisão.

No entanto, as condições do mundo real encontradas por um veículo autónomo podem ser imprevisíveis. O mau tempo, o desfoque de movimento e os sinais ocultos podem tornar complexas as soluções de IA para visão neste setor. Treinar modelos de visão computacional apenas com imagens do mundo real muitas vezes não é suficiente. Os datasets de imagens dos modelos utilizados em carros autónomos precisam de ser diversificados para que o modelo aprenda a lidar com situações inesperadas.

O aumento de dados de imagem resolve este problema ao simular nevoeiro, ajustar o brilho e distorcer formas. Estas alterações ajudam os modelos a reconhecer objetos em diferentes condições. Como resultado, os modelos tornam-se mais inteligentes e fiáveis.

Com o treino aumentado, as soluções de IA para visão em carros autónomos adaptam-se melhor e tomam decisões mais seguras. Resultados mais precisos significam menos acidentes e uma navegação melhorada.

Aumento de dados de imagem aplicado a imagens de carros autónomos

Fig. 5. Um exemplo de aumento de dados de imagem aplicado a carros autónomos.

Os carros autónomos são apenas um exemplo. Na verdade, o aumento de dados de imagem é crucial numa vasta gama de setores, desde a imagiologia médica até à análise do retalho. Qualquer aplicação que dependa de visão computacional pode potencialmente beneficiar do aumento de dados de imagem.

Principais conclusões#

Os sistemas de IA para visão precisam de conseguir reconhecer objetos em diferentes condições, mas recolher continuamente imagens do mundo real para treino pode ser difícil. O aumento de dados de imagem resolve este problema ao criar variações de imagens existentes, ajudando os modelos a aprender mais depressa e a obter melhores resultados em situações do mundo real. Melhora a precisão, garantindo que os modelos de IA para visão, como o Ultralytics YOLO11, conseguem lidar com diferentes condições de iluminação, ângulos e ambientes.

Para empresas e programadores, o aumento de dados de imagem poupa tempo e esforço, tornando simultaneamente os modelos de visão computacional mais fiáveis. Desde os cuidados de saúde até aos carros autónomos, muitos setores dependem dele. À medida que a IA para visão continua a evoluir, o aumento de dados continuará a ser uma parte essencial da criação de modelos mais inteligentes e adaptáveis para o futuro.

Junta-te à nossa comunidade e visita o nosso repositório no GitHub para veres a IA em ação. Explora as nossas opções de licenciamento e descobre mais sobre IA na agricultura e visão computacional na indústria transformadora nas nossas páginas de soluções.

Explore solutions

Visão computacional para imagens aéreas

Visão computacional para imagens aéreas

Transforma imagens de drones e aéreas em insights em tempo real para agricultura, aquicultura, monitoramento ambiental, conservação e análise geoespacial com Ultralytics YOLO.
Saiba mais
Visão computacional no setor aeroespacial

Visão computacional no setor aeroespacial

Leva a IA de visão para o monitoramento aéreo com os modelos do Ultralytics YOLO. Potencializa drones, fluxos de trabalho aeroespaciais, conservação ambiental e indústrias geoespaciais com soluções de visão computacional.
Saiba mais

Protege cada local com os modelos do Ultralytics YOLO. A IA de visão alimenta monitoramento de perímetro, detecção de ameaças, reconhecimento de placas e segurança no local de trabalho.
Saiba mais
Visão computacional na robótica

Visão computacional na robótica

Dê mais inteligência às suas máquinas com os modelos Ultralytics YOLO. A IA de visão na robótica permite a navegação autónoma, a perceção, o rastreamento de objetos e o controlo em tempo real.
Saiba mais
Visão computacional na logística

Visão computacional na logística

Simplifique a logística com os modelos Ultralytics YOLO. A IA de visão permite a inspeção de encomendas, a triagem, o rastreamento de veículos e a monitorização da segurança dos armazéns em tempo real.
Saiba mais
Visão computacional no retalho

Visão computacional no retalho

Reinvente o retalho com os modelos Ultralytics YOLO. A IA de visão permite o rastreamento do inventário, a monitorização de prateleiras, a gestão de filas e informações mais inteligentes sobre os clientes.
Saiba mais
Visão computacional na área da saúde

Visão computacional na área da saúde

Cria soluções de saúde com modelos Ultralytics YOLO. A Vision AI na área da saúde permite obter imagens médicas mais rapidamente, diagnósticos mais inteligentes e monitorização de pacientes.
Saiba mais
Visão computacional na produção

Visão computacional na produção

Otimiza a produção com modelos Ultralytics YOLO. A Vision AI impulsiona o controlo de qualidade, a deteção de defeitos, a conformidade com EPI e a automatização das linhas de montagem.
Saiba mais
Visão computacional no setor automóvel

Visão computacional no setor automóvel

Aplique visão computacional no setor automóvel com modelos Ultralytics YOLO. A IA de visão melhora a segurança rodoviária, a assistência ao condutor e a automatização de veículos para estradas mais inteligentes.
Saiba mais
Visão computacional na agricultura

Visão computacional na agricultura

Leve a IA de visão para a agricultura inteligente com modelos Ultralytics YOLO. Potencie a monitorização das culturas, o acompanhamento do gado e a agricultura de precisão para obter colheitas maiores e mais inteligentes.
Saiba mais
Visão computacional para imagens aéreas

Visão computacional para imagens aéreas

Transforma imagens de drones e aéreas em insights em tempo real para agricultura, aquicultura, monitoramento ambiental, conservação e análise geoespacial com Ultralytics YOLO.
Saiba mais
Visão computacional no setor aeroespacial

Visão computacional no setor aeroespacial

Leva a IA de visão para o monitoramento aéreo com os modelos do Ultralytics YOLO. Potencializa drones, fluxos de trabalho aeroespaciais, conservação ambiental e indústrias geoespaciais com soluções de visão computacional.
Saiba mais

Protege cada local com os modelos do Ultralytics YOLO. A IA de visão alimenta monitoramento de perímetro, detecção de ameaças, reconhecimento de placas e segurança no local de trabalho.
Saiba mais
Visão computacional na robótica

Visão computacional na robótica

Dê mais inteligência às suas máquinas com os modelos Ultralytics YOLO. A IA de visão na robótica permite a navegação autónoma, a perceção, o rastreamento de objetos e o controlo em tempo real.
Saiba mais
Visão computacional na logística

Visão computacional na logística

Simplifique a logística com os modelos Ultralytics YOLO. A IA de visão permite a inspeção de encomendas, a triagem, o rastreamento de veículos e a monitorização da segurança dos armazéns em tempo real.
Saiba mais
Visão computacional no retalho

Visão computacional no retalho

Reinvente o retalho com os modelos Ultralytics YOLO. A IA de visão permite o rastreamento do inventário, a monitorização de prateleiras, a gestão de filas e informações mais inteligentes sobre os clientes.
Saiba mais
Visão computacional na área da saúde

Visão computacional na área da saúde

Cria soluções de saúde com modelos Ultralytics YOLO. A Vision AI na área da saúde permite obter imagens médicas mais rapidamente, diagnósticos mais inteligentes e monitorização de pacientes.
Saiba mais
Visão computacional na produção

Visão computacional na produção

Otimiza a produção com modelos Ultralytics YOLO. A Vision AI impulsiona o controlo de qualidade, a deteção de defeitos, a conformidade com EPI e a automatização das linhas de montagem.
Saiba mais
Visão computacional no setor automóvel

Visão computacional no setor automóvel

Aplique visão computacional no setor automóvel com modelos Ultralytics YOLO. A IA de visão melhora a segurança rodoviária, a assistência ao condutor e a automatização de veículos para estradas mais inteligentes.
Saiba mais
Visão computacional na agricultura

Visão computacional na agricultura

Leve a IA de visão para a agricultura inteligente com modelos Ultralytics YOLO. Potencie a monitorização das culturas, o acompanhamento do gado e a agricultura de precisão para obter colheitas maiores e mais inteligentes.
Saiba mais
Visão computacional para imagens aéreas

Visão computacional para imagens aéreas

Transforma imagens de drones e aéreas em insights em tempo real para agricultura, aquicultura, monitoramento ambiental, conservação e análise geoespacial com Ultralytics YOLO.
Saiba mais
Visão computacional no setor aeroespacial

Visão computacional no setor aeroespacial

Leva a IA de visão para o monitoramento aéreo com os modelos do Ultralytics YOLO. Potencializa drones, fluxos de trabalho aeroespaciais, conservação ambiental e indústrias geoespaciais com soluções de visão computacional.
Saiba mais

Protege cada local com os modelos do Ultralytics YOLO. A IA de visão alimenta monitoramento de perímetro, detecção de ameaças, reconhecimento de placas e segurança no local de trabalho.
Saiba mais
Visão computacional na robótica

Visão computacional na robótica

Dê mais inteligência às suas máquinas com os modelos Ultralytics YOLO. A IA de visão na robótica permite a navegação autónoma, a perceção, o rastreamento de objetos e o controlo em tempo real.
Saiba mais
Visão computacional na logística

Visão computacional na logística

Simplifique a logística com os modelos Ultralytics YOLO. A IA de visão permite a inspeção de encomendas, a triagem, o rastreamento de veículos e a monitorização da segurança dos armazéns em tempo real.
Saiba mais
Visão computacional no retalho

Visão computacional no retalho

Reinvente o retalho com os modelos Ultralytics YOLO. A IA de visão permite o rastreamento do inventário, a monitorização de prateleiras, a gestão de filas e informações mais inteligentes sobre os clientes.
Saiba mais
Visão computacional na área da saúde

Visão computacional na área da saúde

Cria soluções de saúde com modelos Ultralytics YOLO. A Vision AI na área da saúde permite obter imagens médicas mais rapidamente, diagnósticos mais inteligentes e monitorização de pacientes.
Saiba mais
Visão computacional na produção

Visão computacional na produção

Otimiza a produção com modelos Ultralytics YOLO. A Vision AI impulsiona o controlo de qualidade, a deteção de defeitos, a conformidade com EPI e a automatização das linhas de montagem.
Saiba mais
Visão computacional no setor automóvel

Visão computacional no setor automóvel

Aplique visão computacional no setor automóvel com modelos Ultralytics YOLO. A IA de visão melhora a segurança rodoviária, a assistência ao condutor e a automatização de veículos para estradas mais inteligentes.
Saiba mais
Visão computacional na agricultura

Visão computacional na agricultura

Leve a IA de visão para a agricultura inteligente com modelos Ultralytics YOLO. Potencie a monitorização das culturas, o acompanhamento do gado e a agricultura de precisão para obter colheitas maiores e mais inteligentes.
Saiba mais

Vamos construir juntos o futuro da IA!

Começa a tua jornada com o futuro da aprendizagem automática