YOLO Vision 2026:
IA de visão

Tipos de técnicas de aprendizagem de IA usadas em visão computacional

Explora os diferentes tipos de técnicas de machine learning e deep learning usados em aplicações de visão computacional, desde a aprendizagem supervisionada à aprendizagem por transferência.

ABAbirami Vina4 min read
Tipos de técnicas de aprendizagem de IA usadas em visão computacional

Machine learning é um tipo de artificial intelligence (AI) que ajuda os computadores a aprenderem a partir de dados para que possam tomar decisões por conta própria, sem precisar de programação detalhada para cada tarefa. Envolve a criação de algorithmic models capazes de identificar padrões em dados. Ao identificar padrões em data e aprender com eles, esses algoritmos conseguem melhorar gradualmente o seu performance ao longo do tempo.

Uma área onde o machine learning desempenha um papel crucial é em computer vision, um campo da IA que se foca em visual data. A Computer vision utiliza machine learning para ajudar os computadores a detetar e reconhecer padrões em imagens e vídeos. Impulsionado por avanços em machine learning, estima-se que o global market value da visão por computador atinja cerca de 175,72 mil milhões de dólares até 2032.

Neste artigo, vamos analisar os diferentes tipos de machine learning utilizados em computer vision, incluindo a aprendizagem supervisionada, não supervisionada, por reforço e por transferência, e o papel que cada uma desempenha em diferentes aplicações. Vamos começar!

Visão geral do machine learning na visão computacional#

A visão por computador depende do machine learning, especialmente de técnicas como deep learning e neural networks, para interpretar e analisar informações visuais. Estes métodos tornam possível que os computadores realizem computer vision tasks como detecting objects em imagens, classifying images por categoria e recognizing faces. O machine learning também é essencial para computer vision applications em tempo real, como quality control em manufacturing e medical imaging em healthcare. Nestes casos, as neural networks ajudam os computadores a interpretar dados visuais complexos, tais como analyzing brain scans para detect tumors.

De facto, muitos modelos avançados de visão por computador, como o Ultralytics YOLO11, são construídos com base em redes neuronais.

Segmenting brain scans using Ultralytics YOLO11

Fig 1. Segmentação de exames cerebrais usando Ultralytics YOLO11.

Existem vários tipos de métodos de aprendizado em machine learning, como aprendizado supervisionado, não supervisionado, por transferência e por reforço, que estão expandindo os limites do que é possível na visão computacional. Nas seções a seguir, exploraremos cada um desses tipos para entender como eles contribuem para a visão computacional.

Explorando o aprendizado supervisionado#

O Supervised learning é o tipo de machine learning mais utilizado. No aprendizado supervisionado, os modelos são trained utilizando labeled data. Cada entrada é rotulada com a saída correta, o que ajuda o modelo a aprender. Tal como um student learning com um professor, estes dados rotulados funcionam como um guia ou supervisor.

Durante o training, o modelo recebe tanto os dados de entrada (a informação que precisa de processar) como os dados de saída (as respostas corretas). Esta configuração ajuda o modelo a aprender a ligação entre entradas e saídas. O objetivo principal da aprendizagem supervisionada é que o modelo descubra uma regra ou padrão que ligue com precisão cada entrada à respetiva saída correta. Com este mapeamento, o modelo consegue fazer previsões precisas quando se depara com novos dados. Por exemplo, o reconhecimento facial em computer vision baseia-se na aprendizagem supervisionada para identificar rostos com base nestes padrões aprendidos.

Um uso comum disto é desbloquear o teu smartphone com reconhecimento facial. O modelo é treinado com imagens rotuladas do teu rosto para que, quando fores desbloquear o telemóvel, ele compare a imagem em direto com o que aprendeu. Se detetar uma correspondência, o teu telemóvel desbloqueia.

Facial recognition used to unlock your smartphone

Fig 2. O reconhecimento facial pode ser usado para desbloquear o teu smartphone.

Como funciona o aprendizado não supervisionado em IA?#

O Unsupervised learning é um tipo de machine learning que utiliza dados não rotulados — o modelo não recebe qualquer orientação ou respostas corretas durante o treino. Em vez disso, aprende a descobrir padrões e conclusões por si próprio.

O aprendizado não supervisionado identifica padrões usando três métodos principais:

  • Clustering: Agrupa pontos de dados semelhantes. É útil para tarefas como customer segmentation, onde clientes semelhantes podem ser agrupados com base nos seus behaviors ou atributos.
  • Associação: É utilizada para identificar relações entre itens, ajudando a descobrir conexões dentro dos dados (por exemplo, encontrar produtos frequentemente comprados juntos em market basket analysis).
  • Dimensionality reduction: Simplifica conjuntos de dados ao remover caraterísticas redundantes, o que ajuda na visualização e no processamento.

Uma aplicação fundamental da aprendizagem não supervisionada é o image compression, onde técnicas como k-means clustering reduzem o tamanho da imagem sem afetar a qualidade visual. Os pixéis são agrupados em clusters e cada cluster é representado por uma cor média, resultando numa imagem com menos cores e um tamanho de ficheiro menor.

An example of unsupervised image compression

Fig 3. Um exemplo de compressão de imagem não supervisionada.

No entanto, a aprendizagem não supervisionada enfrenta certas limitações. Sem respostas predefinidas, pode ter dificuldades com a precisão e a evaluation do performance. Frequentemente requer esforço manual para interpretar resultados e rotular grupos, sendo também sensível a problemas como valores em falta e ruído, o que pode afetar a qualidade dos resultados.

Explicação do aprendizado por reforço#

Ao contrário da aprendizagem supervisionada e não supervisionada, o reinforcement learning não depende de dados de treino. Em vez disso, utiliza agentes de redes neuronais para interagir com um ambiente de modo a alcançar um objetivo específico.

O processo envolve três componentes principais:

  • Agente: O aprendiz ou tomador de decisão.
  • Ambiente: Tudo com o que o agente interage, que pode ser real ou virtual.
  • Sinal de recompensa: Um valor numérico fornecido após cada ação, guiando o agente em direção ao objetivo.

À medida que o agente realiza ações, ele afeta o ambiente, que então responde com feedback. O feedback ajuda o agente a avaliar suas escolhas e ajustar seu comportamento. O sinal de recompensa ajuda o agente a entender quais ações o aproximam de atingir seu objetivo.

O reinforcement learning é fundamental para casos de uso como autonomous driving e robotics. Em autonomous driving, tarefas como controlos de veículos, deteção e desvio de objetos aprendem com base no feedback. Os modelos são treinados utilizando agentes de redes neuronais para detetar peões ou outros objetos e tomar a ação adequada para avoid collision. Da mesma forma, em robotics, a aprendizagem por reforço permite realizar tarefas como manipulação de objetos e controlo de movimentos.

Um excelente exemplo de reinforcement learning em ação é um projeto da OpenAI, onde investigadores trained AI agents para jogar o popular video game multijogador Dota 2. Utilizando redes neuronais, estes agentes processaram enormes quantidades de informação provenientes do game environment para tomar decisões rápidas e estratégicas. Através de feedback contínuo, os agentes aprenderam e melhoraram ao longo do tempo, atingindo eventualmente um nível de habilidade suficiente para vencer alguns dos game’s top players.

Human vs. AI interpretation of the Dota Matrix

Fig 4. Interpretação humana vs. IA da matriz do Dota.

Entendendo os fundamentos do aprendizado por transferência#

O Transfer learning é diferente de outros tipos de aprendizagem. Em vez de training a model de raiz, ele utiliza um pre-trained model num grande dataset e ajusta-o finamente (fine-tuning) para uma tarefa nova, mas relacionada. O conhecimento adquirido durante o treino inicial é utilizado para melhorar o performance da nova tarefa. O Transfer learning reduz o tempo necessário para treinar para uma nova tarefa, dependendo da sua complexidade. Funciona mantendo as camadas iniciais do modelo que capturam as caraterísticas gerais e substituindo as camadas finais pelas da nova tarefa específica.

A transferência de estilo artístico é uma aplicação interessante da aprendizagem por transferência em visão por computador. Esta técnica permite que um modelo transforme uma imagem para corresponder ao estilo de diferentes artwork. Para conseguir isto, uma rede neuronal é primeiro treinada num grande conjunto de dados de imagens emparelhadas com os respetivos estilos artísticos. Através deste processo, o modelo aprende a identificar caraterísticas gerais de imagens e padrões de estilo.

Uma vez treinado o modelo, ele pode ser ajustado para aplicar o estilo de uma pintura específica a uma nova imagem. A rede se adapta à nova imagem enquanto preserva os recursos de estilo aprendidos, permitindo criar um resultado único que combina o conteúdo original com o estilo artístico selecionado. Por exemplo, você poderia tirar uma foto de uma cordilheira e aplicar o estilo de O Grito de Edvard Munch, resultando em uma imagem que captura a cena, mas com o estilo ousado e expressivo da pintura.

An example of artistic style transfer using transfer learning

Fig 5. Um exemplo de transferência de estilo artístico utilizando transfer learning.

Um olhar sobre as diferenças entre os tipos de machine learning#

Agora que cobrimos os principais tipos de machine learning, vamos analisar cada um com mais detalhes para ajudar você a entender qual se encaixa melhor em diferentes aplicações.

  • Aprendizado supervisionado: Este tipo é altamente preciso ao trabalhar com dados rotulados, mas requer muitos dados e pode ser sensível a ruído.
  • Aprendizado não supervisionado: É útil para explorar dados não rotulados para encontrar padrões ocultos, embora os resultados possam ser menos precisos e mais difíceis de interpretar.
  • Aprendizado por reforço: Treina agentes para tomar decisões passo a passo em ambientes complexos, mas frequentemente requer um poder computacional significativo.
  • Aprendizado por transferência: Essa abordagem usa modelos pré-treinados para acelerar o treinamento e melhorar o desempenho em novas tarefas, especialmente quando os dados são limitados.

A comparison of all the machine learning types

Fig 6. Uma comparação de todos os tipos de machine learning. Imagem do autor.

Escolher o tipo certo de machine learning depende de vários fatores. A aprendizagem supervisionada funciona bem se tiveres dados rotulados abundantes e uma tarefa clara. A aprendizagem não supervisionada é útil para a exploração de dados ou quando os exemplos rotulados são escassos. A aprendizagem por reforço é ideal para tarefas complexas que exigem a tomada de decisões passo a passo, enquanto o transfer learning é excelente quando os dados são limitados ou os recursos são escassos. Ao ponderar estes fatores, podes selecionar a abordagem mais adequada para o teu computer vision project.

Conclusão#

Técnicas de machine learning podem enfrentar uma variedade de desafios, especialmente em áreas como visão computacional. Ao entender os diferentes tipos, aprendizado supervisionado, não supervisionado, por reforço e por transferência, você pode escolher a melhor abordagem para suas necessidades.

O aprendizado supervisionado é excelente para tarefas que exigem alta precisão e dados rotulados, enquanto o aprendizado não supervisionado é ideal para encontrar padrões em dados não rotulados. O aprendizado por reforço funciona bem em cenários complexos baseados em decisões, e o aprendizado por transferência é útil quando você deseja construir sobre modelos pré-treinados com dados limitados.

Cada método tem pontos fortes e aplicações únicas, desde reconhecimento facial até robótica e transferência de estilo artístico. Escolher o tipo certo pode desbloquear novas possibilidades em setores como saúde, automotivo e entretenimento.

Para explorar mais, visita o nosso repositório do GitHub e envolve-te com a nossa comunidade. Explora aplicações de IA em carros autônomos e agricultura nas nossas páginas de soluções. 🚀

Explore solutions

Real-time AI that works with your team

IA em robótica

Potencialize máquinas mais inteligentes com modelos Ultralytics YOLO. A IA de visão em robótica impulsiona a navegação autônoma, percepção, rastreamento de objetos e controle em tempo real.
Sabe mais
Real-time AI that works with your team

IA na Logística

Otimize a logística com modelos Ultralytics YOLO. A IA de visão permite a inspeção de pacotes, triagem, rastreamento de veículos e monitoramento de segurança em armazéns em tempo real.
Sabe mais
Real-time AI that works with your team

IA no varejo

Reinvente o varejo com modelos Ultralytics YOLO. A IA de visão impulsiona o rastreamento de inventário, monitoramento de prateleiras, gerenciamento de filas e percepções mais inteligentes sobre o cliente.
Sabe mais
Real-time AI that works with your team

IA na Saúde

Constrói soluções de saúde com modelos Ultralytics YOLO. A visão AI na saúde impulsiona imagens médicas mais rápidas, diagnósticos mais inteligentes e monitorização do paciente.
Sabe mais
Real-time AI that works with your team

IA na Fabricação

Otimize a fabricação com modelos Ultralytics YOLO. A IA de visão impulsiona o controle de qualidade, detecção de defeitos, conformidade com EPI e automação de linhas de montagem.
Sabe mais
Real-time AI that works with your operation

IA no Setor Automóvel

Aplica visão computacional no setor automóvel com modelos Ultralytics YOLO. A visão AI eleva a segurança rodoviária, a assistência ao condutor e a automação de veículos para estradas mais inteligentes.
Sabe mais
Real-time AI tailored to your operation

IA na Agricultura

Leva a visão AI para a agricultura inteligente com os modelos Ultralytics YOLO. Potencia a monitorização de culturas, o seguimento de gado e a agricultura de precisão para colheitas maiores e mais inteligentes.
Sabe mais
Real-time AI that works with your team

IA em robótica

Potencialize máquinas mais inteligentes com modelos Ultralytics YOLO. A IA de visão em robótica impulsiona a navegação autônoma, percepção, rastreamento de objetos e controle em tempo real.
Sabe mais
Real-time AI that works with your team

IA na Logística

Otimize a logística com modelos Ultralytics YOLO. A IA de visão permite a inspeção de pacotes, triagem, rastreamento de veículos e monitoramento de segurança em armazéns em tempo real.
Sabe mais
Real-time AI that works with your team

IA no varejo

Reinvente o varejo com modelos Ultralytics YOLO. A IA de visão impulsiona o rastreamento de inventário, monitoramento de prateleiras, gerenciamento de filas e percepções mais inteligentes sobre o cliente.
Sabe mais
Real-time AI that works with your team

IA na Saúde

Constrói soluções de saúde com modelos Ultralytics YOLO. A visão AI na saúde impulsiona imagens médicas mais rápidas, diagnósticos mais inteligentes e monitorização do paciente.
Sabe mais
Real-time AI that works with your team

IA na Fabricação

Otimize a fabricação com modelos Ultralytics YOLO. A IA de visão impulsiona o controle de qualidade, detecção de defeitos, conformidade com EPI e automação de linhas de montagem.
Sabe mais
Real-time AI that works with your operation

IA no Setor Automóvel

Aplica visão computacional no setor automóvel com modelos Ultralytics YOLO. A visão AI eleva a segurança rodoviária, a assistência ao condutor e a automação de veículos para estradas mais inteligentes.
Sabe mais
Real-time AI tailored to your operation

IA na Agricultura

Leva a visão AI para a agricultura inteligente com os modelos Ultralytics YOLO. Potencia a monitorização de culturas, o seguimento de gado e a agricultura de precisão para colheitas maiores e mais inteligentes.
Sabe mais
Real-time AI that works with your team

IA em robótica

Potencialize máquinas mais inteligentes com modelos Ultralytics YOLO. A IA de visão em robótica impulsiona a navegação autônoma, percepção, rastreamento de objetos e controle em tempo real.
Sabe mais
Real-time AI that works with your team

IA na Logística

Otimize a logística com modelos Ultralytics YOLO. A IA de visão permite a inspeção de pacotes, triagem, rastreamento de veículos e monitoramento de segurança em armazéns em tempo real.
Sabe mais
Real-time AI that works with your team

IA no varejo

Reinvente o varejo com modelos Ultralytics YOLO. A IA de visão impulsiona o rastreamento de inventário, monitoramento de prateleiras, gerenciamento de filas e percepções mais inteligentes sobre o cliente.
Sabe mais
Real-time AI that works with your team

IA na Saúde

Constrói soluções de saúde com modelos Ultralytics YOLO. A visão AI na saúde impulsiona imagens médicas mais rápidas, diagnósticos mais inteligentes e monitorização do paciente.
Sabe mais
Real-time AI that works with your team

IA na Fabricação

Otimize a fabricação com modelos Ultralytics YOLO. A IA de visão impulsiona o controle de qualidade, detecção de defeitos, conformidade com EPI e automação de linhas de montagem.
Sabe mais
Real-time AI that works with your operation

IA no Setor Automóvel

Aplica visão computacional no setor automóvel com modelos Ultralytics YOLO. A visão AI eleva a segurança rodoviária, a assistência ao condutor e a automação de veículos para estradas mais inteligentes.
Sabe mais
Real-time AI tailored to your operation

IA na Agricultura

Leva a visão AI para a agricultura inteligente com os modelos Ultralytics YOLO. Potencia a monitorização de culturas, o seguimento de gado e a agricultura de precisão para colheitas maiores e mais inteligentes.
Sabe mais

Vamos construir o futuro da IA juntos!

Começa a tua jornada com o futuro da aprendizagem automática