YOLO Vision 2026:
IA de visão

Tudo o que precisas saber sobre IA explicável (XAI)

Descobre como a IA Explicável (XAI) constrói confiança ao tornar as previsões de IA transparentes e confiáveis na saúde, segurança, direção autônoma e muito mais.

ABAbirami Vina4 min read
Uma visão geral da IA explicável (XAI) em visão computacional

Já alguma vez viste uma resposta de uma ferramenta de intelligence artificial (AI) como o ChatGPT e perguntaste-te como é que chegou a essa conclusão? Então, já te deparaste com a preocupação da "caixa preta" da IA. É um termo que se refere à falta de clareza sobre a forma como os modelos de IA processam e analisam dados. Até os engenheiros e cientistas de IA que trabalham regularmente com algoritmos de IA de ponta podem achar desafiante compreender totalmente o seu funcionamento interno. De facto, apenas 22% dos profissionais de TI compreendem verdadeiramente as capacidades das ferramentas de IA.

A incerteza em torno da forma como os modelos de IA tomam decisões pode ser arriscada, especialmente em áreas críticas como a computer vision in healthcare e a AI in finance. No entanto, estão a ser feitos progressos significativos para enfrentar estes desafios e melhorar a transparência.

Em particular, a explainable AI (XAI) concentra-se exclusivamente em resolver esta questão. Em termos simples, é um conjunto de processos e métodos que ajuda os utilizadores humanos a compreender e confiar nos resultados fornecidos por algoritmos de machine learning complexos.

A XAI pode ajudar os programadores a garantir que os sistemas de IA estão a funcionar conforme esperado. Também pode ajudar as empresas de IA a cumprir as normas regulamentares. Neste artigo, vamos explorar a IA explicável e a sua vasta gama de casos de uso. Vamos começar!

A importância da inteligência artificial explicável#

A explicabilidade é fundamental quando se trabalha com IA. Isto é especialmente verdade quando se trata do subcampo da IA, a computer vision, que é amplamente utilizada em aplicações em indústrias como a saúde. Ao utilizar vision models em indústrias tão sensíveis, é importante que o funcionamento do modelo seja transparente e interpretável para todos.

A interpretabilidade nos modelos de visão computacional ajuda os utilizadores a compreender melhor como foi feita uma prediction e a lógica por trás da mesma. A transparência complementa isto, tornando o funcionamento do modelo claro para todos, delineando claramente as limitações do modelo e garantindo que os dados são utilizados de forma ética. Por exemplo, a visão computacional pode ajudar os radiologists a identificar eficientemente complicações de saúde em imagens de raios X.

Chest X-rays analyzed using vision AI for tuberculosis classification

Fig 1. Radiografias torácicas analisadas com IA de visão, mostrando classificações de tuberculose saudável, doente, ativa e latente.

No entanto, um sistema de visão que seja apenas preciso não é suficiente. O sistema também precisa de ser capaz de explicar as suas decisões. Digamos que o sistema pudesse mostrar quais as partes da imagem que conduziram às suas conclusões - assim, quaisquer resultados seriam mais claros. Tal nível de transparência ajudaria os profissionais médicos a verificar duplamente os seus achados e a garantir que o patient care cumpre as normas médicas.

Outra razão pela qual a explicabilidade é essencial é que responsabiliza as empresas de IA e gera confiança nos utilizadores. A IA fiável faz com que os utilizadores sintam confiança de que as inovações de IA funcionam de forma fiável, tomam decisões justas e handle data responsibly.

Principais técnicas de inteligência artificial explicável em visão computacional#

Agora que discutimos por que a explicabilidade importa na visão computacional, vamos dar uma vista de olhos às principais técnicas de XAI usadas na IA de visão.

Mapas de saliência#

Neural networks são modelos inspirados no cérebro humano, concebidos para reconhecer padrões e tomar decisões processando dados através de camadas interconectadas de nós (neurónios). Podem ser utilizados para resolver problemas complexos de visão computacional com alta precisão. Mesmo com esta precisão, continuam a ser caixas pretas por conceção.

Os mapas de saliência são uma técnica de XAI que pode ser usada para ajudar a fazer sentido do que as redes neuronais estão a ver quando analisam imagens. Também podem ser usados para solucionar problemas em modelos caso não estejam a ter o desempenho esperado.

Os mapas de saliência funcionam focando-se em quais as partes de uma imagem (píxeis) que definem as previsões de um modelo. Este processo é muito semelhante à backpropagation, onde o modelo recua desde as previsões até à entrada. Mas, em vez de atualizar os pesos do modelo com base em erros, estamos apenas a observar o quanto cada píxel "importa" para a previsão. Os mapas de saliência são muito úteis para computer vision tasks como a classificação de imagens.

Por exemplo, se um modelo de image classification prevê que uma imagem é de um cão, podemos olhar para o seu mapa de saliência para compreender porque é que o modelo pensa que é um cão. Isto ajuda-nos a identificar quais os píxeis que mais afetam a saída. O mapa de saliência destacaria todos os píxeis que contribuíram para a previsão final de que a imagem é um cão.

A side-by-side view of input images and their saliency maps

Fig 2. Uma vista lado a lado das imagens de entrada e dos seus mapas de saliência.

Class Activation Mapping (CAM)#

O Mapeamento de Ativação de Classes é outra técnica de XAI utilizada para compreender em que partes de uma imagem uma rede neural se foca ao fazer previsões de classificação de imagens. Funciona de forma semelhante aos mapas de saliência, mas foca-se em identificar características importantes na imagem em vez de píxeis específicos. As Features são padrões ou detalhes, como formas ou texturas, que o modelo deteta na imagem.

Métodos como Gradient Weighted Class Activation Mapping (Grad-CAM) e Grad-CAM++ constroem sobre a mesma ideia, com algumas melhorias.

Aqui está como o CAM funciona:

  • Antes da rede neuronal tomar a sua decisão final, utiliza um passo chamado global average pooling (GAP) para simplificar a informação. O GAP combina todos os píxeis num padrão detetado num único valor médio, criando um resumo para cada mapa de características (uma representação visual de padrões detetados).
  • Cada mapa de características recebe então um peso que mostra o quão importante é para prever uma certa classe (como "pássaro" ou "gato").
  • No entanto, uma limitação do CAM é que podes precisar de retrain the model para calcular estes pesos, o que pode ser demorado.

O Grad-CAM melhora isto utilizando gradients, que são como sinais que mostram o quanto cada mapa de características influencia a previsão final. Este método evita a necessidade de GAP e facilita a visualização do foco do modelo sem retreinamento. O Grad-CAM++ vai mais além, focando-se apenas nas influências positivas, o que torna os resultados ainda mais claros.

Comparing CAM, Grad-CAM, and Grad-CAM++

Fig 3. Comparação entre CAM, Grad-CAM e Grad-CAM++.

Explicações contrafatuais#

As explicações contrafatuais são um elemento importante da inteligência artificial explicável. Uma explicação contrafactual envolve descrever uma situação ou resultado considerando cenários ou eventos alternativos que não aconteceram, mas que poderiam ter acontecido. Pode demonstrar como mudanças em variáveis específicas de entrada levam a resultados diferentes, como: "Se X não tivesse acontecido, Y não teria ocorrido."

Quando se trata de IA e visão computacional, uma explicação contrafactual identifica a menor alteração necessária numa entrada (tal como an image or data) para fazer com que um modelo de IA produza um resultado diferente e específico. Por exemplo, alterar a cor de um objeto numa imagem pode mudar a image classification model’s prediction de "gato" para "cão".

Outro bom exemplo seria alterar o ângulo ou a iluminação num facial recognition system. Isto poderia fazer com que o modelo identificasse um indivíduo diferente, mostrando como pequenas alterações na entrada podem influenciar as previsões do modelo.

A forma mais simples de criar estas explicações é por ensaio e erro: podes alterar aleatoriamente partes da entrada (como características da imagem ou dados) até que o modelo de IA te dê o resultado desejado. Outros métodos incluem abordagens agnósticas ao modelo, que utilizam técnicas de optimization e pesquisa para encontrar alterações, e abordagens específicas do modelo, que dependem de definições internas ou cálculos para identificar as alterações necessárias.

Aplicações da inteligência artificial explicável em visão computacional#

Agora que explorámos o que é a XAI e as suas principais técnicas, podemos percorrer como é usada na vida real. A XAI tem aplicações diversas em muitos campos. Vamos mergulhar em alguns casos de uso que destacam o seu potencial:

  • Security systems: A XAI pode ser utilizada para melhorar os sistemas de segurança através da deteção de imagens transformadas em documentos de identificação, como passaportes e cartas de condução. Isto garante a autenticidade das imagens, fortalece os processos de verificação de identidade e evita atividades fraudulentas em aplicações sensíveis.

How XAI works to detect morphed images

Fig 4. Como funciona a XAI para detetar imagens transformadas.

  • Autonomous driving: Compreender as capacidades e limitações do sistema de IA de visão integrado de um carro autónomo pode ser uma parte enorme do teste do carro antes de ser implementado em estradas do mundo real. A XAI pode ajudar as empresas automóveis a identificar e resolver problemas de forma mais clara.

  • Legal systems: Os sistemas de document analysis com capacidades de visão são cada vez mais utilizados na tomada de decisões judiciais. A XAI apoia resultados justos e permite que os julgamentos automatizados sejam escrutinados. Também ajuda os profissionais jurídicos a compreender como um modelo de IA chega às suas decisões.

  • Wildlife monitoring: As câmaras de armadilha são frequentemente utilizadas para monitorizar a vida selvagem e recolher dados sobre espécies animais. A XAI pode ser utilizada para explicar como a IA classifica estas espécies nas imagens. Ao fazê-lo, os esforços de conservação podem ser mais fiáveis e precisos.

Principais conclusões sobre inteligência artificial explicável#

A inteligência artificial explicável torna mais fácil entender como os sistemas de IA funcionam e por que tomam certas decisões. A transparência sobre modelos de IA cria confiança e responsabilidade. Conhecimento é poder e ajuda a que as inovações em IA sejam usadas de forma mais responsável. Em áreas críticas como saúde, segurança, condução autónoma e sistemas legais, a XAI pode ser usada para ajudar programadores e utilizadores a entender previsões de IA, identificar erros e garantir um uso justo e ético. Ao tornar a IA mais transparente, a XAI reduz a lacuna entre a tecnologia e a confiança humana, tornando-a mais segura e fiável para aplicações do mundo real.

Para saber mais, visita o nosso GitHub repository e interage com a nossa community. Explora as AI applications in self-driving cars e a agriculture nas nossas páginas de soluções. 🚀

Explore solutions

Real-time AI that works with your team

IA em robótica

Potencialize máquinas mais inteligentes com modelos Ultralytics YOLO. A IA de visão em robótica impulsiona a navegação autônoma, percepção, rastreamento de objetos e controle em tempo real.
Sabe mais
Real-time AI that works with your team

IA na Logística

Otimize a logística com modelos Ultralytics YOLO. A IA de visão permite a inspeção de pacotes, triagem, rastreamento de veículos e monitoramento de segurança em armazéns em tempo real.
Sabe mais
Real-time AI that works with your team

IA no varejo

Reinvente o varejo com modelos Ultralytics YOLO. A IA de visão impulsiona o rastreamento de inventário, monitoramento de prateleiras, gerenciamento de filas e percepções mais inteligentes sobre o cliente.
Sabe mais
Real-time AI that works with your team

IA na Saúde

Constrói soluções de saúde com modelos Ultralytics YOLO. A visão AI na saúde impulsiona imagens médicas mais rápidas, diagnósticos mais inteligentes e monitorização do paciente.
Sabe mais
Real-time AI that works with your team

IA na Fabricação

Otimize a fabricação com modelos Ultralytics YOLO. A IA de visão impulsiona o controle de qualidade, detecção de defeitos, conformidade com EPI e automação de linhas de montagem.
Sabe mais
Real-time AI that works with your operation

IA no Setor Automóvel

Aplica visão computacional no setor automóvel com modelos Ultralytics YOLO. A visão AI eleva a segurança rodoviária, a assistência ao condutor e a automação de veículos para estradas mais inteligentes.
Sabe mais
Real-time AI tailored to your operation

IA na Agricultura

Leva a visão AI para a agricultura inteligente com os modelos Ultralytics YOLO. Potencia a monitorização de culturas, o seguimento de gado e a agricultura de precisão para colheitas maiores e mais inteligentes.
Sabe mais
Real-time AI that works with your team

IA em robótica

Potencialize máquinas mais inteligentes com modelos Ultralytics YOLO. A IA de visão em robótica impulsiona a navegação autônoma, percepção, rastreamento de objetos e controle em tempo real.
Sabe mais
Real-time AI that works with your team

IA na Logística

Otimize a logística com modelos Ultralytics YOLO. A IA de visão permite a inspeção de pacotes, triagem, rastreamento de veículos e monitoramento de segurança em armazéns em tempo real.
Sabe mais
Real-time AI that works with your team

IA no varejo

Reinvente o varejo com modelos Ultralytics YOLO. A IA de visão impulsiona o rastreamento de inventário, monitoramento de prateleiras, gerenciamento de filas e percepções mais inteligentes sobre o cliente.
Sabe mais
Real-time AI that works with your team

IA na Saúde

Constrói soluções de saúde com modelos Ultralytics YOLO. A visão AI na saúde impulsiona imagens médicas mais rápidas, diagnósticos mais inteligentes e monitorização do paciente.
Sabe mais
Real-time AI that works with your team

IA na Fabricação

Otimize a fabricação com modelos Ultralytics YOLO. A IA de visão impulsiona o controle de qualidade, detecção de defeitos, conformidade com EPI e automação de linhas de montagem.
Sabe mais
Real-time AI that works with your operation

IA no Setor Automóvel

Aplica visão computacional no setor automóvel com modelos Ultralytics YOLO. A visão AI eleva a segurança rodoviária, a assistência ao condutor e a automação de veículos para estradas mais inteligentes.
Sabe mais
Real-time AI tailored to your operation

IA na Agricultura

Leva a visão AI para a agricultura inteligente com os modelos Ultralytics YOLO. Potencia a monitorização de culturas, o seguimento de gado e a agricultura de precisão para colheitas maiores e mais inteligentes.
Sabe mais
Real-time AI that works with your team

IA em robótica

Potencialize máquinas mais inteligentes com modelos Ultralytics YOLO. A IA de visão em robótica impulsiona a navegação autônoma, percepção, rastreamento de objetos e controle em tempo real.
Sabe mais
Real-time AI that works with your team

IA na Logística

Otimize a logística com modelos Ultralytics YOLO. A IA de visão permite a inspeção de pacotes, triagem, rastreamento de veículos e monitoramento de segurança em armazéns em tempo real.
Sabe mais
Real-time AI that works with your team

IA no varejo

Reinvente o varejo com modelos Ultralytics YOLO. A IA de visão impulsiona o rastreamento de inventário, monitoramento de prateleiras, gerenciamento de filas e percepções mais inteligentes sobre o cliente.
Sabe mais
Real-time AI that works with your team

IA na Saúde

Constrói soluções de saúde com modelos Ultralytics YOLO. A visão AI na saúde impulsiona imagens médicas mais rápidas, diagnósticos mais inteligentes e monitorização do paciente.
Sabe mais
Real-time AI that works with your team

IA na Fabricação

Otimize a fabricação com modelos Ultralytics YOLO. A IA de visão impulsiona o controle de qualidade, detecção de defeitos, conformidade com EPI e automação de linhas de montagem.
Sabe mais
Real-time AI that works with your operation

IA no Setor Automóvel

Aplica visão computacional no setor automóvel com modelos Ultralytics YOLO. A visão AI eleva a segurança rodoviária, a assistência ao condutor e a automação de veículos para estradas mais inteligentes.
Sabe mais
Real-time AI tailored to your operation

IA na Agricultura

Leva a visão AI para a agricultura inteligente com os modelos Ultralytics YOLO. Potencia a monitorização de culturas, o seguimento de gado e a agricultura de precisão para colheitas maiores e mais inteligentes.
Sabe mais

Vamos construir o futuro da IA juntos!

Começa a tua jornada com o futuro da aprendizagem automática