YOLO Vision 2026:
Integrações

IA Constitucional visa alinhar modelos de IA com valores humanos

Aprenda como a IA constitucional ajuda os modelos a seguir regras éticas, tomar decisões mais seguras e apoiar a justiça em sistemas de linguagem e visão computacional.

ABAbirami Vina4 min read
IA Constitucional alinhando modelos com valores humanos

A inteligência artificial (IA) está a tornar-se rapidamente numa parte essencial das nossas vidas diárias. Está a ser integrada em ferramentas utilizadas em áreas como saúde, recrutamento, finanças e segurança pública. À medida que estes sistemas se expandem, surgem também preocupações sobre a sua ética e fiabilidade.

Por exemplo, por vezes, sistemas de IA construídos sem considerar a justiça ou a segurança podem produzir resultados que são tendenciosos ou pouco fiáveis. Isto acontece porque muitos modelos ainda não têm uma forma clara de refletir e alinhar-se com os valores humanos.

Para enfrentar esses desafios, os pesquisadores estão explorando uma abordagem conhecida como constitutional AI. Em termos simples, ela introduz um conjunto escrito de princípios no processo de treinamento do modelo. Esses princípios ajudam o modelo a julgar seu próprio comportamento, a depender menos do feedback humano e a tornar as respostas mais seguras e fáceis de entender.

Até agora, essa abordagem tem sido usada principalmente em relação a large language models (LLMs). No entanto, a mesma estrutura pode ajudar a guiar sistemas de computer vision a tomar decisões éticas ao analisar dados visuais.

Neste artigo, vamos explorar como funciona a IA constitucional, analisar exemplos reais e discutir as suas potenciais aplicações em sistemas de visão computacional.

Characteristics of constitutional AI

Fig 1. Características da IA constitucional. Imagem do autor.

O que é a IA constitucional?#

O constitutional AI é um método de model training que orienta como os modelos de IA se comportam, fornecendo um conjunto claro de regras éticas. Essas regras atuam como um código de conduta. Em vez de contar com o modelo para inferir o que é aceitável, ele segue um conjunto escrito de princípios que moldam suas respostas durante o training.

Esse conceito foi introduzido pela Anthropic, uma empresa de pesquisa focada em segurança de IA que desenvolveu a família de LLMs Claude como um método para tornar os sistemas de IA mais autorregulados em sua tomada de decisões.

Em vez de depender apenas do feedback humano, o modelo aprende a criticar e refinar as suas próprias respostas com base num conjunto predefinido de princípios. Esta abordagem é semelhante a um sistema jurídico, onde um juiz recorre a uma constituição antes de tomar uma decisão.

Nesse caso, o modelo se torna tanto o juiz quanto o aluno, usando o mesmo conjunto de regras para revisar e refinar seu próprio comportamento. Esse processo fortalece o alinhamento do modelo de IA e apoia o desenvolvimento de sistemas de IA seguros e responsible.

Como funciona a IA constitucional?#

O objetivo da IA constitucional é ensinar um modelo de IA a tomar decisões seguras e justas seguindo um conjunto claro de regras escritas. Aqui tens uma explicação simples de como este processo funciona:

  • Definir a constituição: É criada uma lista escrita de princípios éticos que o modelo deve seguir. A constituição descreve o que a IA deve evitar e que valores deve refletir.
  • Treinamento com exemplos supervised: O modelo recebe respostas de exemplo que seguem a constituição. Esses exemplos ajudam a IA a entender como é um comportamento aceitável.
  • Reconhecer e aplicar padrões: Com o tempo, o modelo começa a captar estes padrões. Aprende a aplicar os mesmos valores ao responder a novas perguntas ou ao lidar com novas situações.
  • Criticar e refinar resultados: O modelo revê as suas próprias respostas e ajusta-as com base na constituição. Esta fase de auto-avaliação ajuda-o a melhorar sem depender apenas do feedback humano.
  • Produzir respostas alinhadas e mais seguras: O modelo aprende com regras consistentes, o que ajuda a reduzir o viés e a melhorar a fiabilidade na utilização no mundo real. Esta abordagem torna-o mais alinhado com os valores humanos e mais fácil de governar.

An overview of using constitutional AI to train models

Fig 2. Uma visão geral do uso de IA constitucional para treinar modelos.

Princípios fundamentais do design de IA ética#

Para que um modelo de IA siga ethical rules, essas regras precisam ser claramente definidas primeiro. No caso do constitutional AI, essas regras são baseadas em um conjunto de princípios fundamentais.

Por exemplo, aqui estão quatro princípios que constituem a base de uma constituição de IA eficaz:

  • Transparency: Deve ser fácil entender como um modelo chegou a uma resposta. Se uma resposta se basear em fatos, estimativas ou padrões, ela será transparente para o usuário. Isso gera confiança e ajuda as pessoas a julgarem se podem confiar na saída do modelo.
  • Igualdade: As respostas devem manter-se consistentes entre diferentes utilizadores. O modelo não deve alterar o seu resultado com base no nome, antecedentes ou localização de uma pessoa. A igualdade ajuda a prevenir o viés e promove o tratamento equitativo.
  • Responsabilidade: Deve haver uma forma de rastrear como um modelo foi treinado e o que influenciou o seu comportamento. Quando algo corre mal, as equipas devem ser capazes de identificar a causa e melhorá-la. Isto apoia a transparência e a responsabilidade a longo prazo.
  • Segurança: Os modelos precisam de evitar produzir conteúdo que possa causar danos. Se um pedido levar a resultados arriscados ou inseguros, o sistema deve reconhecê-lo e parar. Isto protege tanto o utilizador como a integridade do sistema.

Exemplos de IA constitucional em grandes modelos de linguagem#

O constitutional AI passou da teoria para a prática e agora está sendo usado lentamente em grandes modelos que interagem com milhões de usuários. Dois dos exemplos mais comuns são os LLMs da OpenAI e da Anthropic.

Embora ambas as organizações tenham adotado abordagens diferentes para criar sistemas de IA mais éticos, partilham uma ideia comum: ensinar o modelo a seguir um conjunto de princípios orientadores escritos. Vamos analisar mais de perto estes exemplos.

Abordagem de IA constitucional da OpenAI#

A OpenAI introduziu um documento chamado Model Spec como parte do processo de treino para os seus modelos ChatGPT. Este documento funciona como uma constituição. Descreve o que o modelo deve procurar nas suas respostas, incluindo valores como utilidade, honestidade e segurança. Também define o que conta como resultado prejudicial ou enganador.

Essa estrutura tem sido usada para ajustar os modelos da OpenAI classificando as respostas de acordo com o grau de conformidade com as regras. Com o tempo, isso ajudou a moldar o ChatGPT para que ele produza menos saídas nocivas e se alinhe melhor ao que os usuários realmente desejam.

ChatGPT using OpenAI's Model Spec to respond

Fig 3. Um exemplo do ChatGPT usando a Model Spec da OpenAI para responder.

Modelos de IA ética da Anthropic#

A constituição que o modelo Claude da Anthropic segue baseia-se em princípios éticos de fontes como a Declaração Universal dos Direitos Humanos, diretrizes de plataformas como os termos de serviço da Apple e investigação de outros laboratórios de IA. Estes princípios ajudam a garantir que as respostas do Claude sejam seguras, justas e alinhadas com valores humanos importantes.

O Claude também usa o aprendizado por reforço com feedback de IA (RLAIF), onde ele revisa e ajusta suas próprias respostas com base nessas diretrizes éticas, em vez de depender de human feedback. Esse processo permite que o Claude melhore com o tempo, tornando-o mais escalável e melhor em fornecer respostas úteis, éticas e não nocivas, mesmo em situações difíceis.

Understanding Anthropic's approach to constitutional AI

Fig 4. Entendendo a abordagem da Anthropic para o constitutional AI.

Aplicar a IA constitucional à visão computacional#

Uma vez que a IA constitucional está a influenciar positivamente a forma como os modelos de linguagem se comportam, surge naturalmente a questão: Poderia uma abordagem semelhante ajudar os sistemas baseados em visão a responder de forma mais justa e segura?

Embora os computer vision models trabalhem com imagens em vez de texto, a necessidade de orientações éticas é igualmente importante. Por exemplo, a imparcialidade e o viés são fatores fundamentais a serem considerados, já que esses sistemas precisam ser treinados para tratar todos igualmente e evitar resultados prejudiciais ou injustos ao analisar dados visuais.

Ethical challenges related to computer vision

Fig 5. Desafios éticos relacionados com a visão computacional. Imagem do autor.

Neste momento, a utilização de métodos de IA constitucional na visão computacional ainda está a ser explorada e encontra-se nas suas fases iniciais, com investigação em curso nesta área.

Por exemplo, a Meta introduziu recentemente o CLUE, uma estrutura que aplica raciocínio semelhante ao constitucional a tarefas de segurança de imagens. Ela transforma regras amplas de segurança em etapas precisas que a IA multimodal (sistemas de IA que processam e entendem vários tipos de dados) pode seguir. Isso ajuda o sistema a raciocinar com mais clareza e a reduzir resultados nocivos.

Além disso, o CLUE torna os julgamentos de segurança de imagem mais eficientes ao simplificar regras complexas, permitindo que os modelos de IA ajam de forma rápida e precisa sem necessidade de um extenso contributo humano. Ao utilizar um conjunto de princípios orientadores, o CLUE torna os sistemas de moderação de imagem mais escaláveis, garantindo resultados de alta qualidade.

Principais pontos#

À medida que os sistemas de IA assumem mais responsabilidade, o foco está a mudar do que eles podem fazer para o que eles devem fazer. Esta mudança é fundamental, uma vez que estes sistemas são utilizados em áreas que impactam diretamente a vida das pessoas, como saúde, aplicação da lei e educação.

Para garantir que os sistemas de IA ajam de forma apropriada e ética, precisam de uma base sólida e consistente. Esta base deve priorizar a justiça, a segurança e a confiança.

Uma constituição escrita pode fornecer essa base durante o treino, orientando o processo de tomada de decisão do sistema. Também pode dar aos programadores uma estrutura para rever e ajustar o comportamento do sistema após a implementação, garantindo que continua alinhado com os valores que foi concebido para defender e tornando-o mais fácil de adaptar à medida que surgem novos desafios.

Junte-te à nossa crescente community hoje mesmo! Mergulha mais fundo na IA explorando o nosso GitHub repository. Queres criar os teus próprios projetos de computer vision? Explora as nossas licensing options. Descobre como a computer vision in healthcare está a melhorar a eficiência e explora o impacto da AI in manufacturing visitando as nossas páginas de soluções!

Explore solutions

Real-time AI that works with your team

IA em robótica

Potencialize máquinas mais inteligentes com modelos Ultralytics YOLO. A IA de visão em robótica impulsiona a navegação autônoma, percepção, rastreamento de objetos e controle em tempo real.
Sabe mais
Real-time AI that works with your team

IA na Logística

Otimize a logística com modelos Ultralytics YOLO. A IA de visão permite a inspeção de pacotes, triagem, rastreamento de veículos e monitoramento de segurança em armazéns em tempo real.
Sabe mais
Real-time AI that works with your team

IA no varejo

Reinvente o varejo com modelos Ultralytics YOLO. A IA de visão impulsiona o rastreamento de inventário, monitoramento de prateleiras, gerenciamento de filas e percepções mais inteligentes sobre o cliente.
Sabe mais
Real-time AI that works with your team

IA na Saúde

Constrói soluções de saúde com modelos Ultralytics YOLO. A visão AI na saúde impulsiona imagens médicas mais rápidas, diagnósticos mais inteligentes e monitorização do paciente.
Sabe mais
Real-time AI that works with your team

IA na Fabricação

Otimize a fabricação com modelos Ultralytics YOLO. A IA de visão impulsiona o controle de qualidade, detecção de defeitos, conformidade com EPI e automação de linhas de montagem.
Sabe mais
Real-time AI that works with your operation

IA no Setor Automóvel

Aplica visão computacional no setor automóvel com modelos Ultralytics YOLO. A visão AI eleva a segurança rodoviária, a assistência ao condutor e a automação de veículos para estradas mais inteligentes.
Sabe mais
Real-time AI tailored to your operation

IA na Agricultura

Leva a visão AI para a agricultura inteligente com os modelos Ultralytics YOLO. Potencia a monitorização de culturas, o seguimento de gado e a agricultura de precisão para colheitas maiores e mais inteligentes.
Sabe mais
Real-time AI that works with your team

IA em robótica

Potencialize máquinas mais inteligentes com modelos Ultralytics YOLO. A IA de visão em robótica impulsiona a navegação autônoma, percepção, rastreamento de objetos e controle em tempo real.
Sabe mais
Real-time AI that works with your team

IA na Logística

Otimize a logística com modelos Ultralytics YOLO. A IA de visão permite a inspeção de pacotes, triagem, rastreamento de veículos e monitoramento de segurança em armazéns em tempo real.
Sabe mais
Real-time AI that works with your team

IA no varejo

Reinvente o varejo com modelos Ultralytics YOLO. A IA de visão impulsiona o rastreamento de inventário, monitoramento de prateleiras, gerenciamento de filas e percepções mais inteligentes sobre o cliente.
Sabe mais
Real-time AI that works with your team

IA na Saúde

Constrói soluções de saúde com modelos Ultralytics YOLO. A visão AI na saúde impulsiona imagens médicas mais rápidas, diagnósticos mais inteligentes e monitorização do paciente.
Sabe mais
Real-time AI that works with your team

IA na Fabricação

Otimize a fabricação com modelos Ultralytics YOLO. A IA de visão impulsiona o controle de qualidade, detecção de defeitos, conformidade com EPI e automação de linhas de montagem.
Sabe mais
Real-time AI that works with your operation

IA no Setor Automóvel

Aplica visão computacional no setor automóvel com modelos Ultralytics YOLO. A visão AI eleva a segurança rodoviária, a assistência ao condutor e a automação de veículos para estradas mais inteligentes.
Sabe mais
Real-time AI tailored to your operation

IA na Agricultura

Leva a visão AI para a agricultura inteligente com os modelos Ultralytics YOLO. Potencia a monitorização de culturas, o seguimento de gado e a agricultura de precisão para colheitas maiores e mais inteligentes.
Sabe mais
Real-time AI that works with your team

IA em robótica

Potencialize máquinas mais inteligentes com modelos Ultralytics YOLO. A IA de visão em robótica impulsiona a navegação autônoma, percepção, rastreamento de objetos e controle em tempo real.
Sabe mais
Real-time AI that works with your team

IA na Logística

Otimize a logística com modelos Ultralytics YOLO. A IA de visão permite a inspeção de pacotes, triagem, rastreamento de veículos e monitoramento de segurança em armazéns em tempo real.
Sabe mais
Real-time AI that works with your team

IA no varejo

Reinvente o varejo com modelos Ultralytics YOLO. A IA de visão impulsiona o rastreamento de inventário, monitoramento de prateleiras, gerenciamento de filas e percepções mais inteligentes sobre o cliente.
Sabe mais
Real-time AI that works with your team

IA na Saúde

Constrói soluções de saúde com modelos Ultralytics YOLO. A visão AI na saúde impulsiona imagens médicas mais rápidas, diagnósticos mais inteligentes e monitorização do paciente.
Sabe mais
Real-time AI that works with your team

IA na Fabricação

Otimize a fabricação com modelos Ultralytics YOLO. A IA de visão impulsiona o controle de qualidade, detecção de defeitos, conformidade com EPI e automação de linhas de montagem.
Sabe mais
Real-time AI that works with your operation

IA no Setor Automóvel

Aplica visão computacional no setor automóvel com modelos Ultralytics YOLO. A visão AI eleva a segurança rodoviária, a assistência ao condutor e a automação de veículos para estradas mais inteligentes.
Sabe mais
Real-time AI tailored to your operation

IA na Agricultura

Leva a visão AI para a agricultura inteligente com os modelos Ultralytics YOLO. Potencia a monitorização de culturas, o seguimento de gado e a agricultura de precisão para colheitas maiores e mais inteligentes.
Sabe mais

Vamos construir o futuro da IA juntos!

Começa a tua jornada com o futuro da aprendizagem automática