YOLO Vision 2026:
IA de visão

OpenAI o1: Uma nova série de modelos OpenAI para raciocínio de IA

Informa-te sobre os modelos OpenAI o1 recentemente lançados e o que os torna especiais. Também vamos analisar como funcionam e o seu impacto no futuro da IA.

ABAbirami Vina5 min read
OpenAI o1, uma nova série de modelos OpenAI para raciocínio de IA

A comunidade de IA tem andado a fervilhar de especulações sobre o próximo passo para os OpenAI’s GPT models, com muitos a referirem-se ao projeto como "Project Strawberry". A razão por trás disso é que, se deres prompt GPT-4o perguntando quantos R's existem na palavra "strawberry", ele dir-te-á que existem dois R's na palavra "strawberry". Pode parecer estranho, tendo em conta quão poderoso o GPT-4o é. No entanto, o modelo foi construído para processar o subtexto, e não as palavras exatas. Havia rumores de que o próximo modelo iria tentar resolver isto. Sam Altman alimentou ainda mais estes rumores ao publicar imagens de morangos na sua X (formerly known as Twitter) account.

Com o OpenAI’s latest announcement na quinta-feira, 12 de setembro, temos finalmente uma resposta à especulação! O OpenAI o1, uma nova série de modelos de IA concebidos para abrandar e pensar antes de responder, foi lançado. Curiosamente, o OpenAI o1 consegue raciocinar melhor e responder corretamente à pergunta sobre os morangos! Neste artigo, vamos discutir o que é o OpenAI o1, como funciona, onde pode ser utilizado e o que significa para o futuro da IA. Vamos começar!

An example of prompting OpenAI o1 about strawberries

Fig 1. Um exemplo de como fazer um prompt ao OpenAI o1 sobre morangos.

Novos avanços em IA pela OpenAI#

Em julho de 2024, os executivos da OpenAI partilharam que a investigação da OpenAI está a aproximar-se de um nível humano de resolução de problemas, referido como level 2 of AI. É claro que este nível se foca no raciocínio, uma vez que a OpenAI apresenta a sua nova série de modelos, o OpenAI o1, como pensando antes de responder. O OpenAI o1 é um novo LLM (large language model), um modelo de IA que compreende e gera texto semelhante ao humano através da aprendizagem de padrões a partir de quantidades massivas de dados linguísticos. Foi concebido para lidar com problemas complexos que exigem um raciocínio profundo.

OpenAI’s perspective on the stages of AI

Fig 2. Perspetiva da OpenAI sobre as etapas da IA.

O modelo foi treinado utilizando reinforcement learning, uma técnica em que o modelo aprende a tomar melhores decisões através de tentativa e erro, recebendo recompensas ou penalizações pelas suas ações. O algoritmo de reinforcement learning ajuda o modelo a pensar de forma mais eficaz, seguindo uma cadeia de pensamento. A OpenAI também partilhou que o performance do o1 continua a melhorar com mais reinforcement learning durante o treino e com mais tempo gasto a "pensar" durante a resolução de problemas, mostrando que tanto o treino alargado como o processamento ponderado ajudam a potenciar as capacidades do modelo.

Embora o OpenAI o1 seja um avanço significativo para o raciocínio complexo, ainda é um modelo inicial e carece de algumas funcionalidades que tornam o ChatGPT útil, tais como navegar na web ou carregar ficheiros e imagens. Para muitas tarefas comuns, o GPT-4o pode ainda ser mais capaz por enquanto. No entanto, o OpenAI o1 marca um grande passo em frente na capacidade da IA para lidar com raciocínio complexo, motivo pelo qual a OpenAI está a iniciar uma nova série e a chamá-la de OpenAI o1.

Como os novos modelos da OpenAI melhoram o raciocínio da IA#

O OpenAI o1 pode ser utilizado para tarefas como decifrar cifras, resolver desafios de programação, responder a problemas de matemática, resolver palavras cruzadas e até lidar com tópicos complexos em science, safety e healthcare. Num aceno divertido ao nome de código do projeto, a OpenAI demonstrou as reasoning skills do modelo ao quebrar uma cifra que revelou a mensagem "THERE ARE THREE R’S IN STRAWBERRY".

Além de resolver cifras, o OpenAI o1 também tem muita skill em programação. Tem um bom desempenho em desafios de programação competitiva, como os do Codeforces, uma plataforma onde os programadores resolvem problemas de código complexos sob condições cronometradas. Nestes desafios, o modelo alcança classificações Elo elevadas (um sistema de pontuação que mede os níveis de habilidade com base no desempenho contra outros concorrentes) e supera os modelos anteriores. Também se destaca em matemática e tem um bom desempenho em exams como o American Invitational Mathematics Examination (AIME).

Benchmarking o1’s coding abilities

Fig 3. Avaliação comparativa das capacidades de programação do o1.

Estes avanços posicionam o OpenAI o1 como uma atualização significativa em relação aos modelos anteriores, como o GPT-4o. Abre novas possibilidades para a IA em áreas como business, desenvolvimento, research e healthcare. Por exemplo, em genetics research, o OpenAI o1 pode analisar rapidamente um grande número de artigos de investigação, selecionando conclusões fundamentais e ligações entre marcadores genéticos e diseases. Compreende linguagem científica complexa e consegue resumir pontos importantes, ajudando os investigadores a concentrarem-se na informação mais relevante.

Um olhar mais atento à cadeia de pensamento#

Vimos anteriormente que o OpenAI o1 introduz um processo de raciocínio de "Cadeia de Pensamento". Permite que o modelo aborde problemas complexos de uma forma semelhante às estratégias cognitivas humanas. O modelo pode dividir os desafios em passos mais pequenos e geríveis e aperfeiçoar iterativamente a sua abordagem. Ao contrário dos models anteriores que dependiam do pattern recognition imediato, o o1 otimiza a sua tomada de decisões explorando múltiplos caminhos de raciocínio, aprendendo com os sucessos e os erros através de reinforcement learning.

A OpenAI decidiu manter estas cadeias de pensamento em bruto ocultas dos utilizadores, oferecendo em alternativa resumos que fornecem uma perspetiva sobre o raciocínio do modelo sem expor cada passo. Esta decisão ajuda a evitar a utilização indevida do processo de pensamento do modelo, permitindo ainda que os programadores monitorizem e aperfeiçoem a segurança e o alinhamento da IA. Ao observar as cadeias ocultas internamente, os programadores podem garantir que o o1 cumpre as ethical guidelines e evita comportamentos nocivos.

Benchmarking do OpenAI o1#

O OpenAI o1 apresenta melhorias significativas em relação ao GPT-4o em vários benchmarks que testam capacidades de raciocínio e resolução de problemas. No American Invitational Mathematics Examination (AIME) 2024, um exame de matemática desafiante para os melhores alunos do ensino secundário, o o1 atingiu uma taxa de precisão de 74% com apenas uma amostra por problema, em comparação com os 12% do GPT-4o. Com o consenso em 64 amostras, a sua precisão aumentou para 83% e, utilizando um método de reclassificação refinado com 1000 amostras, atingiu 93%, posicionando-o entre os 500 melhores alunos a nível nacional.

Além da matemática, o o1 também teve um desempenho excecional em benchmarks que testam o conhecimento científico, como o GPQA Diamond, que abrange questões de nível de doutoramento em química, physics e biology. Notavelmente, o o1 superou especialistas humanos com doutoramento neste teste, tornando-se o primeiro modelo de IA a fazê-lo. Também superou o GPT-4o em 54 de 57 categorias no benchmark MMLU, que testa a compreensão num conjunto diversificado de disciplinas, incluindo history, law e ciência.

Benchmarking OpenAI o1

Fig 4. Avaliação comparativa do OpenAI o1.

Experimenta o OpenAI o1#

A OpenAI apresentou dois novos modelos de IA na série o1: o1-preview e o1-mini. O modelo o1-preview foi concebido para pensar mais profundamente antes de responder, destacando-se em tarefas de raciocínio complexas em ciência, codificação e matemática. Oferece capacidades avançadas de resolução de problemas para utilizadores que enfrentam projetos desafiantes. Em contraste, o o1-mini é um modelo mais pequeno, mais rápido e mais rentável, otimizado especificamente para raciocínio STEM, particularmente matemática e codificação. Embora possa ter menos conhecimento geral do mundo, o o1-mini quase iguala o desempenho do o1-preview em avaliações chave como a competição de matemática AIME e os desafios de codificação do Codeforces, tudo com 80% menos custo.

Comparing OpenAI models

Fig 5. Comparação dos modelos OpenAI.

Podes experimentar estes modelos através de várias plataformas da OpenAI. Os utilizadores do ChatGPT Plus e Team podem aceder tanto ao o1-preview como ao o1-mini através do seletor de modelos, experienciando capacidades de raciocínio melhoradas diretamente no ChatGPT. Os programadores com acesso de nível 5 à API podem começar a criar protótipos com estes modelos, embora algumas funcionalidades avançadas ainda estejam em desenvolvimento. A OpenAI também planeia disponibilizar o o1-mini para todos os utilizadores do ChatGPT Free em breve. Ao explorares estes modelos, podes vivenciar em primeira mão os avanços no raciocínio da IA e escolher aquele que melhor se adapta às tuas necessidades.

Considerações éticas de IA feitas pela OpenAI#

A OpenAI focou-se na ethics and safety durante o desenvolvimento da série de modelos o1. Antes de lançar os modelos o1-preview e o1-mini, realizaram avaliações exaustivas, incluindo testes externos e verificações internas para riscos como conteúdos não permitidos, alucinações e viés. Os modelos foram concebidos com capacidades de raciocínio avançadas para melhor compreender e cumprir as regras de segurança.

A OpenAI também implementou salvaguardas como listas de bloqueio e classificadores de segurança para gerir os riscos. O modelo o1 tem uma classificação de risco global média. Apresenta riscos baixos em áreas como a cibersegurança e a autonomia do modelo, e riscos médios em áreas como conteúdos CBRN (Químicos, Biológicos, Radiológicos e Nucleares) e persuasão. O Safety Advisory Group e o Conselho de Administração da OpenAI analisaram estas safety measures para garantir que o modelo é seguro e ético de utilizar.

OpenAI o1 scorecard

Fig 6. Ficha de avaliação do OpenAI o1.

Dos rumores à realidade: o OpenAI o1 entra em cena#

O OpenAI o1 é um grande passo em frente no raciocínio da IA, transformando alguns dos primeiros rumores em realidade. Ao contrário do GPT-4o, a série o1 pensa mais profundamente ao usar uma abordagem de "Cadeia de Pensamento", dividindo problemas complexos em passos menores para melhores respostas. Atualmente disponível como uma pré-visualização inicial no ChatGPT e na API, a OpenAI planeia adicionar funcionalidades como navegação na web e carregamento de ficheiros e imagens. A OpenAI partilhou também que planeia continuar a desenvolver e lançar modelos na série GPT, juntamente com a nova série OpenAI o1. À medida que a IA continua a evoluir, avanços como estes estão a abrir caminho para sistemas de IA mais poderosos, intuitivos e versáteis que podem ajudar e compreender melhor as necessidades humanas.

Mantém-te a par das últimas novidades em IA juntando-te a our community! Dirige-te ao nosso GitHub repository para veres como estamos a ser pioneiros em soluções de IA em setores como manufacturing e healthcare. 🚀

Explore solutions

Real-time AI that works with your team

IA em robótica

Potencialize máquinas mais inteligentes com modelos Ultralytics YOLO. A IA de visão em robótica impulsiona a navegação autônoma, percepção, rastreamento de objetos e controle em tempo real.
Sabe mais
Real-time AI that works with your team

IA na Logística

Otimize a logística com modelos Ultralytics YOLO. A IA de visão permite a inspeção de pacotes, triagem, rastreamento de veículos e monitoramento de segurança em armazéns em tempo real.
Sabe mais
Real-time AI that works with your team

IA no varejo

Reinvente o varejo com modelos Ultralytics YOLO. A IA de visão impulsiona o rastreamento de inventário, monitoramento de prateleiras, gerenciamento de filas e percepções mais inteligentes sobre o cliente.
Sabe mais
Real-time AI that works with your team

IA na Saúde

Constrói soluções de saúde com modelos Ultralytics YOLO. A visão AI na saúde impulsiona imagens médicas mais rápidas, diagnósticos mais inteligentes e monitorização do paciente.
Sabe mais
Real-time AI that works with your team

IA na Fabricação

Otimize a fabricação com modelos Ultralytics YOLO. A IA de visão impulsiona o controle de qualidade, detecção de defeitos, conformidade com EPI e automação de linhas de montagem.
Sabe mais
Real-time AI that works with your operation

IA no Setor Automóvel

Aplica visão computacional no setor automóvel com modelos Ultralytics YOLO. A visão AI eleva a segurança rodoviária, a assistência ao condutor e a automação de veículos para estradas mais inteligentes.
Sabe mais
Real-time AI tailored to your operation

IA na Agricultura

Leva a visão AI para a agricultura inteligente com os modelos Ultralytics YOLO. Potencia a monitorização de culturas, o seguimento de gado e a agricultura de precisão para colheitas maiores e mais inteligentes.
Sabe mais
Real-time AI that works with your team

IA em robótica

Potencialize máquinas mais inteligentes com modelos Ultralytics YOLO. A IA de visão em robótica impulsiona a navegação autônoma, percepção, rastreamento de objetos e controle em tempo real.
Sabe mais
Real-time AI that works with your team

IA na Logística

Otimize a logística com modelos Ultralytics YOLO. A IA de visão permite a inspeção de pacotes, triagem, rastreamento de veículos e monitoramento de segurança em armazéns em tempo real.
Sabe mais
Real-time AI that works with your team

IA no varejo

Reinvente o varejo com modelos Ultralytics YOLO. A IA de visão impulsiona o rastreamento de inventário, monitoramento de prateleiras, gerenciamento de filas e percepções mais inteligentes sobre o cliente.
Sabe mais
Real-time AI that works with your team

IA na Saúde

Constrói soluções de saúde com modelos Ultralytics YOLO. A visão AI na saúde impulsiona imagens médicas mais rápidas, diagnósticos mais inteligentes e monitorização do paciente.
Sabe mais
Real-time AI that works with your team

IA na Fabricação

Otimize a fabricação com modelos Ultralytics YOLO. A IA de visão impulsiona o controle de qualidade, detecção de defeitos, conformidade com EPI e automação de linhas de montagem.
Sabe mais
Real-time AI that works with your operation

IA no Setor Automóvel

Aplica visão computacional no setor automóvel com modelos Ultralytics YOLO. A visão AI eleva a segurança rodoviária, a assistência ao condutor e a automação de veículos para estradas mais inteligentes.
Sabe mais
Real-time AI tailored to your operation

IA na Agricultura

Leva a visão AI para a agricultura inteligente com os modelos Ultralytics YOLO. Potencia a monitorização de culturas, o seguimento de gado e a agricultura de precisão para colheitas maiores e mais inteligentes.
Sabe mais
Real-time AI that works with your team

IA em robótica

Potencialize máquinas mais inteligentes com modelos Ultralytics YOLO. A IA de visão em robótica impulsiona a navegação autônoma, percepção, rastreamento de objetos e controle em tempo real.
Sabe mais
Real-time AI that works with your team

IA na Logística

Otimize a logística com modelos Ultralytics YOLO. A IA de visão permite a inspeção de pacotes, triagem, rastreamento de veículos e monitoramento de segurança em armazéns em tempo real.
Sabe mais
Real-time AI that works with your team

IA no varejo

Reinvente o varejo com modelos Ultralytics YOLO. A IA de visão impulsiona o rastreamento de inventário, monitoramento de prateleiras, gerenciamento de filas e percepções mais inteligentes sobre o cliente.
Sabe mais
Real-time AI that works with your team

IA na Saúde

Constrói soluções de saúde com modelos Ultralytics YOLO. A visão AI na saúde impulsiona imagens médicas mais rápidas, diagnósticos mais inteligentes e monitorização do paciente.
Sabe mais
Real-time AI that works with your team

IA na Fabricação

Otimize a fabricação com modelos Ultralytics YOLO. A IA de visão impulsiona o controle de qualidade, detecção de defeitos, conformidade com EPI e automação de linhas de montagem.
Sabe mais
Real-time AI that works with your operation

IA no Setor Automóvel

Aplica visão computacional no setor automóvel com modelos Ultralytics YOLO. A visão AI eleva a segurança rodoviária, a assistência ao condutor e a automação de veículos para estradas mais inteligentes.
Sabe mais
Real-time AI tailored to your operation

IA na Agricultura

Leva a visão AI para a agricultura inteligente com os modelos Ultralytics YOLO. Potencia a monitorização de culturas, o seguimento de gado e a agricultura de precisão para colheitas maiores e mais inteligentes.
Sabe mais

Vamos construir o futuro da IA juntos!

Começa a tua jornada com o futuro da aprendizagem automática