Ultralytics YOLO27:
IA visual

OpenAI o1: una nueva serie de modelos de OpenAI para el razonamiento de AI

Descubre los modelos OpenAI o1 recién lanzados y qué los hace especiales. También veremos cómo funcionan y cuál es su impacto en el futuro de la AI.

ABAbirami Vina9 min read
OpenAI o1, una nueva serie de modelos de OpenAI para el razonamiento de AI

La comunidad de la IA no ha dejado de especular sobre el próximo paso de los modelos GPT de OpenAI, y muchos se referían a él como «Project Strawberry». El motivo es que, si le preguntas a GPT-4o cuántas R hay en la palabra «strawberry», te dirá que hay dos R. Puede parecer extraño, teniendo en cuenta lo potente que es GPT-4o. Sin embargo, el modelo está diseñado para procesar el subtexto, no las palabras exactas. Corría el rumor de que el próximo modelo intentaría resolver este problema. Sam Altman avivó aún más estos rumores al publicar imágenes de fresas en su cuenta de X (antes conocida como Twitter).

Con el último anuncio de OpenAI del jueves 12 de septiembre, ¡por fin tenemos una respuesta a las especulaciones! OpenAI o1, una nueva serie de modelos de IA diseñados para ralentizarse y pensar antes de responder, ya está disponible. Curiosamente, OpenAI o1 puede razonar mejor y responder correctamente a la pregunta sobre las fresas. En este artículo hablaremos de qué es OpenAI o1, cómo funciona, dónde se puede utilizar y qué significa para el futuro de la IA. ¡Empecemos!

Un ejemplo de cómo preguntar a OpenAI o1 sobre las fresas

Fig. 1. Un ejemplo de cómo preguntar a OpenAI o1 sobre las fresas.

Nuevos avances de OpenAI en IA#

En julio de 2024, los directivos de OpenAI compartieron que su investigación se acerca a un nivel humano de resolución de problemas, denominado nivel 2 de la IA. Está claro que este nivel se centra en el razonamiento, ya que OpenAI presenta su nueva serie de modelos, OpenAI o1, como un modelo que piensa antes de responder. OpenAI o1 es un nuevo modelo de lenguaje grande (LLM), un modelo de IA que entiende y genera texto similar al humano aprendiendo patrones a partir de enormes cantidades de datos lingüísticos. Se ha diseñado para abordar problemas complejos que requieren un razonamiento profundo.

La perspectiva de OpenAI sobre las etapas de la IA

Fig. 2. La perspectiva de OpenAI sobre las etapas de la IA.

El modelo se ha entrenado mediante aprendizaje por refuerzo, una técnica en la que el modelo aprende a tomar mejores decisiones mediante ensayo y error, recibiendo recompensas o penalizaciones por sus acciones. El algoritmo de aprendizaje por refuerzo ayuda al modelo a pensar de forma más eficaz siguiendo una cadena de pensamiento. OpenAI también compartió que el rendimiento de o1 sigue mejorando con un mayor aprendizaje por refuerzo durante el entrenamiento y con más tiempo dedicado a «pensar» durante la resolución de problemas, lo que demuestra que tanto un entrenamiento prolongado como un procesamiento reflexivo ayudan a potenciar las capacidades del modelo.

Aunque OpenAI o1 supone un avance importante en el razonamiento complejo, todavía es un modelo inicial y carece de algunas funciones que hacen útil a ChatGPT, como navegar por la web o cargar archivos e imágenes. Para muchas tareas habituales, GPT-4o puede seguir siendo más capaz por ahora. Sin embargo, OpenAI o1 marca un gran avance en la capacidad de la IA para abordar razonamientos complejos, por lo que OpenAI está iniciando una nueva serie y la denomina OpenAI o1.

Cómo los nuevos modelos de OpenAI mejoran el razonamiento de la IA#

OpenAI o1 se puede utilizar para tareas como descifrar códigos, resolver retos de programación, responder a problemas matemáticos, hacer crucigramas e incluso abordar temas complejos de ciencia, seguridad y asistencia sanitaria. Como guiño divertido al nombre en clave del proyecto, OpenAI mostró las capacidades de razonamiento del modelo haciendo que descifrara un código que revelaba el mensaje «THERE ARE THREE R’S IN STRAWBERRY.»

Además de descifrar códigos, OpenAI o1 también destaca en programación. Ofrece un buen rendimiento en retos de programación competitiva como los de Codeforces, una plataforma en la que los programadores resuelven problemas complejos de código en condiciones de tiempo limitado. En estos retos, el modelo alcanza puntuaciones Elo elevadas (un sistema de puntuación que mide los niveles de habilidad según el rendimiento frente a otros competidores) y supera a modelos anteriores. También destaca en matemáticas y obtiene buenos resultados en exámenes como el Examen Americano por Invitación de Matemáticas (AIME).

Evaluación comparativa de las capacidades de programación de o1

Fig. 3. Evaluación comparativa de las capacidades de programación de o1.

Estos avances convierten a OpenAI o1 en una mejora significativa respecto a modelos anteriores como GPT-4o. Abre nuevas posibilidades para la IA en ámbitos como los negocios, el desarrollo, la investigación y la asistencia sanitaria. Por ejemplo, en la investigación genética, OpenAI o1 puede revisar rápidamente un gran número de artículos de investigación, extrayendo hallazgos clave y conexiones entre marcadores genéticos y enfermedades. Entiende el lenguaje científico complejo y puede resumir los puntos importantes, ayudando a los investigadores a centrarse en la información más relevante.

Un análisis más detallado de la cadena de pensamiento#

Antes hemos visto que OpenAI o1 introduce un proceso de razonamiento de «Chain of Thought». Permite al modelo abordar problemas complejos de forma similar a las estrategias cognitivas humanas. El modelo puede dividir los retos en pasos más pequeños y manejables, y perfeccionar su enfoque de forma iterativa. A diferencia de los modelos anteriores, que se basaban en el reconocimiento inmediato de patrones, o1 optimiza su toma de decisiones explorando múltiples vías de razonamiento y aprendiendo tanto de los aciertos como de los errores mediante aprendizaje por refuerzo.

OpenAI ha decidido mantener ocultas para los usuarios estas cadenas de pensamiento sin procesar y ofrecer, en su lugar, resúmenes que aportan información sobre el razonamiento del modelo sin exponer cada paso. Esta decisión ayuda a evitar el uso indebido del proceso de pensamiento del modelo y, al mismo tiempo, permite a los desarrolladores supervisar y perfeccionar la seguridad y la alineación de la IA. Al observar internamente las cadenas ocultas, los desarrolladores pueden garantizar que o1 siga las directrices éticas y evite comportamientos perjudiciales.

Evaluación comparativa de OpenAI o1#

OpenAI o1 muestra mejoras importantes respecto a GPT-4o en varios benchmarks que ponen a prueba las capacidades de razonamiento y resolución de problemas. En el Examen Americano por Invitación de Matemáticas (AIME) de 2024, un exigente examen de matemáticas para estudiantes de secundaria con mejores resultados, o1 alcanzó una precisión del 74 % con una sola muestra por problema, frente al 12 % de GPT-4o. Con el consenso entre 64 muestras, su precisión aumentó hasta el 83 %, y mediante un método perfeccionado de reordenación con 1.000 muestras alcanzó el 93 %, situándose entre los 500 mejores estudiantes del país.

Además de en matemáticas, o1 obtuvo resultados excepcionales en benchmarks que evalúan conocimientos científicos, como GPQA Diamond, que incluye preguntas de nivel doctoral sobre química, física y biología. Sorprendentemente, o1 superó en esta prueba a expertos humanos con doctorado, convirtiéndose en el primer modelo de IA en lograrlo. También superó a GPT-4o en 54 de las 57 categorías del benchmark MMLU, que evalúa la comprensión de un conjunto diverso de materias, incluida la historia, el derecho y la ciencia.

Evaluación comparativa de OpenAI o1

Fig. 4. Evaluación comparativa de OpenAI o1.

Prueba OpenAI o1 por ti mismo#

OpenAI ha presentado dos nuevos modelos de IA en la serie o1: o1-preview y o1-mini. El modelo o1-preview está diseñado para pensar más profundamente antes de responder y destaca en tareas de razonamiento complejo en ciencia, programación y matemáticas. Ofrece capacidades avanzadas de resolución de problemas para usuarios que trabajan en proyectos exigentes. En cambio, o1-mini es un modelo más pequeño, rápido y rentable, optimizado específicamente para el razonamiento en STEM, especialmente en matemáticas y programación. Aunque puede tener un conocimiento general del mundo menos amplio, o1-mini iguala casi el rendimiento de o1-preview en evaluaciones clave como la competición matemática AIME y los retos de programación de Codeforces, con un coste un 80 % menor.

Comparación de los modelos de OpenAI

Fig. 5. Comparación de los modelos de OpenAI.

Puedes probar estos modelos a través de varias plataformas de OpenAI. Los usuarios de ChatGPT Plus y Team pueden acceder a o1-preview y o1-mini mediante el selector de modelos y experimentar directamente en ChatGPT unas capacidades de razonamiento mejoradas. Los desarrolladores con acceso al nivel 5 de uso de la API pueden empezar a crear prototipos con estos modelos, aunque algunas funciones avanzadas todavía están en desarrollo. OpenAI también tiene previsto hacer que o1-mini esté disponible pronto para todos los usuarios de ChatGPT Free. Al explorar estos modelos, puedes experimentar de primera mano los avances en el razonamiento de la IA y elegir el que mejor se adapte a tus necesidades.

Consideraciones sobre la IA ética de OpenAI#

OpenAI se ha centrado en la ética y la seguridad durante el desarrollo de la serie de modelos o1. Antes de lanzar los modelos o1-preview y o1-mini, realizó evaluaciones exhaustivas, incluidas pruebas externas y comprobaciones internas de riesgos como contenido no permitido, alucinaciones y sesgos. Los modelos están diseñados con capacidades avanzadas de razonamiento para comprender y seguir mejor las normas de seguridad.

OpenAI también ha implementado medidas de protección, como listas de bloqueo y clasificadores de seguridad, para gestionar los riesgos. El modelo o1 tiene una calificación de riesgo general media. Presenta riesgos bajos en ámbitos como la ciberseguridad y la autonomía del modelo, y riesgos medios en áreas como el contenido CBRN (químico, biológico, radiológico y nuclear) y la persuasión. El Grupo Asesor de Seguridad y el Consejo de OpenAI han revisado estas medidas de seguridad para garantizar que el modelo sea seguro y ético.

Ficha de evaluación de OpenAI o1

Fig. 6. Ficha de evaluación de OpenAI o1.

De los rumores a la realidad: OpenAI o1 sube al escenario#

OpenAI o1 supone un gran avance en el razonamiento de la IA y convierte algunos de los primeros rumores en realidad. A diferencia de GPT-4o, la serie o1 piensa más profundamente mediante un enfoque de «Chain of Thought», descomponiendo los problemas complejos en pasos más pequeños para ofrecer mejores respuestas. Actualmente disponible como una versión preliminar en ChatGPT y la API, OpenAI tiene previsto añadir funciones como la navegación web y la carga de archivos e imágenes. OpenAI también ha compartido que planea seguir desarrollando y lanzando modelos de la serie GPT junto con la nueva serie OpenAI o1. A medida que la IA continúa evolucionando, avances como estos allanan el camino hacia sistemas de IA más potentes, intuitivos y versátiles, capaces de ayudar mejor a las personas y comprender sus necesidades.

¡Mantente al día de las últimas novedades en IA uniéndote a nuestra comunidad! Visita nuestro repositorio de GitHub para descubrir cómo estamos impulsando soluciones de IA en sectores como la fabricación y la asistencia sanitaria. 🚀

Explore solutions

Visión por computadora para imágenes aéreas

Visión por computadora para imágenes aéreas

Transforma imágenes de drones y aéreas en información en tiempo real para agricultura, acuicultura, supervisión ambiental, conservación y análisis geoespacial con Ultralytics YOLO.
Más información
Visión artificial en la industria aeroespacial

Visión artificial en la industria aeroespacial

Lleva la IA de visión al monitoreo aéreo con los modelos Ultralytics YOLO. Potencia drones, flujos de trabajo aeroespaciales, conservación ambiental e industrias geoespaciales con soluciones de visión artificial.
Más información

Protege cada sitio con los modelos Ultralytics YOLO. La IA de visión potencia el monitoreo perimetral, la detección de amenazas, el reconocimiento de matrículas y la seguridad laboral.
Más información
Visión artificial en robótica

Visión artificial en robótica

Impulsa máquinas más inteligentes con los modelos de Ultralytics YOLO. La IA de visión en robótica permite la navegación autónoma, la percepción, el seguimiento de objetos y el control en tiempo real.
Más información
Visión artificial en logística

Visión artificial en logística

Optimiza la logística con los modelos de Ultralytics YOLO. La IA de visión permite inspeccionar paquetes, clasificarlos, realizar el seguimiento de vehículos y supervisar la seguridad de los almacenes en tiempo real.
Más información
Visión artificial en comercio minorista

Visión artificial en comercio minorista

Reinventa el comercio minorista con los modelos de Ultralytics YOLO. La IA de visión impulsa el seguimiento del inventario, la supervisión de estanterías, la gestión de colas y un conocimiento más inteligente de los clientes.
Más información
Visión por computador en el sector sanitario

Visión por computador en el sector sanitario

Crea soluciones sanitarias con modelos de Ultralytics YOLO. La IA de visión en el sector sanitario permite obtener imágenes médicas más rápidamente, diagnósticos más inteligentes y supervisar a los pacientes.
Más información
Visión por computador en la fabricación

Visión por computador en la fabricación

Optimiza la fabricación con modelos de Ultralytics YOLO. La IA de visión impulsa el control de calidad, la detección de defectos, el cumplimiento del PPE y la automatización de las líneas de montaje.
Más información
Visión artificial en el sector automovilístico

Visión artificial en el sector automovilístico

Aplica visión artificial en el sector automovilístico con modelos de Ultralytics YOLO. La IA de visión mejora la seguridad vial, la asistencia al conductor y la automatización de vehículos para conseguir carreteras más inteligentes.
Más información
Visión artificial en agricultura

Visión artificial en agricultura

Lleva la IA de visión a la agricultura inteligente con modelos de Ultralytics YOLO. Impulsa la supervisión de cultivos, el seguimiento del ganado y la agricultura de precisión para obtener cosechas mayores e inteligentes.
Más información
Visión por computadora para imágenes aéreas

Visión por computadora para imágenes aéreas

Transforma imágenes de drones y aéreas en información en tiempo real para agricultura, acuicultura, supervisión ambiental, conservación y análisis geoespacial con Ultralytics YOLO.
Más información
Visión artificial en la industria aeroespacial

Visión artificial en la industria aeroespacial

Lleva la IA de visión al monitoreo aéreo con los modelos Ultralytics YOLO. Potencia drones, flujos de trabajo aeroespaciales, conservación ambiental e industrias geoespaciales con soluciones de visión artificial.
Más información

Protege cada sitio con los modelos Ultralytics YOLO. La IA de visión potencia el monitoreo perimetral, la detección de amenazas, el reconocimiento de matrículas y la seguridad laboral.
Más información
Visión artificial en robótica

Visión artificial en robótica

Impulsa máquinas más inteligentes con los modelos de Ultralytics YOLO. La IA de visión en robótica permite la navegación autónoma, la percepción, el seguimiento de objetos y el control en tiempo real.
Más información
Visión artificial en logística

Visión artificial en logística

Optimiza la logística con los modelos de Ultralytics YOLO. La IA de visión permite inspeccionar paquetes, clasificarlos, realizar el seguimiento de vehículos y supervisar la seguridad de los almacenes en tiempo real.
Más información
Visión artificial en comercio minorista

Visión artificial en comercio minorista

Reinventa el comercio minorista con los modelos de Ultralytics YOLO. La IA de visión impulsa el seguimiento del inventario, la supervisión de estanterías, la gestión de colas y un conocimiento más inteligente de los clientes.
Más información
Visión por computador en el sector sanitario

Visión por computador en el sector sanitario

Crea soluciones sanitarias con modelos de Ultralytics YOLO. La IA de visión en el sector sanitario permite obtener imágenes médicas más rápidamente, diagnósticos más inteligentes y supervisar a los pacientes.
Más información
Visión por computador en la fabricación

Visión por computador en la fabricación

Optimiza la fabricación con modelos de Ultralytics YOLO. La IA de visión impulsa el control de calidad, la detección de defectos, el cumplimiento del PPE y la automatización de las líneas de montaje.
Más información
Visión artificial en el sector automovilístico

Visión artificial en el sector automovilístico

Aplica visión artificial en el sector automovilístico con modelos de Ultralytics YOLO. La IA de visión mejora la seguridad vial, la asistencia al conductor y la automatización de vehículos para conseguir carreteras más inteligentes.
Más información
Visión artificial en agricultura

Visión artificial en agricultura

Lleva la IA de visión a la agricultura inteligente con modelos de Ultralytics YOLO. Impulsa la supervisión de cultivos, el seguimiento del ganado y la agricultura de precisión para obtener cosechas mayores e inteligentes.
Más información
Visión por computadora para imágenes aéreas

Visión por computadora para imágenes aéreas

Transforma imágenes de drones y aéreas en información en tiempo real para agricultura, acuicultura, supervisión ambiental, conservación y análisis geoespacial con Ultralytics YOLO.
Más información
Visión artificial en la industria aeroespacial

Visión artificial en la industria aeroespacial

Lleva la IA de visión al monitoreo aéreo con los modelos Ultralytics YOLO. Potencia drones, flujos de trabajo aeroespaciales, conservación ambiental e industrias geoespaciales con soluciones de visión artificial.
Más información

Protege cada sitio con los modelos Ultralytics YOLO. La IA de visión potencia el monitoreo perimetral, la detección de amenazas, el reconocimiento de matrículas y la seguridad laboral.
Más información
Visión artificial en robótica

Visión artificial en robótica

Impulsa máquinas más inteligentes con los modelos de Ultralytics YOLO. La IA de visión en robótica permite la navegación autónoma, la percepción, el seguimiento de objetos y el control en tiempo real.
Más información
Visión artificial en logística

Visión artificial en logística

Optimiza la logística con los modelos de Ultralytics YOLO. La IA de visión permite inspeccionar paquetes, clasificarlos, realizar el seguimiento de vehículos y supervisar la seguridad de los almacenes en tiempo real.
Más información
Visión artificial en comercio minorista

Visión artificial en comercio minorista

Reinventa el comercio minorista con los modelos de Ultralytics YOLO. La IA de visión impulsa el seguimiento del inventario, la supervisión de estanterías, la gestión de colas y un conocimiento más inteligente de los clientes.
Más información
Visión por computador en el sector sanitario

Visión por computador en el sector sanitario

Crea soluciones sanitarias con modelos de Ultralytics YOLO. La IA de visión en el sector sanitario permite obtener imágenes médicas más rápidamente, diagnósticos más inteligentes y supervisar a los pacientes.
Más información
Visión por computador en la fabricación

Visión por computador en la fabricación

Optimiza la fabricación con modelos de Ultralytics YOLO. La IA de visión impulsa el control de calidad, la detección de defectos, el cumplimiento del PPE y la automatización de las líneas de montaje.
Más información
Visión artificial en el sector automovilístico

Visión artificial en el sector automovilístico

Aplica visión artificial en el sector automovilístico con modelos de Ultralytics YOLO. La IA de visión mejora la seguridad vial, la asistencia al conductor y la automatización de vehículos para conseguir carreteras más inteligentes.
Más información
Visión artificial en agricultura

Visión artificial en agricultura

Lleva la IA de visión a la agricultura inteligente con modelos de Ultralytics YOLO. Impulsa la supervisión de cultivos, el seguimiento del ganado y la agricultura de precisión para obtener cosechas mayores e inteligentes.
Más información

¡Construyamos juntos el futuro de la IA!

Comienza tu recorrido hacia el futuro del aprendizaje automático