OpenAI o1: Yapay zekâda akıl yürütme için yeni bir OpenAI model serisi
Yeni piyasaya sürülen OpenAI o1 modelleri ve onları özel kılan özellikler hakkında bilgi edin. Ayrıca nasıl çalıştıklarına ve yapay zekânın geleceği üzerindeki etkilerine göz atacağız.

Yapay zekâ topluluğu, OpenAI’nin GPT modelleri için sıradaki adım hakkında spekülasyonlarla çalkalanıyordu; birçok kişi bundan “Project Strawberry” olarak bahsediyordu. Bunun nedeni, GPT-4o’ya "strawberry" kelimesinde kaç tane R olduğunu soran bir istem verdiğinde, kelimede iki R bulunduğunu söylemesidir: "strawberry." GPT-4o’nun ne kadar güçlü olduğu düşünüldüğünde bu garip görünebilir. Ancak model, tam olarak sözcükleri değil, alt metni işlemek üzere tasarlanmıştır. Bir sonraki modelin bunu çözmeyi amaçlayacağı söylentileri vardı. Sam Altman da X (eski adıyla Twitter) hesabında çilek fotoğrafları paylaşarak bu söylentileri daha da güçlendirdi.
12 Eylül Perşembe günü yapılan OpenAI’nin son duyurusuyla nihayet bu spekülasyonlara bir yanıt aldık! Yanıt vermeden önce yavaşlayıp düşünecek şekilde tasarlanan yeni bir yapay zekâ model serisi OpenAI o1 yayımlandı. İlginç bir şekilde OpenAI o1 daha iyi akıl yürütebiliyor ve çileklerle ilgili soruyu doğru yanıtlayabiliyor! Bu makalede OpenAI o1’in ne olduğunu, nasıl çalıştığını, nerelerde kullanılabileceğini ve yapay zekânın geleceği açısından ne anlama geldiğini ele alacağız. Hadi başlayalım!

Şekil 1. OpenAI o1’e çilekler hakkında istem verme örneği.
OpenAI’nin yapay zekâ alanındaki yeni gelişmeleri#
Temmuz 2024’te OpenAI yöneticileri, OpenAI’nin araştırmalarının yapay zekânın 2. seviyesinde ifade edilen, insan seviyesine yakın problem çözmeye yaklaştığını paylaştı. OpenAI, yeni model serisi OpenAI o1’i yanıt vermeden önce düşünen bir model olarak tanıttığı için bu seviyenin akıl yürütmeye odaklandığı açık. OpenAI o1, büyük miktarda dil verisinden örüntüleri öğrenerek insan benzeri metinleri anlayan ve üreten yeni bir LLM (büyük dil modeli) olan bir yapay zekâ modelidir. Derinlemesine akıl yürütme gerektiren karmaşık sorunları ele alacak şekilde tasarlanmıştır.

Şekil 2. OpenAI’nin yapay zekâ aşamalarına bakış açısı.
Model, pekiştirmeli öğrenme kullanılarak eğitildi; bu teknikte model, eylemleri karşılığında ödül veya ceza alarak deneme yanılma yoluyla daha iyi kararlar vermeyi öğrenir. Pekiştirmeli öğrenme algoritması, bir düşünce zincirini izleyerek modelin daha etkili düşünmesine yardımcı olur. OpenAI ayrıca o1’in performansının, eğitim sırasında daha fazla pekiştirmeli öğrenmeyle ve problem çözme sırasında "düşünmeye" daha fazla zaman ayırmasıyla gelişmeye devam ettiğini paylaştı; bu da hem uzun süreli eğitimin hem de dikkatli işlemenin modelin yeteneklerini artırmaya yardımcı olduğunu gösteriyor.
OpenAI o1 karmaşık akıl yürütme açısından önemli bir ilerleme olsa da hâlâ erken aşamadaki bir model ve ChatGPT’yi kullanışlı kılan web’de gezinme veya dosya ve görsel yükleme gibi bazı özelliklerden yoksun. Birçok yaygın görev için GPT-4o şimdilik hâlâ daha yetenekli olabilir. Ancak OpenAI o1, yapay zekânın karmaşık akıl yürütme becerisinde büyük bir ilerlemeye işaret ediyor; OpenAI’nin yeni bir seri başlatıp buna OpenAI o1 adını vermesinin nedeni de bu.
Yeni OpenAI modelleri yapay zekâda akıl yürütmeyi nasıl geliştiriyor?#
OpenAI o1; şifreleri çözme, programlama görevlerini tamamlama, matematik problemlerini yanıtlama, bulmacaları çözme ve hatta bilim, güvenlik ve sağlık alanlarındaki karmaşık konuları ele alma gibi görevlerde kullanılabilir. OpenAI, projenin kod adına eğlenceli bir gönderme yaparak, "THERE ARE THREE R’S IN STRAWBERRY." mesajını ortaya çıkaran bir şifreyi çözmesiyle modelin akıl yürütme becerilerini gösterdi.
Şifre çözmenin ötesinde OpenAI o1, kodlama konusunda da yetenekli. Programcıların süre sınırlaması altında karmaşık kodlama problemlerini çözdüğü bir platform olan Codeforces’taki yarışmalı programlama görevlerinde başarılı performans gösteriyor. Model, bu görevlerde yüksek Elo derecelendirmelerine (diğer yarışmacılara karşı performansa dayalı beceri düzeylerini ölçen bir puanlama sistemi) ulaşıyor ve önceki modelleri geride bırakıyor. Ayrıca matematikte de başarılı ve American Invitational Mathematics Examination (AIME) gibi sınavlarda iyi performans gösteriyor.

Şekil 3. o1’in kodlama yeteneklerinin kıyaslanması.
Bu gelişmeler, OpenAI o1’i GPT-4o gibi önceki modellere kıyasla önemli bir yükseltme konumuna getiriyor. Yapay zekâ için iş dünyası, geliştirme, araştırma ve sağlık gibi alanlarda yeni olanaklar sunuyor. Örneğin genetik araştırmalarında OpenAI o1, çok sayıda araştırma makalesini hızla inceleyerek temel bulguları ve genetik belirteçlerle hastalıklar arasındaki bağlantıları ayıklayabilir. Karmaşık bilimsel dili anlayabilir ve önemli noktaları özetleyerek araştırmacıların en ilgili bilgilere odaklanmasına yardımcı olabilir.
Düşünce zincirine daha yakından bakış#
Daha önce OpenAI o1’in bir "Düşünce Zinciri" akıl yürütme süreci sunduğunu görmüştük. Bu süreç, modelin karmaşık sorunları insan bilişsel stratejilerine benzer bir şekilde ele almasını sağlar. Model, zorlukları daha küçük ve yönetilebilir adımlara ayırabilir ve yaklaşımını yinelemeli olarak geliştirebilir. Anlık örüntü tanımaya dayanan önceki modellerin aksine o1, birden fazla akıl yürütme yolunu keşfederek ve pekiştirmeli öğrenme yoluyla hem başarılarından hem de hatalarından öğrenerek karar verme sürecini optimize eder.
OpenAI, ham düşünce zincirlerini kullanıcılardan gizli tutmaya; bunun yerine her adımı açığa çıkarmadan modelin akıl yürütmesi hakkında fikir veren özetler sunmaya karar verdi. Bu karar, geliştiricilerin yapay zekâ güvenliğini ve hizalamasını izlemesine ve geliştirmesine olanak tanırken modelin düşünce sürecinin kötüye kullanılmasını önlemeye yardımcı oluyor. Geliştiriciler, gizli zincirleri dahili olarak gözlemleyerek o1’in etik kurallara uyduğundan ve zararlı davranışlardan kaçındığından emin olabilir.
OpenAI o1’in kıyaslanması#
OpenAI o1, akıl yürütme ve problem çözme becerilerini test eden çeşitli kıyaslamalarda GPT-4o’ya kıyasla önemli gelişmeler gösteriyor. Başarılı lise öğrencileri için zorlu bir matematik sınavı olan American Invitational Mathematics Examination (AIME) 2024’te o1, problem başına yalnızca bir örnekle %74 doğruluk oranına ulaşırken GPT-4o %12’de kaldı. 64 örnek üzerindeki uzlaşıyla doğruluk oranı %83’e yükseldi; 1.000 örnekle iyileştirilmiş bir yeniden sıralama yöntemi kullanıldığında ise %93’e ulaşarak ülke genelindeki en iyi 500 öğrenci arasına girdi.
Matematiğin yanı sıra o1, kimya, fizik ve biyoloji alanlarında doktora düzeyindeki soruları kapsayan GPQA Diamond gibi bilimsel bilgiyi test eden kıyaslamalarda da olağanüstü başarılı oldu. Dikkat çekici biçimde o1, bu testte doktora derecesine sahip insan uzmanları geride bırakarak bunu başaran ilk yapay zekâ modeli oldu. Ayrıca çeşitli konulardaki anlayışı test eden MMLU kıyaslamasında, tarih, hukuk ve bilim de dâhil olmak üzere 57 kategorinin 54’ünde GPT-4o’yu geride bıraktı.

Şekil 4. OpenAI o1’in kıyaslanması.
OpenAI o1’i uygulamalı olarak deneyimle#
OpenAI, o1 serisinde iki yeni yapay zekâ modeli tanıttı: o1-preview ve o1-mini. o1-preview modeli, yanıt vermeden önce daha derin düşünmek üzere tasarlanmış olup bilim, kodlama ve matematik alanlarındaki karmaşık akıl yürütme görevlerinde başarılıdır. Zorlu projeler üzerinde çalışan kullanıcılara gelişmiş problem çözme yetenekleri sunar. Buna karşılık o1-mini, özellikle matematik ve kodlama başta olmak üzere STEM akıl yürütmesi için optimize edilmiş daha küçük, daha hızlı ve daha uygun maliyetli bir modeldir. Daha sınırlı genel dünya bilgisine sahip olabilse de o1-mini, AIME matematik yarışması ve Codeforces kodlama görevleri gibi temel değerlendirmelerde o1-preview’in performansına neredeyse ulaşırken maliyeti %80 daha düşüktür.

Şekil 5. OpenAI modellerinin karşılaştırılması.
Bu modelleri çeşitli OpenAI platformları üzerinden deneyebilirsin. ChatGPT Plus ve Team kullanıcıları, model seçici üzerinden hem o1-preview’e hem de o1-mini’a erişerek gelişmiş akıl yürütme yeteneklerini doğrudan ChatGPT içinde deneyimleyebilir. API kullanım katmanı 5 erişimine sahip geliştiriciler bu modellerle prototip oluşturmaya başlayabilir; ancak bazı gelişmiş özellikler hâlâ geliştirme aşamasında. OpenAI ayrıca o1-mini’ı yakında tüm ChatGPT Free kullanıcılarının kullanımına sunmayı planlıyor. Bu modelleri keşfederek yapay zekâda akıl yürütme alanındaki gelişmeleri doğrudan deneyimleyebilir ve ihtiyaçlarına en uygun olanı seçebilirsin.
OpenAI’nin etik yapay zekâ konusundaki değerlendirmeleri#
OpenAI, o1 model serisini geliştirirken etik ve güvenliğe odaklandı. o1-preview ve o1-mini modellerini yayımlamadan önce, harici testler ve izin verilmeyen içerik, halüsinasyonlar ve önyargı gibi risklere yönelik dahili kontroller dâhil olmak üzere kapsamlı değerlendirmeler gerçekleştirdi. Modeller, güvenlik kurallarını daha iyi anlamak ve bunlara uymak için gelişmiş akıl yürütme yetenekleriyle tasarlandı.
OpenAI, riskleri yönetmek için engelleme listeleri ve güvenlik sınıflandırıcıları gibi önlemler de uyguladı. o1 modelinin genel risk derecesi orta düzeydedir. Siber güvenlik ve model özerkliği gibi alanlarda düşük; CBRN (Kimyasal, Biyolojik, Radyolojik ve Nükleer) içerik ile ikna gibi alanlarda ise orta düzeyde risk taşır. OpenAI’nin Güvenlik Danışma Grubu ve Yönetim Kurulu, modelin güvenli ve etik biçimde kullanılmasını sağlamak amacıyla bu güvenlik önlemlerini inceledi.

Şekil 6. OpenAI o1 puan kartı.
Söylentilerden gerçeğe: OpenAI o1 sahneye çıkıyor#
OpenAI o1, yapay zekâda akıl yürütme açısından büyük bir ilerleme sağlayarak ilk söylentilerin bazılarını gerçeğe dönüştürüyor. GPT-4o’nun aksine o1 serisi, "Düşünce Zinciri" yaklaşımını kullanarak daha derin düşünüyor ve daha iyi yanıtlar vermek için karmaşık sorunları daha küçük adımlara ayırıyor. Şu anda ChatGPT ve API’de erken önizleme olarak sunulan OpenAI, web’de gezinme ve dosya ile görsel yükleme gibi özellikleri eklemeyi planlıyor. OpenAI ayrıca yeni OpenAI o1 serisinin yanı sıra GPT serisindeki modelleri geliştirmeye ve yayımlamaya devam etmeyi planladığını paylaştı. Yapay zekâ gelişmeye devam ederken bunun gibi ilerlemeler, insan ihtiyaçlarına daha iyi yardımcı olabilen ve bunları daha iyi anlayabilen daha güçlü, sezgisel ve çok yönlü yapay zekâ sistemlerinin önünü açıyor.
Topluluğumuza katılarak yapay zekâ alanındaki en son gelişmeleri takip et! GitHub depomuza göz atarak üretim ve sağlık gibi sektörlerde yapay zekâ çözümlerine nasıl öncülük ettiğimizi gör. 🚀









