En yeni OpenAI güncellemeleri: Canvas, görme için ince ayar ve daha fazlası
OpenAI tarafından yayınlanan son ChatGPT güncellemelerine yakından bakalım. Canvas'ı, görme yetenekleri için ince ayarı ve en yeni Search özelliğini inceleyeceğiz.

Eylül ayında OpenAI'ın o1 modellerine (akıl yürütmeyi geliştirmek üzere tasarlanmışlardı) son baktığımızdan bu yana ChatGPT'ye birçok yeni ve heyecan verici özellik eklendi. Bu sürümlerin bazıları geliştiricilere yönelikken diğerleri kullanıcı deneyimini iyileştirmek üzere tasarlandı. Genel olarak her yükseltme, ChatGPT ile etkileşimleri daha sezgisel ve etkili hâle getiriyor.
İş birliğine dayalı yazma ve kodlama için tasarlanan Canvas ve ChatGPT'nin görsellerle çalışma biçimini iyileştiren görsel yetenekler için ince ayar gibi güncellemeler büyük ilgi uyandırarak kullanıcıları daha yaratıcı olasılıkları keşfetmeye teşvik etti. Bu sırada yeni API'ler ve adalet testi raporları gibi teknik yükseltmeler, model entegrasyonu ve etik yapay zekâ uygulamaları gibi konuları ele alıyor. Haydi, OpenAI'ın en yeni ChatGPT özelliklerini daha iyi anlamak için ayrıntılara bakalım!
OpenAI'ın Canvas özelliğine genel bakış#
Canvas, ChatGPT'nin kullanıma sunulmasından bu yana kullanıcı arayüzündeki (UI) ilk büyük güncellemedir. Sol kenar çubuğunda istemlerin, sağ taraftaki pencerede ise yanıtların yer aldığı iki ekranlı yeni bir arayüzdür. Yeni UI, sohbet benzeri tek ekranlı alışılmış iş akışını ortadan kaldırıyor ve üretkenliği artırmak üzere çoklu görevlere uygun iki ekranlı bir düzene geçiyor.

Şekil 1. Canvas, ChatGPT'ye UI güncellemeleri getiriyor.
Canvas kullanıma sunulmadan önce ChatGPT'de uzun biçimli belgelerle çalışmak, ekranı epeyce aşağı ve yukarı kaydırmayı gerektiriyordu. Yeni düzende istemler sol kenar çubuğunda gösteriliyor, metin belgesi veya kod parçacığı ise ekranın büyük bölümünü kaplıyor. Gerekirse sol kenar çubuğunun ve çıktı ekranının boyutunu da özelleştirebilirsin. Ayrıca metnin bir bölümünü veya kodun bir kısmını seçerek belgenin tamamını değiştirmeden yalnızca ilgili bölümü düzenleyebilirsin.

Şekil 2. Canvas kullanılarak metnin belirli bölümlerini düzenleme.
Canvas kullanıyorsan ChatGPT arayüzünde onu açmaya yarayan belirli bir düğme veya geçiş olmadığını fark edeceksin. Bunun yerine GPT-4o modeliyle çalışırken düzenleme, yazma veya kodlama yaptığını algılarsa Canvas otomatik olarak açılır. Daha basit istemlerde etkin kalmaz. Manuel olarak açmak istersen "Open the Canvas" veya "Get me the Canvas layout" gibi istemleri kullanabilirsin.
Canvas şu anda beta aşamasında ve yalnızca GPT-4o ile kullanılabiliyor. Ancak OpenAI, beta aşamasından çıktığında Canvas'ın tüm ücretsiz kullanıcıların kullanımına sunulacağını belirtti.
ChatGPT API güncellemeleri#
OpenAI verimliliği, ölçeklenebilirliği ve çok yönlülüğü artırmayı amaçlayan üç yeni ChatGPT API güncellemesi yayımladı. Bu güncellemelerin her birine daha yakından bakalım.
Model damıtma#
OpenAI API'leri aracılığıyla Model Damıtma özelliğini kullanan geliştiriciler, GPT-4o veya o1-preview gibi gelişmiş modellerin çıktılarını kullanarak GPT-4o mini gibi daha küçük ve maliyet açısından verimli modellerin performansını artırabilir. Model damıtma, daha küçük modelleri daha gelişmiş modellerin davranışını taklit edecek şekilde eğitmeyi içeren bir süreçtir ve bu modelleri belirli görevler için daha verimli hâle getirir.
Bu özellik kullanıma sunulmadan önce geliştiricilerin çeşitli görevleri farklı araçları kullanarak manuel olarak koordine etmesi gerekiyordu. Bu görevler arasında veri kümeleri oluşturmak, model performansını ölçmek ve modellerde ince ayar yapmak yer alıyordu; bu da süreci çoğu zaman karmaşık ve hataya açık hâle getiriyordu. Model Distillation güncellemesi, geliştiricilerin Stored Completions aracını kullanarak API üzerinden gelişmiş modeller tarafından üretilen girdi-çıktı çiftlerini yakalayıp depolamasına ve otomatik olarak veri kümeleri oluşturmasına olanak tanıyor.
Model Distillation'ın bir diğer özelliği olan Evals (şu anda beta aşamasında), özel değerlendirme betikleri oluşturmaya veya ayrı araçlar kullanmaya gerek kalmadan bir modelin belirli görevlerde ne kadar iyi performans gösterdiğini ölçmeye yardımcı olur. Geliştiriciler, Stored Completions ile oluşturulan veri kümelerini ve Evals ile performans değerlendirmesini kullanarak kendi özel GPT modellerinde ince ayar yapabilir.

Şekil 3. Model performansını ölçmek için Evals'ı kullanabilirsin.
İstem önbelleğe alma#
Yapay zekâ uygulamaları, özellikle de sohbet botları oluştururken, mevcut isteği anlamak için gereken aynı bağlam (arka plan bilgileri veya önceki konuşma geçmişi) çoğu zaman birden fazla API çağrısında tekrar tekrar kullanılır. İstem Önbelleğe Alma, geliştiricilerin yakın zamanda kullanılan girdi belirteçlerini (modelin istemi anlamak ve yanıt oluşturmak için işlediği metin bölümlerini) yeniden kullanmasını mümkün kılarak maliyeti ve gecikmeyi azaltmaya yardımcı olur.
OpenAI, 1 Ekim'den itibaren Prompt Caching'i GPT-4o, GPT-4o mini, o1-preview ve o1-mini gibi modellerine otomatik olarak uyguladı. Bu, geliştiriciler uzun bir istemle (1.024 belirteçten uzun) bir modelle etkileşim kurmak için API'yi kullandığında sistemin daha önce işlediği bölümleri kaydettiği anlamına geliyor.
Bu sayede aynı veya benzer istemler tekrar kullanılırsa sistem bu bölümleri yeniden hesaplamayı atlayabilir. Sistem, daha önce karşılaştığı istemin en uzun bölümünü otomatik olarak önbelleğe alır; 1.024 belirteçle başlar ve istem uzadıkça 128 belirteçlik parçalar ekler.
Realtime API#
Bir sesli asistan oluşturmak genellikle sesi metne dönüştürmeyi, metni işlemeyi ve ardından yanıtı çalınacak sese dönüştürmeyi gerektirir. OpenAI'ın Realtime API'si bu sürecin tamamını tek bir API isteğiyle gerçekleştirmeyi amaçlıyor. API, süreci basitleştirerek yapay zekâ ile gerçek zamanlı konuşmalar yapılmasını sağlıyor.
Örneğin Realtime API ile entegre bir sesli asistan, kullanıcı isteklerine göre sipariş verme veya bilgi bulma gibi belirli işlemleri gerçekleştirebilir. API, sesli asistanı daha duyarlı hâle getirir ve kullanıcıların ihtiyaçlarına hızla uyum sağlamasına olanak tanır. Realtime API, 1 Ekim'de altı sesle genel beta üzerinden kullanıma sunuldu. 30 Ekim'de beş ses daha eklendi ve kullanılabilir seslerin toplamı on bire çıktı.

Şekil 4. Yeni bir dilde konuşma pratiği yapmak için Realtime API kullanımına bir örnek.
Görsel görevler için ChatGPT'de ince ayar yapma#
Başlangıçta GPT-4o görsel dil modelinde yalnızca metin içeren veri kümeleri kullanılarak ince ayar yapılabiliyor ve model özelleştirilebiliyordu. Şimdi görsel ince ayar API'sinin yayımlanmasıyla geliştiriciler, görsel veri kümelerini kullanarak GPT-4o'yu eğitebilir ve özelleştirebilir. Kullanıma sunulmasından bu yana görsel ince ayar, geliştiriciler ve bilgisayarlı görü mühendisleri arasında önemli bir ilgi konusu hâline geldi.
GPT-4o'nun görsel yeteneklerinde ince ayar yapmak için geliştiriciler, 100 kadar az veya 50.000 kadar çok görüntü içeren veri kümelerini kullanabilir. Veri kümesinin OpenAI'ın gerektirdiği biçime uygun olduğu doğrulandıktan sonra OpenAI platformuna yüklenebilir ve model belirli uygulamalar için ince ayarlanabilir.
Örneğin bir otomasyon şirketi olan Automat, ekrandaki UI öğelerini bir açıklamaya göre tanımlayabilmesi için GPT-4o'yu eğitmek amacıyla ekran görüntülerinden oluşan bir veri kümesi kullandı. Bu, botların kullanıcı arayüzleriyle etkileşim kurmasını kolaylaştırarak Robotik Süreç Otomasyonu (RPA) süreçlerini iyileştirir. Model, sabit koordinatlara veya karmaşık seçici kurallarına bağlı kalmak yerine UI öğelerini basit açıklamalara göre tanımlayabilir; bu da otomasyon kurulumlarını daha uyarlanabilir hâle getirir ve arayüzler değiştiğinde bakımlarını kolaylaştırır.

Şekil 5. UI öğelerini algılamak için GPT-4o modelinin ince ayarlanmış bir sürümünün kullanımı.
ChatGPT'de adalet ve önyargı tespiti#
Yapay zekâ giderek daha gelişmiş hâle geldikçe yapay zekâ uygulamalarını çevreleyen etik kaygılar önemli bir tartışma konusu oluyor. ChatGPT'nin yanıtları kullanıcıların sağladığı istemlere ve İnternet'te bulunan verilere dayandığından, dilini her zaman sorumlu olacak şekilde ince ayarlamak zor olabilir. Raporlara göre ChatGPT'nin yanıtları isim, cinsiyet ve ırk temelinde önyargılı. OpenAI'ın kurum içi ekibi bu sorunu ele almak için birinci şahıs adalet testi gerçekleştirdi.
İsimler çoğu zaman kültürümüz ve coğrafi faktörler hakkında ince ipuçları taşır. Çoğu durumda ChatGPT, isimlerdeki ince ipuçlarını göz ardı eder. Ancak bazı durumlarda ırkı veya kültürü yansıtan isimler ChatGPT'den farklı yanıtlar alınmasına yol açar ve bu yanıtların yaklaşık %1'i zararlı dil içerir. Önyargıları ve zararlı dili ortadan kaldırmak bir dil modeli için zorlu bir görevdir. Bununla birlikte OpenAI, bu bulguları kamuya açık şekilde paylaşarak ve modelin sınırlamalarını kabul ederek kullanıcıların daha tarafsız yanıtlar elde etmek için istemlerini iyileştirmesine yardımcı oluyor.

Şekil 6. Kullanıcının adı nedeniyle farklı yanıtların ortaya çıkmasına bir örnek.
ChatGPT aramasını anlamak#
ChatGPT ilk kullanıma sunulduğunda yapay zekâ topluluğunda, geleneksel web taramasının yerini alıp alamayacağı tartışılıyordu. Artık birçok kullanıcı Google Search yerine ChatGPT kullanıyor.
OpenAI'ın yeni güncellemesi olan Search özelliği bunu bir adım ileri taşıyor. Search ile ChatGPT güncel yanıtlar oluşturuyor ve ilgili kaynaklara bağlantılar ekliyor. 31 Ekim itibarıyla Search özelliği tüm ChatGPT Plus ve Team kullanıcılarının kullanımına sunuldu; böylece ChatGPT yapay zekâ destekli bir arama motoru gibi çalışıyor.

Şekil 7. ChatGPT'nin yeni Search özelliğinin kullanımına bir örnek.
Geleceğe bakış#
ChatGPT'nin son güncellemeleri yapay zekâyı daha kullanışlı, esnek ve adil hâle getirmeye odaklanıyor. Yeni Canvas özelliği kullanıcıların daha verimli çalışmasına yardımcı olurken görsel ince ayar, geliştiricilerin görsel görevleri daha iyi ele alacak şekilde modelleri özelleştirmesine olanak tanıyor. Adaleti ele almak ve önyargıyı azaltmak da temel öncelikler arasında yer alıyor; böylece yapay zekânın kim olduklarından bağımsız olarak herkes için iyi çalışması sağlanıyor. İster modellerde ince ayar yapan bir geliştirici ol ister yalnızca en yeni özellikleri kullanıyor ol, ChatGPT çok çeşitli ihtiyaçları karşılamak üzere gelişiyor. Gerçek zamanlı yetenekler, görsel entegrasyon ve sorumlu kullanıma odaklanma sayesinde bu güncellemeler herkes için daha güvenilir ve sağlam bir yapay zekâ deneyimi oluşturuyor.
GitHub depomuzu ziyaret ederek ve topluluğumuza katılarak yapay zekâ hakkında daha fazla bilgi edin. Otonom sürüş ve sağlık hizmetlerinde yapay zekâ uygulamaları hakkında daha fazlasını öğren.









