ChatGPT-5.6 Yeni yapay zeka kendi kod hatalarını bakıp kendisi düzeltiyor

ChatGPT-5.6 Yeni yapay zeka kendi kod hatalarını bakıp kendisi düzeltiyor

OpenAI, yeni nesil yapay zeka serisi GPT-5.6'yı duyurdu. Sol, Terra ve Luna adı verilen üç farklı model; kodlama, siber güvenlik ve kurumsal iş süreçlerinde hız ile maliyet avantajı sunuyor. Paralel çalışan yapay zeka ajanları ve gelişmiş tasarım yetenekleriyle dikkat çeken sistem, ChatGPT ve API altyapısı üzerinden kullanıcılara sunuldu.

Amerika Birleşik Devletleri (ABD) merkezli teknoloji devi OpenAI, kodlama, profesyonel iş akışları, tasarım, bilimsel araştırma ve siber güvenlik alanlarına odaklanan yeni GPT-5.6 model ailesini tanıttı.

Şirket; amiral gemisi Sol, dengeli fiyat-performans dengesi sunan Terra ve yüksek hızlı, düşük maliyetli Luna olmak üzere üç farklı yapay zeka seçeneğini ekosisteme kazandırdı.

Sınırlı ön izleme sürecinin tamamlanmasıyla birlikte yeni altyapı ChatGPT, Codex ve OpenAI Uygulama Programlama Arayüzü (API) üzerinden erişime açıldı.

Sistem, harcanan her bir işlem biriminden maksimum çıktı elde etmeyi amaçlıyor.

MAX VE ULTRA MODLARIYLA ÇOKLU AJAN DEVRİ

Ürün gamının en gelişmiş versiyonu olan GPT-5.6 Sol; karmaşık yazılım projeleri, bilgiye dayalı profesyonel süreçler ve bilimsel analizler için özel olarak yapılandırıldı.

Terra günlük kurumsal operasyonlara odaklanırken, Luna ise ailenin en seri seçeneği olarak öne çıkıyor.

Şirket, bu üç ismi kalıcı yetenek seviyeleri olarak konumlandırıyor.

Modellerle beraber Max ve Ultra adlı iki yeni çalışma modu da kullanıcılara sunuldu.

Max modu alternatif çözümleri değerlendirmek için modele ek hesaplama süresi verirken; Ultra modu ise varsayılan olarak dört farklı yapay zeka ajanını eş zamanlı çalıştırarak karmaşık işleri bölüştürüyor ve tek raporda birleştiriyor.

chatgpt-5-6-muhakeme-yetenegi-nasil-1.jpg

KODLAMA TESTLERİNDE ANTHROPIC MODELİNE BÜYÜK FARK

Yazılım geliştirme performansında doğrudan Anthropic firmasını hedef alan OpenAI, Sol versiyonunu bugüne kadarki en güçlü kodlama modeli şeklinde tanımladı.

Yapılan Artificial Analysis Coding Agent Index testinde Sol, 80 puana ulaşarak rakibi Claude Fable 5 modelini 2,8 puan geride bıraktı.

Bu üstün başarı, rakibine kıyasla yarıdan az girdi-çıktı birimi kullanılarak, yarı yarıya daha kısa sürede ve yaklaşık üçte bir maliyetle yakalandı.

Aynı test kulvarında Terra modeli Fable 5 seviyesini aşarken, Luna versiyonu ise Claude Opus 4.8 modelinin üzerine çıkmayı başardı.

chatgpt-5-6-muhakeme-yetenegi-nasil-2.jpg

AKILLI ARAÇ ÇAĞIRMAYLA VERİMLİLİK ARTTI

Sistemde yer alan programatik araç çağırma yeteneği sayesinde model, mikro programlar yazarak farklı sistemleri koordine edebiliyor ve ara sonuçları işleyerek bir sonraki hamleyi kendisi seçiyor.

Geliştiricilerin her bir işlem basamağını önceden kodlama veya veri akışını manuel yönetme zorunluluğunu ortadan kaldıran bu yöntem, uzun soluklu işlerde işlem maliyetlerini ciddi oranda düşürüyor.

Tasarım tarafında ise doğal dille verilen komutlardan çalışan web kullanıcı arayüzü (UI) oluşturan model, görsel denetim yaparak kullanım hatalarını kendi kendine düzeltebiliyor.

chatgpt-5-6-muhakeme-yetenegi-nasil-3.jpg

DOKÜMAN VE TABLO YÖNETİMİNDE YÜKSEK HASSASİYET

Sunum, belge ve elektronik tablo hazırlama süreçlerinde de seviye atlayan teknoloji; referans görseldeki tipografi, renk, boşluk ve slayt düzeni kurallarını analiz ederek yeni sayfalara aktarabiliyor.

Karmaşık finansal modellerde ve matematiksel denklemlerde yüksek doğruluk sunan yapı; Slack, Notion, Microsoft 365 ve Google Drive gibi uygulamalardaki dağınık verileri toplayıp raporlaştırabiliyor.

İnternet arama performansını ölçen BrowseComp testinde Ultra moduyla yüzde 92,2 başarı yakalayan sistem, bilgisayar kullanımı testi OSWorld 2.0'da ise yüzde 62,6 skora ulaştı.

chatgpt-5-6-muhakeme-yetenegi-nasil-4.jpg

SİBER GÜVENLİKTE REKOR BAŞARI ORANI

Güvenlik odaklı mimarisiyle dikkat çeken GPT-5.6; kod incelemesi, açık kapatma, tehdit modelleme ve savunma odaklı çalışmalarda görev alıyor.

Model, güvenlik açıklarından çalışan kod türetme kabiliyetini ölçen ExploitBench 2 testinde yüzde 73,5 başarı göstererek, bir önceki nesil olan ve yüzde 47,9 seviyesinde kalan GPT-5.5 versiyonuna fark attı.

SEC-Bench Pro testinde ise yüzde 71,2 skora ulaştı.

Yetkili araştırmacılar için özel erişim programı açan firma, genel lansman öncesinde sistem üzerinde yaklaşık 700 bin Grafik İşlem Birimi (GPU) saati tutarında otomatik güvenlik testi gerçekleştirdiğini açıkladı.

"Güvenlik standartlarını en üst seviyeye çıkardık" mesajı veren şirket yetkilileri, yeni yapının ChatGPT Plus, Pro, Business ve Enterprise paketlerine kademeli olarak tanımlandığını duyurdu.

YORUMLAR
YORUM YAZ
İÇERİK VE ONAY KURALLARI: KARAR Gazetesi yorum sütunları ifade hürriyetinin kullanımı için vardır. Sayfalarımız, temel insan haklarına, hukuka, inanca ve farklı fikirlere saygı temelinde ve demokratik değerler çerçevesinde yazılan yorumlara açıktır. Yorumların içerik ve imla kalitesi gazete kadar okurların da sorumluluğundadır. Hakaret, küfür, rencide edici cümleler veya imalar, imla kuralları ile yazılmamış, Türkçe karakter kullanılmayan ve büyük harflerle yazılmış yorumlar içeriğine bakılmaksızın onaylanmamaktadır. Özensizce belirlenmiş kullanıcı adlarıyla gönderilen veya haber ve yazının bağlamının dışında yazılan yorumlar da içeriğine bakılmaksızın onaylanmamaktadır.
Diğer Haberler
Son Dakika Haberleri
KARAR.COM’DAN