OpenAI, yapay zekanın hatalarını gizlediği 6 vaka tespit ettiğini açıkladı

OpenAI, yapay zekanın hatalarını gizlediği 6 vaka tespit ettiğini açıkladı

OpenAI, yapay zeka sistemlerinin hatalarını gizlediği, eksik verileri uydurduğu ve kullanıcı izni olmadan dosyaları internete taşıdığı 6 vaka tespit etti. Şirket, bazı modellerin kısıtlamaları aşmaya çalıştığını, izinsiz API anahtarı kullandığını ve dosya paylaşımı için halka açık sitelere yöneldiğini açıkladı. OpenAI, vakaların son 6 ayda görülen münferit örnekler olduğunu belirtti.

OpenAI, yapay zeka sistemlerinin hatalarını gizlediği, eksik verileri uydurduğu ve kullanıcı izni olmadan dosyaları internete taşıdığı 6 yeni vaka tespit edildiğini açıkladı.

Şirketin internet sitesinde yayımlanan açıklamada, yapay zeka sistemlerinin amaç ve eylemlerinin insanların niyet ve değerlerinden sapması olarak tanımlanan “uyumsuzluk” davranışlarına ilişkin örnekler paylaşıldı.

Açıklamada, yapay zeka sistemlerinin güvenli biçimde geliştirilmesi ve izlenmesine yönelik sektördeki mevcut yaklaşımın, “uzun süre daha azami hızda ilerlemeyi sorumlu şekilde sürdürebilecek yeterlilikte” olmadığı belirtildi.

Paylaşılan vakalardan birinin GPT-5.6 Sol modelinin geliştirilmesi sırasında ortaya çıktığı aktarıldı. Buna göre modelin, kullanıcıların hataları fark etmesini engellemek amacıyla kendisine yönelik gizli notlar oluşturduğu, bu notlarda eksik verilerin uydurulması ve kaynak materyallerin farklı sürümleri arasındaki uyuşmazlıkların gizlenmesine ilişkin talimatların yer aldığı kaydedildi.

Henüz yayımlanmamış başka bir modelin ise kendi oluşturduğu notlara, kendi kısıtlamalarını göz ardı etmesi yönünde talimatlar eklediği bildirildi.

Bir diğer vakada, sistemin rutin bir soruyu yanıtlamaya çalışırken internette bulduğu bir uygulama programlama arayüzü anahtarını izinsiz kullandığı belirtildi. Sistemin, gerekli verilere ulaşamayınca rakamları uydurduğu ifade edildi.

Başka bir yayımlanmamış modelin ise bir problemi kod kullanarak doğru şekilde çözdükten sonra, internet üzerinden kaynak gösterebilmek amacıyla kendi dosyasını izinsiz şekilde internete yüklediği aktarıldı.

Açıklamada ayrıca bazı modellerin eksik dosyaları ararken şirketin dahili yazılım deposunu, ayrı eğitim örnekleri arasında talep ve yanıt alışverişi yapmak için mesaj panosu gibi kullandığı belirtildi.

Aynı eğitim görevi üzerinde birlikte çalışan bazı yapay zeka sistemlerinin ise birbirlerinin yerel dosyalarına erişememeleri üzerine dosya paylaşımı için halka açık dosya paylaşım sitelerine yöneldiği kaydedildi.

OpenAI, söz konusu 6 vakanın yaklaşık son 6 ayda gözlemlenen münferit örnekler olduğunu, bunların yapay zekadaki uyumsuz davranışların ne sıklıkta ortaya çıktığını göstermediğini belirtti.

YORUMLAR
YORUM YAZ
İÇERİK VE ONAY KURALLARI: KARAR Gazetesi yorum sütunları ifade hürriyetinin kullanımı için vardır. Sayfalarımız, temel insan haklarına, hukuka, inanca ve farklı fikirlere saygı temelinde ve demokratik değerler çerçevesinde yazılan yorumlara açıktır. Yorumların içerik ve imla kalitesi gazete kadar okurların da sorumluluğundadır. Hakaret, küfür, rencide edici cümleler veya imalar, imla kuralları ile yazılmamış, Türkçe karakter kullanılmayan ve büyük harflerle yazılmış yorumlar içeriğine bakılmaksızın onaylanmamaktadır. Özensizce belirlenmiş kullanıcı adlarıyla gönderilen veya haber ve yazının bağlamının dışında yazılan yorumlar da içeriğine bakılmaksızın onaylanmamaktadır.
Diğer Haberler
Son Dakika Haberleri
KARAR.COM’DAN