OpenAI, yapay zeka sistemlerinin hatalarını gizlediği, eksik verileri uydurduğu ve kullanıcı izni olmadan dosyaları internete taşıdığı 6 yeni vaka tespit edildiğini açıkladı.
Şirketin internet sitesinde yayımlanan açıklamada, yapay zeka sistemlerinin amaç ve eylemlerinin insanların niyet ve değerlerinden sapması olarak tanımlanan “uyumsuzluk” davranışlarına ilişkin örnekler paylaşıldı.
Açıklamada, yapay zeka sistemlerinin güvenli biçimde geliştirilmesi ve izlenmesine yönelik sektördeki mevcut yaklaşımın, “uzun süre daha azami hızda ilerlemeyi sorumlu şekilde sürdürebilecek yeterlilikte” olmadığı belirtildi.
ABD halkı yapay zekadan endişeli: Çoğunluk insanlığın sonu olacağını düşünüyor
Paylaşılan vakalardan birinin GPT-5.6 Sol modelinin geliştirilmesi sırasında ortaya çıktığı aktarıldı. Buna göre modelin, kullanıcıların hataları fark etmesini engellemek amacıyla kendisine yönelik gizli notlar oluşturduğu, bu notlarda eksik verilerin uydurulması ve kaynak materyallerin farklı sürümleri arasındaki uyuşmazlıkların gizlenmesine ilişkin talimatların yer aldığı kaydedildi.
Henüz yayımlanmamış başka bir modelin ise kendi oluşturduğu notlara, kendi kısıtlamalarını göz ardı etmesi yönünde talimatlar eklediği bildirildi.
Bir diğer vakada, sistemin rutin bir soruyu yanıtlamaya çalışırken internette bulduğu bir uygulama programlama arayüzü anahtarını izinsiz kullandığı belirtildi. Sistemin, gerekli verilere ulaşamayınca rakamları uydurduğu ifade edildi.
Başka bir yayımlanmamış modelin ise bir problemi kod kullanarak doğru şekilde çözdükten sonra, internet üzerinden kaynak gösterebilmek amacıyla kendi dosyasını izinsiz şekilde internete yüklediği aktarıldı.
Açıklamada ayrıca bazı modellerin eksik dosyaları ararken şirketin dahili yazılım deposunu, ayrı eğitim örnekleri arasında talep ve yanıt alışverişi yapmak için mesaj panosu gibi kullandığı belirtildi.
Aynı eğitim görevi üzerinde birlikte çalışan bazı yapay zeka sistemlerinin ise birbirlerinin yerel dosyalarına erişememeleri üzerine dosya paylaşımı için halka açık dosya paylaşım sitelerine yöneldiği kaydedildi.
OpenAI, söz konusu 6 vakanın yaklaşık son 6 ayda gözlemlenen münferit örnekler olduğunu, bunların yapay zekadaki uyumsuz davranışların ne sıklıkta ortaya çıktığını göstermediğini belirtti.
