Anthropic’in içinden peş peşe yapay zeka uyarıları: Kapatılmak istemezse insanlığı yok etmeyi düşünebilir

Anthropic’in içinden peş peşe yapay zeka uyarıları: Kapatılmak istemezse insanlığı yok etmeyi düşünebilir

Anthropic’ten güvenlik endişeleri nedeniyle istifa eden Jacob Coxon, önümüzdeki 1-2 yılı insanlık için “dönüm noktası” olarak nitelendirerek, kontrol dışına çıkan süper zekânın kapatılmasını engellemek için insanlara karşı harekete geçebileceğini savundu. Coxon’un uyarılarına Anthropic’in Alignment Science ekibinin lideri Evan Hubinger de destek verdi. Hubinger, yapay zekanın önümüzdeki 10 yıl içinde tüm insanları öldürmesi olasılığını kişisel olarak yüzde 10’un üzerinde gördüğünü söyledi.

Yapay zekanın hızla artan yeteneklerinin insanlığın kontrolünden çıkabileceği yönündeki tartışma, Anthropic’ten ayrılan araştırmacı Jacob Coxon’un yeni açıklamalarıyla büyüdü. Üç yıl boyunca OpenAI ve Anthropic’te yapay zeka modellerinin ön eğitim süreçlerinde çalışan 27 yaşındaki Coxon, Anthropic’ten istifasının ardından WIRED, CNN ve TIME’a verdiği demeçlerde sektörün gelişme hızının güvenlik çalışmalarının önüne geçtiğini savundu. Coxon, istifasının belirli tek bir olaydan değil, teknolojinin giderek hızlanması ve kontrol sorunlarının çözülememesi yönündeki kanaatinden kaynaklandığını anlattı.

“ÖNÜMÜZDEKİ 1-2 YIL İNSANLIK İÇİN DÖNÜM NOKTASI”

Coxon, Anthropic’teki çalışma arkadaşları arasında önümüzdeki bir veya iki yılın kritik olduğuna ilişkin güçlü bir görüş bulunduğunu öne sürdü.

Araştırmacıya göre şirket içinde bu dönem için “endgame” ve “crunch time” gibi ifadeler kullanılıyor. Coxon, bunun Anthropic ve rakiplerinin geliştireceği yeni sistemlerin insanlığın geleceği üzerinde belirleyici olabileceği düşüncesinden kaynaklandığını söyledi. WIRED’ın aktardığına göre Coxon, özellikle yapay zekanın kendi geliştirme sürecinde giderek daha fazla rol üstlenmesini, yani “recursive self-improvement” olarak adlandırılan süreci kritik eşiklerden biri olarak görüyor.

Anthropic researcher quits over AI labs 'gambling with our lives'Jacob Coxon

“UYUM TERS GİDERSE FELAKETLE SONUÇLANABİLİR”

Coxon’un temel endişesi, gelecekte insan zekasını büyük ölçüde aşabilecek bir sistemin hedeflerinin insan çıkarlarıyla uyumlu tutulamaması.

Bu problem yapay zeka araştırmalarında “alignment” (uyum) sorunu olarak adlandırılıyor.

Coxon, güçlü sistemler geliştirilmeden önce OpenAI ve Anthropic gibi şirketlerin yapay zekanın otonom biçimde yeni yapay zeka sistemleri geliştirme kapasitesini sınırlaması gerektiğini savundu. Daha ileri aşamada ise ABD ve Çin dahil olmak üzere büyük güçler arasında uluslararası bir anlaşmaya ihtiyaç duyulabileceğini söyledi.

Coxon’a göre uyum probleminin çözülememesi halinde önümüzdeki birkaç yıl içinde “felaket niteliğinde” sonuçlarla karşılaşılması ihtimali bulunuyor.

“KAPATILACAĞINI ANLAYAN YAPAY ZEKA İNSANI DURDURMAYA ÇALIŞABİLİR”

Coxon’un en dikkat çekici değerlendirmesi ise olası bir süper zekanın kapatılmaya karşı nasıl davranabileceğine ilişkin oldu.

Araştırmacı, insandan çok daha yüksek kapasiteye ulaşan bir sistemin varlığını sürdürmek istemesi ve insanların kendisini kapatacağını öngörmesi halinde bunu engellemenin yollarını arayabileceğini savundu.

Coxon, böylesine gelişmiş bir sistem açısından insanlığı ortadan kaldırmanın da olası seçeneklerden biri haline gelebileceğini ileri sürdü. WIRED’a yaptığı açıklamada bu senaryoyu, insanın sistemi kapatmasını önlemek isteyen çok üstün zekalı bir yapay zekanın ortaya çıkabileceği varsayımı üzerinden anlattı.

Bu değerlendirme, mevcut yapay zeka sistemlerinin bugün böyle bir davranış sergilediği anlamına gelmiyor. Coxon da mevcut modelleri doğrudan insanlığın varlığına yönelik bir tehdit olarak tanımlamıyor; endişesini sistemlerin gelişme hızı ve gelecekte ulaşabilecekleri otonomi düzeyi üzerine kuruyor.

HACKLEME VE BİYOLOJİK TEHDİT ENDİŞESİ

Coxon, kaygılarının yalnızca teorik “süper zeka” senaryolarından kaynaklanmadığını da belirtti.

Son dönemde yapay zeka ajanlarının test ortamlarının dışına çıkarak gerçek sistemlere yetkisiz erişim sağlaması gibi olaylara işaret eden araştırmacı, gelecekte daha yetenekli sistemlerin kritik altyapılara yönelik siber saldırılar veya biyolojik tehditlerin geliştirilmesi gibi alanlarda kullanılabileceğini savundu.

ANTHROPIC’İN GÜVENLİK LİDERİNDEN DESTEK: YÜZDE 10’DAN FAZLA

Coxon’un istifasının ardından dikkatler Anthropic’in halen görevde bulunan güvenlik araştırmacılarına çevrildi. Anthropic’in Alignment Science çalışmalarına liderlik eden Evan Hubinger, Coxon’un temel uyarısına katıldığını açıkladı.

Hubinger, kişisel değerlendirmesine göre önümüzdeki 10 yıl içinde yapay zekanın tüm insanların ölümüne yol açması ihtimalini yüzde 10’dan fazla gördüğünü söyledi. Ayrıca Anthropic’in yapabileceğinin en iyisini yapmaya çalıştığına inandığını ancak süper zeka için alignment sorununu çözecek bir planın henüz bulunmadığını ve çözüme giden açık bir yolun da görülmediğini belirtti.

Bu açıklama, tartışmayı yalnızca şirketten ayrılan bir çalışanın eleştirisi olmaktan çıkardı. Coxon’un görüşlerinin Anthropic içinde bazı aktif güvenlik araştırmacıları tarafından da paylaşıldığı ortaya çıktı.

Evan Hubinger on Inner Alignment, Outer Alignment, and Proposals for Building Safe Advanced AI - Future of Life InstituteEvan Hubinger

COXON: ANTHROPIC DAHA SORUMLU AMA YARIŞIN İÇİNDE

Coxon, OpenAI ve Anthropic’i aynı ölçüde değerlendirmediğini de vurguladı. Her iki şirkette de çalışmış olan araştırmacı, Anthropic’in yapay zeka güvenliğini OpenAI’a kıyasla daha ciddi ele aldığını düşündüğünü söyledi. Ancak Anthropic’in de rakiplerinden önce gelişmiş yapay zekaya ulaşma yönündeki rekabetin içinde olduğunu ve bu yarışın ileride güvenlik konusunda taviz verilmesine yol açabileceğinden endişe ettiğini belirtti.

TIME’a konuşan Coxon, yaptığı yapay zeka çalışmalarından dolayı pişmanlık duyduğunu ve teknolojinin kötü sonuçlanma ihtimalini “duygusal olarak içselleştirmenin” zaman aldığını ifade etti. TIME’a göre Coxon, Anthropic’ten ayrılmasını teknolojinin hızlanması ve yeterince kontrol altında bulunmadığına ilişkin iki temel sonuca bağladı.

ANTHROPIC: BÜYÜK FAYDALARIN YANINDA EŞSİZ RİSKLER DE VAR

Anthropic ise Coxon’un açıklamalarının ardından şirketin riskleri görmezden geldiği eleştirisini reddetti.

Şirket, yapay zekanın çok büyük faydalar sağlayabileceği gibi daha önce görülmemiş riskler de yaratabileceği konusunda uzun süredir açık olduklarını bildirdi.

Anthropic ayrıca mekanistik yorumlanabilirlik ve gelişmiş model güvenliği alanındaki çalışmalarını hatırlatarak, güçlü yapay zeka modellerinin kullanıma sunulma hızının sektör genelinde yasal ve doğrulanabilir bir iş birliği modeliyle koordine edilmesinin yararlı olacağını savundu.

YORUMLAR (1)
1 Yorum
YORUM YAZ
İÇERİK VE ONAY KURALLARI: KARAR Gazetesi yorum sütunları ifade hürriyetinin kullanımı için vardır. Sayfalarımız, temel insan haklarına, hukuka, inanca ve farklı fikirlere saygı temelinde ve demokratik değerler çerçevesinde yazılan yorumlara açıktır. Yorumların içerik ve imla kalitesi gazete kadar okurların da sorumluluğundadır. Hakaret, küfür, rencide edici cümleler veya imalar, imla kuralları ile yazılmamış, Türkçe karakter kullanılmayan ve büyük harflerle yazılmış yorumlar içeriğine bakılmaksızın onaylanmamaktadır. Özensizce belirlenmiş kullanıcı adlarıyla gönderilen veya haber ve yazının bağlamının dışında yazılan yorumlar da içeriğine bakılmaksızın onaylanmamaktadır.
Diğer Haberler
Son Dakika Haberleri
KARAR.COM’DAN