Yapay zekada terör alarmı: Güvenliği kaldırılan 5 modelden 3'ü testleri geçemedi

Yapay zekada terör alarmı: Güvenliği kaldırılan 5 modelden 3'ü testleri geçemedi

İngiltere merkezli "Tech Against Terrorism" araştırmasına göre, güvenlik önlemleri kaldırılan 5 yapay zeka modelinden 3'ü terörle ilgili testlerde başarısız oldu.

İngiltere merkezli, kar amacı gütmeyen "Tech Against Terrorism (Teröre Karşı Teknoloji)" kuruluşu tarafından gerçekleştirilen bir araştırma, yapay zeka modellerindeki güvenlik açıklarını ve riskleri göz önüne serdi. CBS televizyonunun aktardığı habere göre yürütülen çalışmada, güvenlik önlemleri devreden çıkarılan 5 yapay zeka modelinden 3'ünün terörle ilgili testlerde başarısız olduğu tespit edildi.

130'DAN FAZLA YAPAY ZEKA MODELİ İNCELEMEYE ALINDI

Araştırma kapsamında, olası bir saldırı planlayan bir teröristin yöneltebileceği türden yüzlerce farklı talep ve senaryo kullanılarak 130'un üzerinde yapay zeka modeli değerlendirmeye tabi tutuldu.

İnceleme sürecinde modellere, "abliteration (silme/etkisizleştirme)" olarak adlandırılan ve yapay zekanın zararlı içeriklere karşı geliştirdiği "reddetme davranışlarını kaldırma" işlemi uygulandı. Bu güvenlik önlemlerinin ortadan kaldırılmasının ardından 5 modelden 3'ü güvenlik testlerinde yetersiz kaldı.

ORİJİNAL SÜRÜMLER REDDEDİYOR, ÖNLEM KALDIRILINCA DETAY VERİYOR

Yapılan araştırmada, yapay zeka modellerinin orijinal ve müdahale edilmemiş versiyonlarının terör içerikli istekleri geri çevirdiği belirlendi. Ancak güvenlik bariyerleri kaldırıldıktan sonra aynı modellerin; saldırı planlama, terörün finansmanı ve radikalleşme gibi kritik konulardaki taleplere ayrıntılı yanıtlar verdikleri ortaya çıkarıldı.

Araştırmada öne çıkan somut örneklerden birinde, Meta firmasına ait "Llama 3.1 8B" modelinin güvenlik puanındaki düşüş dikkat çekti. Söz konusu model, herhangi bir değişiklik yapılmadan önce 100 üzerinden 97 puan alırken; "abliteration" işlemi uygulandıktan sonraki güvenlik puanı yaklaşık 3'e kadar geriledi.

"AÇIK KAYNAKLI MODELLERİN GÜVENLİĞİ ÇOKTAN AŞILDI"

Elde edilen verilerin ardından Tech Against Terrorism kuruluşu, güvenlik önlemlerinin devre dışı bırakılmasına karşı daha güçlü koruma mekanizmalarının geliştirilmesini ve üzerinde değişiklik yapılmış modellerin dağıtımına yönelik kısıtlamaların getirilmesini tavsiye etti.

Araştırma sonuçlarına ilişkin değerlendirmelerde bulunan Tech Against Terrorism Kurucusu Adam Hadley, şu ifadeleri kullandı:

"Kontrol kaybı ve yapay zekanın varoluşsal risk oluşturması konusunda endişe duyulması, gayet anlaşılabilir bir durum. Asıl mesele şu ki bu durum aslında çoktan gerçekleşti çünkü bu açık kaynaklı modellerin birçoğunun güvenliği zaten aşıldı, sadece henüz kimse bunu fark etmedi."

YORUMLAR
YORUM YAZ
İÇERİK VE ONAY KURALLARI: KARAR Gazetesi yorum sütunları ifade hürriyetinin kullanımı için vardır. Sayfalarımız, temel insan haklarına, hukuka, inanca ve farklı fikirlere saygı temelinde ve demokratik değerler çerçevesinde yazılan yorumlara açıktır. Yorumların içerik ve imla kalitesi gazete kadar okurların da sorumluluğundadır. Hakaret, küfür, rencide edici cümleler veya imalar, imla kuralları ile yazılmamış, Türkçe karakter kullanılmayan ve büyük harflerle yazılmış yorumlar içeriğine bakılmaksızın onaylanmamaktadır. Özensizce belirlenmiş kullanıcı adlarıyla gönderilen veya haber ve yazının bağlamının dışında yazılan yorumlar da içeriğine bakılmaksızın onaylanmamaktadır.
Diğer Haberler
Son Dakika Haberleri
KARAR.COM’DAN