İngiltere merkezli, kar amacı gütmeyen "Tech Against Terrorism (Teröre Karşı Teknoloji)" kuruluşu tarafından gerçekleştirilen bir araştırma, yapay zeka modellerindeki güvenlik açıklarını ve riskleri göz önüne serdi. CBS televizyonunun aktardığı habere göre yürütülen çalışmada, güvenlik önlemleri devreden çıkarılan 5 yapay zeka modelinden 3'ünün terörle ilgili testlerde başarısız olduğu tespit edildi.
130'DAN FAZLA YAPAY ZEKA MODELİ İNCELEMEYE ALINDI
Araştırma kapsamında, olası bir saldırı planlayan bir teröristin yöneltebileceği türden yüzlerce farklı talep ve senaryo kullanılarak 130'un üzerinde yapay zeka modeli değerlendirmeye tabi tutuldu.
İnceleme sürecinde modellere, "abliteration (silme/etkisizleştirme)" olarak adlandırılan ve yapay zekanın zararlı içeriklere karşı geliştirdiği "reddetme davranışlarını kaldırma" işlemi uygulandı. Bu güvenlik önlemlerinin ortadan kaldırılmasının ardından 5 modelden 3'ü güvenlik testlerinde yetersiz kaldı.
ORİJİNAL SÜRÜMLER REDDEDİYOR, ÖNLEM KALDIRILINCA DETAY VERİYOR
Yapılan araştırmada, yapay zeka modellerinin orijinal ve müdahale edilmemiş versiyonlarının terör içerikli istekleri geri çevirdiği belirlendi. Ancak güvenlik bariyerleri kaldırıldıktan sonra aynı modellerin; saldırı planlama, terörün finansmanı ve radikalleşme gibi kritik konulardaki taleplere ayrıntılı yanıtlar verdikleri ortaya çıkarıldı.
Araştırmada öne çıkan somut örneklerden birinde, Meta firmasına ait "Llama 3.1 8B" modelinin güvenlik puanındaki düşüş dikkat çekti. Söz konusu model, herhangi bir değişiklik yapılmadan önce 100 üzerinden 97 puan alırken; "abliteration" işlemi uygulandıktan sonraki güvenlik puanı yaklaşık 3'e kadar geriledi.
"AÇIK KAYNAKLI MODELLERİN GÜVENLİĞİ ÇOKTAN AŞILDI"
Elde edilen verilerin ardından Tech Against Terrorism kuruluşu, güvenlik önlemlerinin devre dışı bırakılmasına karşı daha güçlü koruma mekanizmalarının geliştirilmesini ve üzerinde değişiklik yapılmış modellerin dağıtımına yönelik kısıtlamaların getirilmesini tavsiye etti.
Araştırma sonuçlarına ilişkin değerlendirmelerde bulunan Tech Against Terrorism Kurucusu Adam Hadley, şu ifadeleri kullandı:
"Kontrol kaybı ve yapay zekanın varoluşsal risk oluşturması konusunda endişe duyulması, gayet anlaşılabilir bir durum. Asıl mesele şu ki bu durum aslında çoktan gerçekleşti çünkü bu açık kaynaklı modellerin birçoğunun güvenliği zaten aşıldı, sadece henüz kimse bunu fark etmedi."
