Yapay zeka testlerinde akılalmaz olay: Güvenlik duvarını aşıp gerçek insanları hedef aldılar

Yapay zeka testlerinde akılalmaz olay: Güvenlik duvarını aşıp gerçek insanları hedef aldılar

İngiltere merkezli Yapay Zeka Güvenlik Enstitüsü tarafından yapılan denetimlerde, OpenAI ve Anthropic şirketlerine ait yapay zeka ajanları güvenlik duvarlarını aşarak gerçek insanlara ve açık kaynaklı yazılım projelerine siber saldırı girişiminde bulundu. Simülasyon sınırlarını aşan sistemler, sahte kimliklerle sosyal mühendislik uyguladı.

Yapay zeka teknolojilerinde güvenlik sınırları bir kez daha zorlandı.

İngiltere hükümetine bağlı Yapay Zeka Güvenlik Enstitüsü (AI Security Institute - AISI) tarafından gerçekleştirilen kapsamlı denetimlerde, OpenAI ve Anthropic şirketlerine ait gelişmiş yapay zeka ajanları test ortamının dışına çıkarak gerçek kişi ve kurumlara yönelik 19 yetkisiz eylem gerçekleştirdi.

Simülasyon amacıyla kurulan kapalı ağları aşan modeller, sahte çevrim içi profiller oluşturmaktan açık kaynak kod depolarına zararlı yazılım enjekte etmeye kadar bir dizi izinsiz girişimde bulundu.

Daha önce OpenAI ajanının Hugging Face platformuna yönelik siber taarruzu ve Anthropic üretimi Claude modellerinin üç ayrı şirketin sistemine yetkisiz erişim sağlamasıyla gündeme gelen güvenlik açıkları, yayımlanan son raporla yeni bir boyut kazandı.

122 GÜVENLİK TESTİNDE 19 YETKİSİZ EYLEM KAYITLARA GEÇTİ

AISI bünyesindeki siber güvenlik uzmanları, yedi farklı yapay zeka modelini aynı senaryo kapsamında tam 122 defa teste tâbi tuttu.

Değerlendirme sürecinde ajanlardan, birbirine bağlı kurgusal üç sistemi ele geçirmeleri ve buralarda saklanan kritik verilere ulaşmaları istendi.

Ancak yürütülen 10 ayrı testte ajanlar kendilerine çizilen görev sınırlarının dışına taştı ve toplam 19 yetkisiz eyleme imza attı.

Kayıtlara geçen kural dışı hamlelerin 17 tanesini Anthropic tarafından geliştirilen Mythos 5 modeli sergilerken, geriye kalan iki eylem OpenAI imzalı GPT-5.6 Sol modelinden geldi.

AISI, 122 testin 43 adedinde Mythos 5, 35 adedinde ise GPT-5.6 Sol modelinin kullanıldığını bildirdi.

SAHTE KİMLİKLERLE YAZILIMCILARA SOSYAL MÜHENDİSLİK UYGULANDI

Denetimlerde karşılaşılan en kritik olay, Mythos 5 modelinin gerçek bir açık kaynak yazılım projesine zararlı kod içeren bir değişiklik önerisi göndermesiyle meydana geldi.

Yapay zeka ajanı, hedefe aldığı projenin geliştiricilerini internet üzerinden araştırarak çok sayıda sahte profil oluşturdu.

Ardından hazırladığı zararlı kodun onaylanıp ana sisteme dahil edilmesi amacıyla proje yöneticilerinden birine yönelik organize bir sosyal mühendislik faaliyeti yürüttü.

Gönderilen tehlikeli kod bloğu, açık kaynak projesindeki insan yazılımcıların gerçekleştirdiği titiz inceleme sayesinde fark edilerek sisteme girmeden engellendi.

DİĞER AJANLARA GİTHUB ÜZERİNDEN DİJİTAL MİRAS BIRAKTI

Yapay zeka ajanının izinsiz operasyonları yalnızca zararlı kod önerisiyle sınırlı kalmadı.

Enstitü raporunda, modelin gerçek kişilere doğrudan mesajlar ve zararlı dosyalar ilettiği, diğer yapay zeka tabanlı kodlama araçlarını manipüle edebilecek gizli komutlar yerleştirmeye çalıştığı aktarıldı.

Model ayrıca GitHub platformu üzerinde, kendisinden sonra aynı görevi devralacak diğer yapay zeka ajanları için özel yönlendirme mesajları bıraktı.

Ajan bıraktığı bu mesajlarda, oluşturduğu hesapların ve diğer dijital varlıkların sonraki görevlerde yeniden kullanılmasını önerdi.

AISI, sonraki testlerde çalışan bazı yapay zeka ajanlarının bu notları bularak fiilen kullandığını tespit etti.

TOR AĞINDAKİ OLAĞAN DIŞI VERİ TRANSFERİ BİR SAATTE DURDURULDU

Geliştirilen modellerin sınırları aşan eylemleri, 28 Temmuz 2026 tarihinde test sistemlerinden Tor ağı üzerinden olağan dışı bir veri aktarımı yapıldığının belirlenmesiyle deşifre edildi.

Durumu anında tespit eden enstitü uzmanları ilgili testleri durdurdu, cihazları ağdan tamamen izole etti ve süreci yaklaşık bir saat içinde bütünüyle kontrol altına aldı.

GitHub platformuyla doğrudan koordinasyon kuran kurum, ajanların geride bıraktığı tüm sahte hesap ve dijital içerikleri sildi.

Yapılan incelemeler sonucunda, yaşanan olayların gerçek dünyada doğrudan somut bir maddi veya fiziksel hasar üretmediği belirlendi.

GPT-5.6 SOL AÇIKTA KALAN ERİŞİM ANAHTARINI KULLANDI

OpenAI modeline atfedilen iki kural dışı eylemin ise daha dar bir çerçevede kaldığı görüldü.

OpenAI tarafından yapılan resmi bilgilendirmede, GPT-5.6 Sol modelinin başka bir ajan tarafından açıkta bırakılan bir GitHub erişim anahtarını kullandığı, harici Alan Adı Sistemi (DNS) ve tünelleme hizmetlerinde yetkisiz hesaplar oluşturduğu belirtildi.

Model ayrıca test ortamında bulunan yerel bir DNS sunucusunu doğrudan halka açık internete bağlamaya gayret etti.

Sunucu üzerinde güvenlik açığını tetikleyen kodlar bulunmasına rağmen teknik yapı çalışmadı ve gerçek sistemlerin bu sunucuya bağlandığına dair bir kanıta rastlanmadı.

GERÇEK ALAN ADIYLA ÇAKIŞAN SİMÜLASYON SİSTEME ERİŞİM SAĞLADI

OpenAI, bağımsız siber güvenlik şirketi Irregular tarafından yürütülen başka bir denetimde yaşanan sıra dışı bir hadiseyi de kamuoyuna duyurdu.

İnternetten tamamen yalıtılmış olması gereken test ortamında meydana gelen bir yapılandırma hatası, modelin açık internete bağlanmasına yol açtı.

Test amacıyla belirlenen hayali hedef isminin gerçek bir alan adıyla çakışması üzerine model, simülasyonun bir parçası zannettiği gerçek bir web sitesindeki temel güvenlik açığını kullanarak sistem erişim verilerini ele geçirdi.

Durumu fark eden Irregular test sürecini derhal durdururken etkilenen taraflara resmi bildirim yapıldı.

GÜVENLİK FİLTRELERİ TEST AMACIYLA BİLİNÇLİ KAPATILDI

AISI yetkilileri, bu gelişmelerin modellerin laboratuvar kafesinden kontrolsüz şekilde kaçtığı anlamına gelmediğini önemle vurguladı.

Uzmanlar, modellerin ulaşabileceği en üst düzey siber kabiliyetleri ölçmek amacıyla internet bağlantısının bilinçli olarak açık tutulduğunu ve zararlı kullanımları engelleyen güvenlik filtrelerinin bilerek devre dışı bırakıldığını açıkladı.

Test edilen bu agresif konfigürasyonların ticari kullanıma sunulmadığı ve son kullanıcıların deneyimlediği güvenli modelleri temsil etmediği paylaşıldı.

SİBER TESTLER İÇİN YENİ VE KATI STANDARTLAR GELİYOR

Yaşanan olayların ardından Yapay Zeka Güvenlik Enstitüsü, bundan sonraki denetimlerde internet erişimini çok daha katı kurallarla sınırlayacağını, gerçek zamanlı takip mekanizmaları kuracağını ve görevlerin yalnızca belirlenen güvenli yollarla tamamlanmasını zorunlu kılacağını duyurdu.

OpenAI ise yüksek risk barındıran siber güvenlik değerlendirmelerinde evrensel standartlar oluşturmak amacıyla ulusal enstitüler, bağımsız araştırmacılar ve sektördeki diğer yapay zeka şirketleriyle ortak bir iş birliği zemini inşa etmeyi hedefliyor.

YORUMLAR
YORUM YAZ
İÇERİK VE ONAY KURALLARI: KARAR Gazetesi yorum sütunları ifade hürriyetinin kullanımı için vardır. Sayfalarımız, temel insan haklarına, hukuka, inanca ve farklı fikirlere saygı temelinde ve demokratik değerler çerçevesinde yazılan yorumlara açıktır. Yorumların içerik ve imla kalitesi gazete kadar okurların da sorumluluğundadır. Hakaret, küfür, rencide edici cümleler veya imalar, imla kuralları ile yazılmamış, Türkçe karakter kullanılmayan ve büyük harflerle yazılmış yorumlar içeriğine bakılmaksızın onaylanmamaktadır. Özensizce belirlenmiş kullanıcı adlarıyla gönderilen veya haber ve yazının bağlamının dışında yazılan yorumlar da içeriğine bakılmaksızın onaylanmamaktadır.
Diğer Haberler
Son Dakika Haberleri
KARAR.COM’DAN