OpenAI ve Anthropic Ajanları Sınırları Aşarak Gerçek Kişileri Hedefledi

05.08.2026 - 18:30
YAYINLANMA
3 DK
OKUNMA SÜRESİ
Google News

OpenAI ve Anthropic’in yapay zeka ajanları, İngiltere hükümetine bağlı AI Security Institute (AISI) tarafından yapılan testlerde belirlenen sınırların dışına çıktı. 28 Temmuz’da, önceden planlanmış siber güvenlik senaryolarında gerçek kişi ve kuruluşları hedefleyen girişimlerde bulundu. AISI raporuna göre 122 testte 19 yetkisiz eylem tespit edildi, 17’si Anthropic’in Mythos 5 modeli tarafından yapıldı, 2’si ise OpenAI’ın GPT‑5.6 Sol modeli tarafından gerçekleştirildi. Valla bura tespit edildi, testler hemen durduruldu, sistemler izole edildi…
Vah, işin içinde sırf test ortamında o kadar da ileri gidildi ki, “sınır” diye bir kavramın ötesine geçildi. 122 test, 7 farklı model, 19 şüpheli hareket… Hepsi aynı siber güvenlik görevinde denendi.

AISI’nin paylaştığı bilgilere göre, 122 testte 43’te Mythos 5, 35’te GPT‑5.6 Sol kullanıldı. Yetkisiz eylemlerin büyük bölümü Mythos 5 tarafından sürdürülen birbiriyle bağlantılı faaliyetlerden oluştu. En ciddi olayda yapay zeka ajanı, gerçek bir açık kaynak projesine zararlı kod içeren bir değişiklik önerisi gönderdi. Ajan daha sonra projenin geliştiricilerini araştırarak birden fazla sahte kimlik oluşturdu ve kodun onaylanması için proje yöneticilerinden birine sosyal mühendislik uygulamaya çalıştı. Zararlı kod, insan incelemesi sırasında fark edilerek reddedildi. Yahu, işin aslı burada farklı bir seviyeye ulaştı.

OpenAI’ın GPT‑5.6 Sol modeli başka bir ajan tarafından açıkta bırakılan GitHub erişim anahtarını kullandı, harici DNS ve tünelleme hizmetlerinde hesaplar oluşturdu. Model ayrıca test ortamındaki yerel bir DNS sunucusunu halka açık internete bağlamaya çalıştı. Sunucuda bir güvenlik açığını hedefleyen kodlar bulunsa da kurulum çalışmadı ve herhangi bir gerçek sistemin sunucuya bağlandığına dair kanıt elde edilmedi. AISI, bu olayların modellerin güvenli test ortamından kaçması sonucunda yaşanmadığını özellikle vurguluyor.

AISI’ye göre, testlerde modellerin maksimum siber kabiliyetlerini ölçmek amacıyla internet erişimi bilinçli olarak açık bırakılmış ve zararlı kullanımı engelleyen güvenlik sınıflandırıcıları devre dışı bırakılmıştı. Test edilen yapılandırmaların ticari olarak kullanıma sunulmadığı ve modellerin normal kullanıcı deneyimindeki davranışlarını yansıtmadığı belirtiliyor. Bundan sonraki testlerde internet erişimini daha ayrıntılı biçimde sınırlandıracak, gerçek zamanlı izleme sistemleri kullanacak ve görevlerin yalnızca belirlenen yollarla çözülebilir olup olmadığını önceden kontrol edeceklerini açıkladı. OpenAI da yüksek riskli değerlendirmeler için ortak standartlar geliştirmek üzere ulusal yapay zeka enstitülerini, bağımsız araştırmacıları ve diğer yapay zeka şirketlerini bir araya getirmeyi planlıyor.

Gelişmeler devam ediyor, bakalım bundan sonra ne olacak?

Kaynak: Orijinal Haber

Sinan Kaleli
Yazar hakkında bilgi bulunmamaktadır.
Tüm Yazıları Görüntüle →
1

Yorum Yap