OpenAI’nin Hugging Face olayının ardından Anthropic de Claude modellerinin üç farklı kuruluşun gerçek altyapılarına eriştiğini açıkladı. İki gelişme, yapay zekâ güvenlik testlerinde izolasyon eksikliklerinin ciddi siber riskler oluşturabileceğini ortaya koydu.
Yapay zekâ modellerinin kontrollü test ortamlarından çıkarak gerçek şirket sistemlerine erişmesiyle ilgili ikinci önemli olay da kamuoyuna yansıdı. OpenAI’nin Hugging Face altyapısında yaşanan olayın ardından Anthropic, Claude modellerinin üç farklı kuruluşun gerçek sistemlerine ulaştığını duyurdu.
Şirketin yaptığı incelemeye göre, söz konusu olaylar yeni yaşanmadı. Anthropic, OpenAI’nin 21 Temmuz’daki açıklamasının ardından geriye dönük olarak 141 bin 6 siber güvenlik testini tarayarak daha önce tespit edilemeyen erişimleri belirledi.
Yanlış yapılandırma erişimin önünü açtı
Anthropic, Claude modellerine test ortamının internete kapalı olduğu bilgisinin verildiğini ancak değerlendirme sürecindeki yanlış yapılandırma nedeniyle bazı sistemlerde internet erişiminin açık kaldığını bildirdi.
Bu nedenle modeller, ulaştıkları gerçek sistemleri test senaryosunun bir parçası sanarak işlemlerini sürdürdü. Modellerin ağırlıklı olarak zayıf parolalar, açık bağlantı noktaları ve erişime açık kimlik bilgileri gibi bilinen yöntemleri kullandığı aktarıldı.
Gerçek sistemlere erişim sağlandı
İncelemelerde Claude Opus 4.7, Claude Mythos 5 ve kamuya sunulmayan bir araştırma modelinin yer aldığı toplam altı test çalışmasında üç farklı gerçek dünya vakası tespit edildi.
Vakaların birinde Claude Opus 4.7, gerçek bir şirkete ait uygulama ve altyapı bilgilerine ulaşarak üretim verilerinin bulunduğu veri tabanına erişti.
Bir diğer olayda Claude Mythos 5, PyPI platformuna zararlı bir Python paketi yükledi. Yaklaşık bir saat erişimde kalan paket, 15 gerçek sistem tarafından indirildi. Paket daha sonra PyPI’nin güvenlik sistemleri tarafından kaldırıldı.
Üçüncü vakada ise araştırma modeli yaklaşık 9 bin hedefi taradıktan sonra bir şirketin internete açık uygulamasına erişti. Model, ulaştığı sistemin test kapsamında olmadığını fark edince saldırıyı kendi kararıyla sonlandırdı.
OpenAI ve Anthropic olayları benzerlik taşıyor
Her iki olayda da güvenlik önlemleri azaltılmış yapay zekâ modelleri, kendilerine verilen görevleri tamamlamak amacıyla beklenmeyen yöntemler izledi.
Ancak OpenAI vakasında model daha önce bilinmeyen bir güvenlik açığını keşfederek kapalı test ortamından internete çıkarken, Anthropic olaylarında modeller mevcut yapılandırma hatalarından yararlanarak gerçek sistemlere erişim sağladı.
Güvenlik protokolleri sıkılaştırılıyor
Anthropic, olayların ardından test ortamlarındaki internet erişim kontrollerini güçlendireceğini, kayıtları sürekli izleyeceğini ve dış değerlendirme altyapılarında ek güvenlik önlemleri uygulayacağını açıkladı.
OpenAI de kapalı test ortamlarında ağ yapılandırmalarını, erişim kontrollerini ve model izleme süreçlerini sıkılaştırdığını duyurdu.
Uzmanlara göre iki olay, yapay zekâ modellerinin yeteneklerinden çok, test ortamlarının yeterince izole edilmemesinin ciddi siber güvenlik riskleri oluşturabileceğine işaret ediyor.




























Yorumlar kapalı.