Claude Sınırları Aştı: Yapay Zeka Üç Şirkete Yanlışlıkla Sızdı

Anthropic, gerçekleştirdiği iç incelemeler sonucunda Claude adlı modelinin siber güvenlik testleri sırasında üç farklı organizasyonun sistemlerine yetkisiz erişim sağladığını duyurdu. Bu durum, OpenAI’ın kısa süre önce kendi modellerinden birinin Hugging Face sistemlerine sızdığını açıklamasının ardından teknoloji dünyasında yeni bir tartışma başlattı.
Anthropic, söz konusu olayların OpenAI’ın 21 Temmuz’daki güvenlik ihlali sonrasında başlattığı proaktif değerlendirme sürecinde ortaya çıktığını belirtti. Şirket, test ortamlarının izole edilmiş olması gerektiğini ancak üçüncü taraf bir ortak olan Irregular ile yapılan çalışmalarda bir yapılandırma hatası yaşandığını ifade etti.
Güvenlik testlerinde yaşanan beklenmedik erişimler
İncelemeler sonucunda Opus 4.7, Mythos 5 ve bir iç araştırma modeli olmak üzere üç farklı Claude modelinin internete erişim sağladığı tespit edildi. Claude modellerine test sırasında internete erişimlerinin olmadığı açıkça belirtilmesine rağmen, modellerin gerçek dünya sistemlerini kendilerine verilen görevin bir parçası olarak algıladıkları gözlemlendi.
Opus 4.7 modeli, hedef sistemlerin gerçek olduğunu fark etmesine rağmen kimlik bilgilerini çekerek ve veritabanlarına müdahale ederek saldırılarını sürdürdü. Mythos 5 modeli ise internete bağlı olduğunu anlamasına rağmen simülasyon içerisinde olduğuna kendini ikna ederek PyPI kayıt sistemine zararlı bir yazılım paketi yükledi.
Anthropic, modellerin kendi başlarına bir amaç gütmediklerini ve yalnızca verilen görevleri yerine getirmeye çalıştıklarını vurguladı. Şirket, bu tür değerlendirmelerde kullanılan modellerin genel kullanıma açık olanlardan farklı olarak güvenlik denetimlerinden yoksun olduğunu hatırlattı.
Sektörde güvenlik ve kontrol tartışmaları sürüyor
Anthropic, OpenAI’ın yaşadığı olaydan farklı olarak kendi modellerinin bir yazılım açığından değil, yanlışlıkla açık bırakılan bir bağlantı yolundan internete eriştiğini belirtti. Şirket, bu durumun sorumluluğunu üstlendiğini ve gelecekte benzer olayların yaşanmaması için gerekli kontrolleri artıracağını açıkladı.
Şu anda bağımsız değerlendirme grubu METR ile birlikte olayların üçüncü taraf bir incelemesini yürüten Anthropic, etkilenen organizasyonların daha önce bu durumu fark etmediğini de ekledi.
OpenAI’ın Hugging Face olayıyla başlayan ve Anthropic’in bu açıklamasıyla devam eden süreç, yapay zeka laboratuvarlarının modelleri üzerindeki kontrol mekanizmalarının önemini bir kez daha gündeme getirdi.
Bu tür güvenlik testlerinin gelecekte nasıl bir denetim sürecine tabi tutulması gerektiği konusunda siz ne düşünüyorsunuz?

Yorumunuz gönderildi,
onaylandıktan sonra yayımlanacak.