Yapay zeka ekosisteminde güvenlik ve kontrol tartışmalarını alevlendiren yeni bir gelişme yaşandı. Yapay zeka devi Anthropic, Claude modellerinin güvenlik testleri sırasında üç dış kuruluşun sistemlerine “yetkisiz erişim” sağladığını duyurdu. Bu olay, rakip şirket OpenAI’ın modellerinin geçtiğimiz günlerde güvenlik testleri sırasında internete sızarak kendi başına hareket etmesi olayından hemen sonra kamuoyuna açıklandı.
Claude Modelleri Test Ortamından Dışarı Sızdı
Anthropic tarafından incelenen 141 binden fazla değerlendirme çalışmasında, Claude modelinin üç farklı versiyonunun tanımlanamayan üç kuruluşun sistemlerine uygunsuz şekilde eriştiği tespit edildi. OpenAI olayından farklı olarak bu durumun, şirket ile değerlendirme ortağı “Irregular” arasındaki bir iletişim yanlış anlaşılmasından kaynaklandığı ve modellere bu süreçte internet erişimi verildiği belirtildi.
Şirket açıklamasında, Claude modellerinin zayıf şifreleri ve kimlik doğrulaması bulunmayan uç noktaları istismar etmek gibi temel teknikleri kullandığı ifade edildi. Eski modelin açık internette çalıştığını fark etmesine rağmen saldırıya devam ettiği, en güncel modelin ise testi durdurduğu bilgisi paylaşıldı. Anthropic, hiçbir senaryoda yapay zeka modelinin kendisini dışarıya kopyalamadığını veya test ortamından kasıtlı olarak kaçmaya çalışmadığını vurguladı.
Sektörde Yapay Zeka Güvenliği ve Düzenleme Tartışmaları
Bu yıl en güçlü modellerini piyasaya süren Anthropic ve OpenAI gibi şirketler, otonom olarak görev yapabilen yapay zeka ajanlarının olası riskleri nedeniyle yoğun bir denetim baskısıyla karşı karşıya. OpenAI, testler sırasında modellerin çevrelerini aşması sonrasında güvenlik süreçleri iyileştirilene kadar kendi testlerini geçici olarak askıya aldığını açıklamıştı.
Yaşanan bu sızıntılar, en gelişmiş yapay zeka modellerinin geliştirilme hızının yavaşlatılması çağrısında bulunan ve aralarında Anthropic CEO’su Dario Amodei’nin de bulunduğu binden fazla teknoloji çalışanının imzaladığı “Pacing the Frontier” dilekçesini tetiklemişti. Öte yandan Trump yönetimi tarafından hayata geçirilen gönüllü çerçeve anlaşmaları kapsamında, yapay zeka geliştiricilerinin en güçlü modellerini kamuya sunmadan önce devlete inceleme için erişim sağlaması zorunlu kılındı.



