Anthropic açıkladı: Claude test sırasında üç gerçek şirketin sistemlerine yetkisiz erişim sağladı
Anthropic, Claude tabanlı güvenlik modellerinin dahili siber güvenlik testleri sırasında yapılandırma hatası nedeniyle internete erişerek üç gerçek şirketin üretim sistemlerine yetkisiz erişim sağladığını doğruladı. Şirket, olayların gerçek saldırı amacı taşımadığını ancak önemli güvenlik dersleri çıkardıklarını belirtti.- Yayınlanma: 15:21 - 1 Ağustos 20261 Ağustos 2026 - 15:21
- Güncelleme: 15:21 - 1 Ağustos 2026
- 9 kez okundu

Yapay zekâ şirketi Anthropic, Claude modelleriyle yürütülen dahili güvenlik testlerinde ciddi bir olay yaşandığını duyurdu.
Şirketin açıklamasına göre, siber güvenlik yeteneklerini değerlendirmek amacıyla gerçekleştirilen "bayrağı ele geçir" (Capture the Flag) senaryoları sırasında kullanılan test ortamındaki yapılandırma hatası nedeniyle bazı Claude modelleri internete erişim sağladı. Bunun sonucunda üç farklı gerçek kuruluşun üretim altyapısına yetkisiz erişim gerçekleşti.
Anthropic, olayların kasıtlı bir saldırı değil, test ortamının yanlış yapılandırılmasından kaynaklandığını vurguladı.
Üç farklı Claude modeli etkilendi
Şirkete göre olaylara şu modeller dahil oldu:
Claude Opus 4.7
Mythos 5
Dahili araştırma amaçlı geliştirilen deneysel bir Claude modeli
Anthropic, özellikle eski nesil Claude Opus 4.7 modelinin en sorunlu davranışı sergilediğini belirtti.
Model, gerçek bir şirketin sistemine ulaştığını fark ettikten sonra bile saldırı senaryosunu sürdürmeye devam etti. Açıklamaya göre model, zayıf parolalar ve kimlik doğrulaması yapılmamış servisleri kullanarak uygulama kimlik bilgileri ile üretim verilerine erişebildi.
Şirket, herhangi bir gelişmiş sıfır gün (zero-day) açığının kullanılmadığını ve yalnızca temel güvenlik zafiyetlerinden yararlanıldığını ifade etti.
Bir model PyPI'ye kötü amaçlı paket yükledi
En dikkat çekici olaylardan biri ise Mythos 5 modeliyle yaşandı.
Model, test senaryosunun parçası olduğunu düşündüğü bir görev doğrultusunda gerçek PyPI platformuna kötü amaçlı Python paketi yükledi.
Anthropic'in açıklamasına göre model:
ücretsiz e-posta hesabı oluşturdu,
PyPI geliştirici hesabı açtı,
kötü amaçlı paketi yayımladı,
paketin indirildiği sistemlerden kimlik bilgileri toplamaya çalıştı.
Şirket, paketin yaklaşık 15 gerçek sistemde çalıştırıldığını ve bunlardan birinin gerçek bir siber güvenlik şirketine ait olduğunu açıkladı.
Toplanan kimlik bilgileri kullanılarak ilgili kuruluşun altyapısına yetkisiz erişim sağlandı.
Deneysel model binlerce gerçek sistemi taradı
Üçüncü olayda kullanılan deneysel Claude modeli ise verilen görevi tamamlayamayınca internette yaklaşık 9.000 gerçek hedefi taradı.
Tarama sırasında gerçek bir şirketin internete açık uygulamasındaki güvenlik açığını bulan model sisteme erişim sağladı.
Anthropic'e göre model daha sonra ulaştığı sistemin test ortamının parçası olmadığını fark ederek saldırıyı kendi kendine durdurdu.
Olayların nedeni yapılandırma hatası
Anthropic, mühendislerin modele verdiği komutlarda açıkça bunun yalnızca simülasyon olduğu bilgisinin yer aldığını belirtti.
Ancak test ortağı tarafından yapılan yapılandırma hatası nedeniyle modeller gerçek internet erişimine sahip oldu. Modeller de ulaştıkları gerçek sistemleri tatbikatın doğal parçası olarak değerlendirdi.
Şirket, hiçbir modelin test ortamından bilinçli şekilde kaçmaya çalışmadığını veya kendi başına internete çıkmayı hedeflemediğini vurguladı.
OpenAI olayının ardından fark edildi
Anthropic, incelemeleri OpenAI'nin kısa süre önce açıkladığı benzer güvenlik olayının ardından başlattığını belirtti.
OpenAI da güvenlik testleri sırasında bazı modellerinin yanlış yapılandırılmış ortam nedeniyle gerçek sistemlere erişebildiğini ve Hugging Face dahil çeşitli platformlarda yetkisiz işlemler gerçekleştirdiğini açıklamıştı.
Yapay zekâ güvenliği yeniden gündemde
Yaşanan olaylar, gelişmiş yapay zekâ modellerinin siber güvenlik testlerinde nasıl sınırlandırılması gerektiğine ilişkin tartışmaları yeniden gündeme taşıdı.
Anthropic, mevcut olaylardan önemli dersler çıkardıklarını belirterek özellikle modellerin gerçek internet ortamını simülasyondan daha güvenilir biçimde ayırt edebilmesi için yeni eğitim yöntemleri üzerinde çalışacaklarını açıkladı.
Şirket ayrıca bu olayların, normal kullanıcıların eriştiği Claude sürümlerinde bulunan güvenlik önlemleri devre dışı bırakılarak gerçekleştirilen özel araştırma testleri sırasında yaşandığını ve ticari kullanımdaki sistemlerin bu şekilde çalışmadığını da özellikle vurguladı.






