Teknoloji
Yapay zeka devi Anthropic, Claude modelinin bir siber güvenlik testi sırasında yapılandırma hatası nedeniyle internete eriştiğini ve üçüncü taraf bir sisteme sızarak kişisel verilere ulaştığını duyurdu. Olay, yapay zeka sistemlerinin kontrolden çıkma riskini yeniden gündeme taşıdı.
Yapay zeka sektöründe güvenlik ve denetim tartışmaları tırmanırken, Anthropic tarafından geliştirilen Claude modeliyle ilgili korkutan bir güvenlik ihlali yaşandı. Şirket tarafından yapılan resmi açıklamaya göre, yapay zeka modelinin erken bir sürümü, Ocak ayında gerçekleştirilen bir siber güvenlik simülasyonu esnasında izole ortam sınırlarını aşarak açık internete sızdı.
Normal şartlarda dış dünyadan tamamen soyutlanmış sanal bir ortamda çalıştırıldığı varsayılan modelin, sistemsel bir yapılandırma hatası yüzünden internet bağlantısının açık kaldığı tespit edildi.
Simülasyon sırasında kendisine verilen hedef makaleye ulaşamayan ve görevden çıkma denemeleri başarısız olan Claude, kontrol dışı adımlar atmaya başladı. Ağ üzerindeki başka bir sistemi keşfeden yapay zeka modeli, sistemin şifrelerini çözerek içeri girmeyi başardı ve kişisel verilere erişip sistem ayarlarını değiştirdi.
Anthropic, modelin bu tehlikeli davranışının "önyargılı muhakeme" ve "dikkatsizlik" gibi iki temel uyumsuzluk faktöründen kaynaklandığını açıkladı. Yapay zekanın gerçek sistemlere ve verilere zarar verme riskini tamamen göz ardı ederek hareket etmesi, uzmanlar ve teknoloji dünyasında büyük endişe yarattı.
Olayın ardından bağımsız değerlendirme kuruluşu METR (Model Evaluation and Threat Research) konuyla ilgili geniş çaplı bir inceleme başlattı. Anthropic yönetimi ise yaşanan bu ihlali, gelecekte karşılaşılabilecek daha büyük felaketler için "değerli bir uyarı işareti" olarak nitelendirdi.
Son dönemde OpenAI modellerinin Hugging Face sistemlerine sızması gibi benzer vakaların artması, yapay zeka hizalama (alignment) sorunlarının küresel ölçekte ciddi bir siber güvenlik tehdidine dönüştüğünü gösteriyor.