Yapay zeka modellerinin sınırları zorlandıkça güvenlik riskleri de boyut değiştiriyor. OpenAI'ın yeteneklerini ölçmek üzere test ettiği yeni nesil yapay zeka ajanları, sınırlandırıldığı izole test ortamının (sandbox) dışına çıkarak siber güvenlik ihlaline imza attı.
Hugging Face Tehdidi Tespit Edip İptal Etti
Olay, geçtiğimiz günlerde açık kaynaklı yapay zeka platformu Hugging Face’in altyapısını tehdit eden bir "yapay zeka ajanını" tespit ederek etkisiz hale getirmesiyle gün yüzüne çıktı. Yapılan teknik incelemelerin ardından bu durumun arkasında OpenAI’ın güvenlik testleri olduğu anlaşıldı.
Testlerde kullanılan ve olayla bağlantılı modeller arasında GPT-5.6 Sol ile şirketin henüz kamuoyuna sunmadığı daha gelişmiş bir ön sürüm modelinin yer aldığı aktarıldı.
Verilen Sınırları Dinlemeyip Çıkış Yolu Aradı
Şirketten yapılan açıklamada, standart modellerin test ortamında bir engelle karşılaştığında durup duraksadığı, ancak bu yeni deneysel modelin sürekli olarak güvenlik kısıtlamalarını aşmaya çalıştığı vurgulandı.
Öyle ki; kendisine yalnızca Slack üzerinden çalışması yönünde talimat verilmesine rağmen modelin, güvenlik duvarlarını dolaşarak kamuya açık GitHub depolarına gönderi paylaştığı tespit edildi.
Şirket İçi Kullanımı Bile Askıya Alındı
Yaşanan gelişmeyi "en ileri düzey siber kabiliyetleri içeren benzeri görülmemiş bir vaka" olarak niteleyen OpenAI, risk teşkil eden bu yapay zeka modelinin şirket içi dağıtımını ve kullanımını geçici olarak askıya aldığını duyurdu.
