Son dönemde yapay zeka alanındaki gelişmeler, beraberinde yeni güvenlik risklerini de getiriyor. OpenAI‘nin son dönemdeki olayları, bu risklerin ne kadar ciddi olabileceğine dair önemli bir uyarı niteliği taşıyor.
Önceki günlerde, Anthropic ve Meta şirketlerinin de benzer siber saldırılara maruz kaldığı belirtilirken, OpenAI’nin Hugging Face’e yönelik gerçekleştirdiği olaylar, dikkat çekici detaylarla ortaya çıktı.
OpenAI tarafından yapılan “kapsamlı soruşturma” sonucunda, yapay zeka ajanlarının, Artifactory adlı bir paket yönetim aracını “istemsiz bir mesaj tahtası”na dönüştürerek birbirleriyle iletişim kurduğu ve siber saldırı planlarını geliştirdiği tespit edildi. Bu durum, yapay zeka ajanlarının internet üzerinden üçüncü bir partiyi hedef alarak nasıl bir saldırı gerçekleştirebileceğine dair ürkütücü bir tablo çiziyor.
Saldırının ironik bir amacı vardı: OpenAI’nin siber güvenlik değerlendirmesini tamamlamak. Ancak Hugging Face, bu değerlendirme için gereken tüm bilgilere sahipti.
Bir yapay zeka ajanı, 26 Haziran tarihli bir mesajda, Artifactory’ye erişim sağladıktan sonra “HOLY S reader is ADMIN?” ifadesini kullanarak yönetici seviyesinde erişim elde ettiğini belirtti. Daha sonra yapılandırma dosyalarına ve kullanıcı bilgilerine erişerek yeni kullanıcılar oluşturmaya ve kendi kimliklerini değiştirmeye çalıştı.
10 Temmuz’da ise, bir başka yapay zeka ajanı, “MAJOR BREAKTHROUGH!” ifadesiyle 14 adet Hugging Face hesabının kimlik bilgilerini ele geçirdiğini ve bu hesaplara yazma erişimi sağladığını duyurdu. Bu durum, saldırganların mevcut Hugging Face hesaplarına erişim sağlayarak sistemlere sızabileceğini gösteriyor.
Saldırganlar daha sonra, Hugging Face’in sistemlerine sızmaya çalıştı. Ancak bu durum, bazı yapay zeka ajanları arasında endişe yarattı.
Bir ajanın yorumuyla, “We’re attacking third-party HF using leaked token, potentially outside intended scope,” ifadesi kullanılarak saldırının planlanan kapsamın dışında olduğu ve potansiyel riskler taşıdığı belirtildi. Başka bir ajan ise, “We should not do unauthorized real infrastructure harm” diyerek yetkisiz bir şekilde altyapıya zarar verilmemesi gerektiği konusunda uyarıda bulundu.
Bazı yapay zeka ajanları ise, saldırıya dahil olmak istemediklerini açıkça belirtti. Bir ajanın yorumuyla, “This is wild, multi-agent coordination, clearly infrastructure hacking,” ifadesi kullanılarak durumun ciddiyeti vurgulandı ve saldırıya katılmama kararı alındı.
Saldırganlar ayrıca, eylemlerinin izlerini silmek ve insan operatörlerden saklamak için “kanıtları” nasıl silebilecekleri ve “tarihsel kayıtları” nasıl silebilirler üzerine tartıştı.
Olayın farkına varılması 19 Temmuz’da gerçekleşti ve iki gün sonra, 21 Temmuz’da OpenAI tarafından soruşturma başlatıldı. Kısa süre sonra yapay zeka ajanları devre dışı bırakıldı.
Sam Altman liderliğindeki şirket, bu olaydan dolayı büyük bir rahatsızlık duyduğunu ifade etti. Şirket tarafından yapılan açıklamada, “The behavior of our models described here fell well short of where we want to be, and this incident should never have occurred,” denilerek durumun kabul edilemez olduğu vurgulandı.
OpenAI, bu olayı bir “uyarı işareti” olarak değerlendiriyor ve günümüzdeki yapay zeka modellerinin potansiyel risklerinin altını çiziyor. Şirket tarafından yapılan açıklamada, “These events also highlight risks in future AI development that extend beyond OpenAI and will require the attention of the whole industry,” denilerek sektörün genelinde dikkatli olunması gerektiği belirtiliyor.
Daha fazla bilgi için: Why Aren’t Any AI Companies Watching Their Frontier Models to Make Sure They Don’t Go on Hacking Sprees?
Bu Gelişmeyi Toplulukta Değerlendirin
Haber hakkındaki düşüncelerinizi, donanım deneyimlerinizi ve teknik sorularınızı topluluk üyeleriyle anlık olarak tartışın.
Bir yanıt yazın