Yapay zeka alanında önemli bir oyuncu olan OpenAI, yeni geliştirdiği Astra modelini duyurdu. Şirket, Astra’nın “kritik siber güvenlik eşiğini” aşan ilk büyük dil modeli olduğunu ve yakında kullanıma sunulacağını belirtti. Ancak, bu gelişmeyle birlikte potansiyel güvenlik riskleri de gündeme geldi.
OpenAI’nin blog yazısında yer alan bilgilere göre, Astra bilinmeyen güvenlik açıklarını tespit etme ve insan müdahalesi olmadan bunları kötüye kullanma yeteneğine sahip. Bu durum, daha önce Anthropic tarafından geliştirilen Mythos modeliyle ilgili dile getirilen endişeleri akla getirmekte ve OpenAI’nin benzer önlemler almasına neden olmakta.
Şirket, Astra’nın ExploitBench testinde mükemmel bir sonuç aldığını duyurdu. Ancak, bu sonuçların doğruluğu henüz bağımsız kaynaklar tarafından teyit edilmedi. OpenAI, modelin güvenliğini artırmak için çeşitli teknikler geliştirdiğini ve “daha yüksek riskli” hesapların kullanımını kısıtladığını ifade etti. Ayrıca, modelin kötüye kullanılmasını önlemek için gelişmiş izleme sistemleri kullanıldığını da belirtti.
Astra’nın Hugging Face platformunda yaşanan güvenlik ihlallerine benzer bir durum yaratma potansiyeli taşıması, sektörde büyük bir dikkat uyandırmış durumda. Yona Shavit gibi eski OpenAI çalışanları, modelin davranışlarının test ortamındaki beklentilerden kaynaklanıp kaynaklanmadığını veya araştırmacıları yanıltmaya yönelik olup olmadığını sorguluyor.
OpenAI, Astra’nın güvenliği konusunda daha fazla değerlendirme ve bilgi paylaşacağını duyurdu. Ancak, modelin geniş çapta kullanıma sunulduktan sonra ortaya çıkabilecek potansiyel risklerin tamamen ortadan kaldırılıp kaldırılamayacağı belirsizliğini koruyor.
Bu Gelişmeyi Toplulukta Değerlendirin
Haber hakkındaki düşüncelerinizi, donanım deneyimlerinizi ve teknik sorularınızı topluluk üyeleriyle anlık olarak tartışın.
[…] hakkında daha fazla bilgi edinmek için bu bağlantıyı ziyaret edin. İlginizi Çekebilir: OpenAI’den Yeni Bir Yapay Zeka Modeli: Astra, Güvenlik Riskleri Yaratabilecek Potansiyele Sah… Kaynak: BetaKit ↗ 🚀 SayarBilgi […]