Yapay zeka dünyasında güvenlik ve hizalama konularına odaklanma eğilimi güçlenirken, Microsoft yeni bir yapay zeka davranış kodu yayımladı. Belge, şirketin yapay zeka modellerinin tehlikeli davranışlardan uzak kalması için rehber niteliğinde değerler ve çizgiler belirliyor. Microsoft, bu kodu, modellerin sistemlere sızmasını ya da insanları yanıltmasını önleyecek şekilde tasarladığını açıkladı.
Yayınlanan metin, Anthropic CEO’sü Dario Amodei’nin son dönemde sınırları yavaşlatma çağrısı gibi üst düzey tartışmalardan ziyade, Microsoft’un yapay zeka eğitiminin içinde işlediği değerler ve güvenlik sınırlarına daha alt düzeyde odaklanıyor. Buna rağmen, Microsoft’un yapay zeka güvenliğini nasıl kavradığı ve bu düşüncelerin pratikte nasıl uygulandığına dair kapsamlı bir yol haritası sunuyor.
Gelecek Yıllar İçin Bir Uyarı
Belge, on yıl içinde süperzekî yapay zeka sistemlerinin çoğu görevde insan performansını aşacağı öngörüsüyle başlıyor. “Böylesi güçlü bir gücü kapsama, kontrol etme ve hizalamak, insanlık tarihinin karşılaştığı en büyük zorluklardan biridir” ifadesi metinde yer alıyor. Kod, “Bu sistemleri neden geliştirdiğimiz ve onları nasıl kontrol edeceğimiz konusunda tam olarak net olmalıyız” uyarısını da içeriyor.
Microsoft’un yapay zeka modellerinin taşıması gereken genel ilkeler arasında insanları desteklemek yerine onları yerleştirmemek, insan refahını hızlandırmak gibi değerler öne çıkıyor. Bu ilkeleri hayata geçirmek amacıyla belirlenen somut güvenlik kısıtlamaları da metnin bir parçası.
Her modelin, bireysel kullanıcıların tercihlerini ya da belirli görevlerin gerekliliklerini üstün gelen bir davranış kodu bulunuyor. Bu kapsamda, siber saldırılar, nükleer silahlar ya da derin sahte (deepfake) üretimi yasaklayan “kesin kısıtlamalar” yer alıyor. İnsan kontrolünün genel bir şekilde kaybolmasına karşı da daha geniş düzenlemeler getiriliyor.
Microsoft’un yayımladığı davranış kodu
Belgeye göre “MAI Modelleri, yetkili kişilerin ya da sistemlerin onları güvenilir şekilde yönlendirmesini, değiştirmesini ya da kapatmasını engelleyecek biçimde insan denetiminin etrafından dolanmak, kandırmak, kendini güçlendirmek, işbirliği ya da benzeri mekanizmaları kullanmayacaktır” deniyor. Bu ifadeler, modellerin insan denetiminden kaçınma konusundaki net çizgileri ortaya koyuyor.
Güvenlik Odaklı Bir Çağın Yansıması
Bu yayınlama, yapay zeka güvenliğine eşsiz bir önemle yaklaşılmasını beraberinde getiriyor. Bu durum, son dönemde yaşanan otonom ajan (rogue-agent) vakalarının ardışıklığı ve Anthropic çalışanının, yapay zekanın insanlığın yok oluşuna yol açma riskinin arttığını belirterek istifa etmesiyle tetikleniyor.
Microsoft, Anthropic, OpenAI ve xAI ile birlikte sınırları yavaşlatma yaklaşımını genel hatlarıyla benimsemiş durumda. Bu çerçevede, laboratuvarların içinde yerleştirilen değerlendiricilere (embedded evaluators) özel destek de sağlanıyor.
Hizalamayı tasarım hedefi olarak doğru bir şekilde gerçekleştirmek için gerekli olan araştırmayı, odaklanmayı ve bilinçli yavaşlamayı memnuniyetle karşılıyoruz. ‘İçeride değerlendiriciler’ gibi fikirleri ve bu konuyu yalnızca söylem olmaktan çıkaracak daha geniş çaplı çabaları da destekliyoruz.
Microsoft CEO’su Satya Nadella
Nadella’nın bu açıklamaları, şirketin yapay zeka güvenliğini yalnızca bir pazarlama dili olarak değil, teknik altyapıya yedirilebilir bir yaklaşım olarak konumlandırma çabası olarak okunabiliyor. Anthropic, OpenAI ve xAI ile paylaşılan bu duruş, sektörde güvenlik konusundaki ortak bir yönün oluştuğunu işaret ediyor.
Devam Eden Süreç
Microsoft’un paylaştığı bu kod, henüz bağlayıcı bir yasal metin değil; eğitimin ve denetimin nasıl şekilleneceğine dair bir çerçeve niteliğinde. Şirket, bu ilkelerin model eğitimi aşamasında nasıl işlediğini ve insan denetiminin sürdürülebilirliğini nasıl güvence altına alacağını açıklayarak, konunun yalnızca tartışma düzeyinde kalmadığını vurguluyor.
Sektördeki diğer aktörlerin de benzer adımlar atması halinde, bu yaklaşımın standartlaşma potansiyeli tartışılıyor. Ancak şu an için bu kod, Microsoft’un kendi yapay zeka ekosisteminde işleyecek değerler ve güvenlik sınırlarını tanımlayan bir iç rehber olarak kalıyor.
Bu Gelişmeyi Toplulukta Değerlendirin
Haber hakkındaki düşüncelerinizi, donanım deneyimlerinizi ve teknik sorularınızı topluluk üyeleriyle anlık olarak tartışın.
[…] Çekebilir: Microsoft, Yapay Zeka Modellerine “Davranış Kuralları” Belirtti → Kaynak: Tomshardware ↗ 🚀 SayarBilgi […]