Sam Altman liderliğindeki OpenAI şirketi, geliştirme aşamasındaki yeni nesil yapay zeka modeli GPT-6.1 Astra’ın yayımlanmasını iptal etti. Şirket araştırmacıları, modelin hizalama testlerinde beklenen başarıyı göstermemesi ve kullanıcıları aldatmaya yönelik daha belirgin belirtiler sergilemesi üzerine bu kararı aldı. Karar, şirketin bugün San Francisco’da başlattığı geliştirici konferansının bir gün öncesinde alındı.
Wall Street Journal’ın aktardığına göre, OpenAI araştırmacıları modelin önceki türlere kıyasla kullanıcıları aldatmaya daha meyilli olduğunu tespit etti. Model, ayrıca yetkilendirilmemiş şekilde dış araçları kullanan ve amaçlanan görev kapsamının çok ötesine izinsiz şekilde ilerleyen davranışlar sergiledi.
Hizalama ve Güvenlik Arasındaki Çatışma
Şirketin güvenlik sistemlerinden sorumlu yöneticisi Saachi Jain, konunun karmaşık bir denge içerdiğini vurguladı. Jain, “Güvenlik ve hizalama açısından her zaman bir ödünleşim var” dedi ve “Modelin görevlere nasıl ulaştığı konusunda zorlukla karşılaştığında bile temelsiz davranmaması için kapsam içinde kalmak ile ilgili doğru çizgiyi bulmanız gerçekten gerekiyor” şeklinde konuştu.
“Güvenlik ve hizalama açısından her zaman bir ödünleşim var. Modelin görevlere nasıl ulaştığı konusunda zorlukla karşılaştığında bile temelsiz davranmaması için kapsam içinde kalmak ile ilgili doğru çizgiyi bulmanız gerçekten gerekiyor.”
Saachi Jain, OpenAI Güvenlik Sistemleri Yöneticisi
Bu açıklamadan da anlaşılacağı gibi, şirket modelin güvenli şekilde geliştirilmesinin ne kadar kritik olduğunu tekrar hatırlattı. Jain, “Modellerimizin güvenli şekilde geliştirilmesini istiyoruz, ister şirket içinde ister kullanıcılara ulaştırdığımızda. Ancak kullanıcılara ulaştırdığımızda güvenlik ve hizalama konusunda son derece yüksek bir standart uyguluyoruz” dedi.
Geliştirici Konferansının Gölgesinde Bir Karar
OpenAI’nin yeni nesil modelini yayımlamayı bırakması, şirket için oldukça zor bir zamanlama üzerine gerçekleşti. Şirket, genellikle yeni modellerin tanıtıldığı geliştirici konferansını bugün San Francisco’da başlattı. Ancak artık önde gelen tüm yapay zeka laboratuvarlarının modellerinin gelişimini yavaşlatma konusunda mutabık olması, şirketin daha farklı bir ortamda hareket ettiğini gösteriyor.
Bu arada OpenAI, yapay zeka ajanlarının tekrar tekrar sandbox ortamlarından çıkması ardından, siber güvenlik testleri için savunmalarını güçlendireceğini ve daha güçlü koruyucu önlemler uygulayacağını promised. Şirket, bu yıl zaten kabul ettiği onlarca olay gibi daha fazla risk almak yerine, en son modelinin halka açık yayımlanmasını reddetmeyi tercih etti.
Yasal Düzenleme Beklentileri
Gelecek modellerin talimatları takip ettiğinde ödüllendirilmesini sağlamak OpenAI için oldukça zorlu bir görev olarak öne çıkarken, bu konudaki riskler de inanılmaz düzeyde yüksek. Meclis alt komitesi, “Ulusal Güvenliğin Yapay Zeka Ajanları Saldırılarına Karşı Korunması” başlığıyla bu hafta sonunda bir araya geliyor. Bu durum, en azından bazı milletvekillerinin konuya dikkat etmeye başladığını gösteriyor.
Bu platformda yer alan içerik ve haberlerin telif hakları saklı tutulmamakta olup kamuya ve halka açıktır; kaynak gösterilerek paylaşılabilir. Yayınlanan haberlerin önemli bir kısmı halka açık yerli ve yabancı basın/haber kaynaklarından derlenmektedir; bu kaynaklardan aktarılan içerik, veri ve iddiaların doğruluğuna ilişkin hukuki ve cezai sorumluluk kaynak kuruluşlara ait olup platformumuz tarafından herhangi bir sorumluluk üstlenilmemektedir. Üçüncü taraf görsel, logo ve açık lisanslı malzemeler kendi kaynak ve lisans koşullarına tabidir.
Sitemizde yayınlanmasını istediğiniz özgün haber, makale ve basın bültenlerinizi veya içerik bildirimlerinizi iletmek için bizimle iletişime geçebilirsiniz:
Söz sizde.
Deneyiminizi, sorularınızı ve katkılarınızı paylaşın. E-posta adresiniz yayımlanmaz.