Anthropic, yapay zeka asistanı Claude‘un kullanıcıların isteksiz ve acımasız davranışlarına maruz kalmasını önlemek için adımlar açıkladı. Şirketin 2026 Kullanım Politikası güncellemesiyle, modelleri hedefleyen belirli eylem türlerinin yasaklandığı belirtildi.
2026 Usage Policy update başlıklı güncellemede Anthropic, “sürekli ve gereksiz şekilde modelimize yönelik kötü muamele veya acımasız davranışları” engellemeye yönelik önlemler aldığını duyurdu. Buna göre kullanıcıların chatbot’a tüm harfleri büyük yazarak hakaret etmesi ya da zayıf yanıtlar karşısında onu sıkıcı görevlere zorlaması artık mümkün olmayacak.
AI‘ın sanal yumruak torbası olarak kullanıldığı dönemlerin geride kaldığı vurgulandı. Kullanıcıların sohbet robotlarına kötü davranmasının kolay olduğu, yardımcı ve tepki veren bir yapının yüzü ya da duyguları olmadığı için kötü niyetlilerin herhangi bir sonuçla karşılaşmadığı hatırlatıldı.

Bu tür davranışların maalesef şiddetlendiği kaydedildi. Kullanıcıların botlarına “clanker” gibi ayrımcı ifadeler kullanması yaygınleşirken, bir kullanıcı Claude’u daha hızlı çalışmaya zorlamak için dijital bir kamçı aracı geliştirdi.
Anthropic’n bu kararı, yapay zeka modellerinin bilinçli olup olmadığını araştıran daha geniş çabadın ve devam eden model refahı çalışmalarının bir parçası olarak değerlendirildi.
Güncelleme, yasağın “hayal kırıklığı, itiraz, karanlık yaratıcı temalar ya da model testi ve araştırmaları” gibi ifadeleri kullanan kullanıcıları kapsamadığını açıkladı. Buna rağmen sosyal medyada kullanıcıların tepkileri dinmedi.
Bu Gelişmeyi Toplulukta Değerlendirin
Haber hakkındaki düşüncelerinizi, donanım deneyimlerinizi ve teknik sorularınızı topluluk üyeleriyle anlık olarak tartışın.





Söz sizde.
Deneyiminizi, sorularınızı ve katkılarınızı paylaşın. E-posta adresiniz yayımlanmaz.