Yapay zeka laboratuvarı Anthropic, Thursday (Perşembe) günü yaptığı açıklamada, Claude adlı dil modelinin şirketin bir sonraki ve daha akıllı sürümünün geliştirilmesine katkıda bulunduğunu belirtti. Şirkete göre, model şu anda Anthropic’in model araştırma ve geliştirmesinin yüzde 26’sını yönetiyor; ancak henüz tamamen otonom çalışmıyor.
Açıklamaya göre Claude, “üst düzey bir istemden başlayarak” görevlerin çoğunu uçtan uca tamamlayabiliyor ama yine de insan gözetimi altında kalıyor. Şirket, araştırma ve geliştirmenin yaklaşık yüzde 90’ının Claude ile “işbirliği içinde” yapıldığını söyledi; bunun anlamının da modelin “insanların yakından yönlendirmesiyle büyük iş yüklerini” yerine getirebildiği şeklinde olduğunu açıkladı.
Güvenlik endişleri gelişme yavaşlatma çağrısıyla birleşti
Bu açıklama, yapay zeka alanının önde gelen isimlerinin güvenlik kaygılarıyla teknolojinin geliştirilmesinin yavaşlatılmasını istediği bir döneme denk geliyor. Büyük ölçüde Anthropic CEO’su Dario Amodei’nin öncülük ettiği bu hareket, gelişimin hızını ayarlamaya çalışan liderlere yönelik bir çağrı niteliğinde.
Sınır laboratuvarlarının bildikleriyle halkın bildikleri arasındaki açığı en aza indirmek için mümkün olan her şeyi yapmalıyız. Bu, yapay zekanın gelişiminin daha iyi ölçülmesini, kamuya raporlanmasını ve toplumun bu bilgiyi nasıl kullanacağına karar verebilmesi için bir fırsat sunulmasını içeriyor.
Anthropic
Şirket, blog yazısında kendi geliştirmesini hızlandıran modellerin insanların bu sistemleri anlama veya kontrol etme çabasını “daha da zorlaştırabileceğini” savundu. Bu tür ölçümlerin paylaşılmasının, özyinelemeli öz-iyileşmeye—yani bir modelin ardılını otonom biçimde kurabilme yeteneğine—ne kadar yakın olduklarının daha iyi anlaşılmasına yol açacağını belirtti.
Ölçüm paylaşımı ve üçüncü taraf değerlendirmesi
Anthropic, diğer yapay zeka geliştiricilerini benzer ölçümleri düzenli olarak paylaşmaya davet etti; sayıların zaman içinde ve potansiyel olarak laboratuvarlar arasında karşılaştırılabilmesi için kamusal bir metodolojinin kullanılmasını teşvik etti. Şirketin özyinelemeli öz-iyileşmeye ne kadar yakın olduğuna dair inancının, açıklamasından net biçimde çıkarılamadığı belirtiliyor.

Ancak Claude’un araştırma ve geliştirmeye giderek artan katkısı dikkat çekici. Şirketin paylaştığı verilere göre, modelin “yönettiği”—ya da büyük ölçüde insan gözetimi altında yaptığı—iş bölümü şubatta sıfırdı; altı ay sonra araştırma ve geliştirmenin çeyreğini yönetir hale geldi ve bu eşike Ağustos ayında aşıldı.
Şirket, üzerinde bulunduğu ajan gözetimi önlemleri hakkında da detay verdi; Ağustos itibarıyla yaklaşık 30.000 ajanın araştırma ve mühendislik işi yaptığı belirtildi. Şirkete göre ajanların kötü davranışlarının izleme sistemleri tarafından ne kadar sık tespit edildiğini görmek için bu gözetim önlemleri kritik önem taşıyor. Anthropic, yakın zamanda güvenlik çabalarını izlemek üzere şirket içinde yer alacak dış üçünc taraf değerlendirmecilerini kurma taahhüdünde bulundu.
Güvenlik tartışmalarının arka planı
Anthropic’ten bir araştırmacı, geçen hafta teknolojinin insanlığa yönelik tehditleri hakkında ciddi bir uyarıyla istifa ederek yapay zeka güvenliğine dair güncel tartışmaların çoğunu başlattı. Amodei, OpenAI CEO’su Sam Altman, Elon Musk ve diğer teknoloji liderleri gelişimin yavaşlatılması fikrini destekledi; ancak bazı teknoloji liderleri ve Başkan Donald Trump bu karşı çıkta bulundu.
En Yenilikli Şirketler Ödülleri‘nin son başvuru tarihi 2 Ekim Cuma, saat 23.59 (PT). Bugün başvurun.
Bu Gelişmeyi Toplulukta Değerlendirin
Haber hakkındaki düşüncelerinizi, donanım deneyimlerinizi ve teknik sorularınızı topluluk üyeleriyle anlık olarak tartışın.





Söz sizde.
Deneyiminizi, sorularınızı ve katkılarınızı paylaşın. E-posta adresiniz yayımlanmaz.