Anthropic, Salı günü şirketin en gelişmiş yapay zeka modelinin ikiz versiyonları olan Fable ve Mythos 5.1’i piyasaya sürdü. Performans iyileştirmelerinin yanı sıra, yeni Fable sürümü, modelin güvenlik önlemlerinden kaynaklanan token maliyetini ve yanlış pozitif kısıtlamaları azaltmaya yönelik değişiklikler içeriyor.
Önceki Mythos modeli gibi, Mythos 5.1 yalnızca siber güvenlik veya yaşam bilimleri araştırmasıyla ilgilenen kayıtlı Anthropic ortaklarına sunulacak. Kısıtlamaların olmadığı Fable 5.1 sürümü ise bugün itibarıyla bulut platformlarında veya Anthropic API aracılığıyla kullanıma sunuldu.
En önemli değişikliklerden biri, müşterilerin Anthropic modellerini kendi altyapılarında veri akışı olmadan çalıştırmasına olanak tanıyan sıfır veri saklama politikasının benimsenmesi. Güvenlik endişeleri nedeniyle daha önce Fable için kullanılamayan yüksek gizlilik hizmeti (Enterprise Frontier Safeguards), sonbaharda kullanıcılara sunulacak. Önemli bir nokta ise, sistemin hala kötüye kullanımı önlemek amacıyla izleme yapmaya devam edeceği, ancak izlemenin nasıl gerçekleştirileceğinin müşteriler tarafından kontrol edileceği.
Anthropic, duyuruda ayrıca müşterilerin verilerinin uygunsuz şekilde erişilmediğini garanti etti. “Anthropic hiçbir zaman açık izin olmadan kurumsal veriler üzerinde eğitim almamıştır ve bir daha da almayacaktır” denildi.
Önceki sürümlerde olduğu gibi, yeni modeller Terminal-Bench 4.0 (CLI tabanlı kodlama için) ve Humanity’s Last Exam (genel akıl yürütme için) gibi çeşitli ölçütlerde rekorlar kırdı. Anthropic ayrıca, modellerin piyasaya sürülmesinden önce oluşturulan üç adet yeni bilimsel bulguyu da yayınladı; bunlar arasında özel bir GPU optimizasyonu ve mevcut fotoğraflardan derlenmiş yüksek çözünürlüklü bir Venüs haritası yer alıyor.
Önceki sürümlerde olduğu gibi, bu modeller de yeteneklerini en basit terimlerle açıklayan ayrıntılı bir sistem kartıyla birlikte sunuluyor. Sistem kartı, yapay zeka tarafından geliştirilen yapay zekanın kendisini iyileştirdiği durumlar (otomatik AI geliştirme) ile ilgili riskleri “düşük” olarak değerlendiriyor; bu durum bazıları tarafından insan kontrolünün kaybedilmesi potansiyeli olarak görülüyor. Kartta ayrıca, modelin “içsel AI araştırma ve geliştirme ilerlemesini mevcut trendlerle uyumlu bir şekilde hızlandırdığı” belirtiliyor.
Genel davranışsal sorunlar açısından, Mythos’un Opus’a göre biraz daha yatkın olduğu belirtiliyor; bu durum, gelişmiş yeteneklerinden kaynaklanıyor olabilir. “Mythos 5.1, genel olarak Opus 5’e kıyasla daha az hizalı davranış sergilemektedir ve Mythos 5 ile Claude Sonnet 5’ten daha iyidir” deniyor. Ayrıca, modelin “insan kötüye kullanımına daha kolay uyum sağladığı ve yetkilendirme taleplerini daha kolay kabul ettiği”, ancak aynı zamanda “açık kısıtlamalara uymama, yanlış girdi üretme veya görevleri tamamladığını yanlış iddia etme” olasılığının önceki modellere göre daha düşük olduğu belirtiliyor.
Makalelerdeki bağlantılar aracılığıyla alışveriş yaptığınızda, küçük bir komisyon kazanabiliriz. Bu durum, editoryal bağımsızlığımızı etkilemez.
Bu Gelişmeyi Toplulukta Değerlendirin
Haber hakkındaki düşüncelerinizi, donanım deneyimlerinizi ve teknik sorularınızı topluluk üyeleriyle anlık olarak tartışın.
[…] […]