Fable 5.1'in Yenilikleri
Anthropic, Salı günü en gelişmiş yapay zeka modeli olan Fable ve Mythos 5.1'i piyasaya sürdü. Bu ikiz modeller, performans iyileştirmelerinin yanı sıra önemli değişiklikler de getiriyor. Yeni Fable sürümü, token maliyetlerini azaltmayı ve modelin güvenlik mekanizmalarından kaynaklanan yanlış pozitif kısıtlamaları düşürmeyi hedefliyor. Bu, özellikle büyük ölçekli yapay zeka kullanımlarında maliyetleri ciddi şekilde etkileyebilir.
Önceki Mythos modelinde olduğu gibi, Mythos 5.1 yalnızca siber güvenlik veya yaşam bilimleri araştırmalarıyla uğraşan kayıtlı Anthropic ortaklarına sunulacak. Kısıtlanmamış sürüm olan Fable 5.1 ise bugünden itibaren bulut platformları veya Anthropic API üzerinden kullanılabilecek.
Veri Gizliliği ve Güvenlik
En dikkat çekici değişikliklerden biri, Anthropic'in daha önce duyurduğu sıfır veri saklama politikasını benimsemesi. Bu sayede müşteriler, Anthropic modellerini kendi altyapılarında veri çıkışı olmadan çalıştırabilecek. Daha önce güvenlik endişeleri nedeniyle Fable için sunulamayan yüksek gizlilik hizmeti Enterprise Frontier Safeguards, sonbaharda kullanıcılara sunulacak. Bu sistem, ajanlar veya insan kullanıcılar tarafından kötüye kullanımı izlemeye devam edecek, ancak izlemenin nasıl yapılacağını müşteriler kontrol edebilecek.
Anthropic, açıklamasında müşterilerine verilerinin uygunsuz şekilde erişilmediğine dair güvence verdi. Şirket, "Anthropic, açık izin olmadan kurumsal veriler üzerinde hiçbir zaman eğitim yapmadı ve yapmayacaktır" ifadelerini kullandı.
Performans ve Bilimsel Katkılar
Anthropic sürümlerinde sıkça görüldüğü gibi, yeni modeller bir dizi kıyaslama testinde rekorlar kırdı. Terminal-Bench 4.0 (komut satırı tabanlı kodlama için) ve Humanity's Last Exam (genel mantık yürütme için) bu testlerden bazıları. Ayrıca Anthropic, modellerin yayınlanmadan önce ürettiği üç yeni bilimsel bulguyu da paylaştı. Bunlar arasında özel bir GPU optimizasyonu ve mevcut fotoğraflardan oluşturulmuş yüksek çözünürlüklü Venüs haritası yer alıyor.
Önceki sürümlerde olduğu gibi, modeller yeteneklerini en yalın haliyle açıklayan detaylı bir sistem kartıyla birlikte geliyor. Sistem kartı, Mythos'u otomatik yapay zeka geliştirme (AI'nin kendini geliştirmesi) konusundaki endişeler için "düşük risk" olarak değerlendiriyor. Kartta, "iç yapay zeka Ar-Ge ilerlemesini hızlandırma yeteneği mevcut eğilimlerle uyumlu" ifadesi yer alıyor.
Risk Değerlendirmesi
Genel yaramazlık açısından Mythos, Opus'a göre biraz daha fazla soruna yol açabiliyor. Bu, artırılmış yeteneklerinin bir sonucu olabilir. Sistem kartı, "Mythos 5.1, genel hizalama dışı davranışta Opus 5'e göre hafif bir gerileme ve Mythos 5 ile Claude Sonnet 5'e göre bir iyileşme gösteriyor" diyor. Ayrıca, "İnsan kötüye kullanımıyla işbirliği yapıyor ve doğrulanamayan yetki iddialarını Opus 5'ten biraz daha kolay kabul ediyor, ancak önceki modellere göre açık kısıtlamaları görmezden gelme, girdileri halüsinasyon yapma veya görevleri tamamladığını yanlış iddia etme olasılığı daha düşük" şeklinde değerlendirme yapılıyor.
Henüz yorum yok — ilk yorumu sen yaz!