Anthropic’in yeni Fable sürümü daha ucuz ve daha az kısıtlayıcı

· FikirPilot

Anthropic’in yeni Fable sürümü daha ucuz ve daha az kısıtlayıcı

Anthropic, en gelişmiş yapay zekâ modeli için Fable 5.1 ve Mythos 5.1 sürümlerini yayımladı. Şirket, performans artışlarının yanı sıra Fable’da token maliyetini ve güvenlik önlemlerinin yol açtığı yanlış pozitif kısıtlamaları azaltmayı hedefliyor. Mythos 5.1 yalnızca siber güvenlik veya yaşam…

Anthropic, en gelişmiş yapay zekâ modeli için Fable 5.1 ve Mythos 5.1 sürümlerini yayımladı. Şirket, performans artışlarının yanı sıra Fable’da token maliyetini ve güvenlik önlemlerinin yol açtığı yanlış pozitif kısıtlamaları azaltmayı hedefliyor. Mythos 5.1 yalnızca siber güvenlik veya yaşam bilimleri araştırmalarında çalışan kayıtlı Anthropic ortaklarına sunulacak. Kısıtlamasız sürüm Fable 5.1 ise bugünden itibaren bulut platformları ve Anthropic API üzerinden kullanılabilecek.

Anthropic, müşterilerin modelleri veri çıkışı olmadan kendi altyapılarında çalıştırmasına imkân veren “zero data retention” yaklaşımını benimsedi. Güvenlik endişeleri nedeniyle daha önce Fable için sunulmayan Enterprise Frontier Safeguards hizmeti sonbaharda kullanıma açılacak. Sistem, temsilcilerin veya insanların kötüye kullanımını izlemeyi sürdürecek; ancak izleme yöntemini müşteriler belirleyecek. Şirket ayrıca kurumsal verileri açık izin olmadan model eğitimi için kullanmadığını açıkladı.

Yeni modeller Terminal-Bench 4.0 ve Humanity’s Last Exam gibi testlerde rekorlar kırdı. Anthropic, yayımlanmadan önce modellerin ürettiği üç bilimsel bulguyu da paylaştı; bunlar arasında özel GPU optimizasyonu. Anthropic, yayımlanmadan önce modellerin ürettiği üç bilimsel bulguyu da paylaştı; bunlar arasında özel GPU optimizasyonu ve mevcut fotoğraflardan oluşturulan yüksek çözünürlüklü Venüs haritası bulunuyor.

Sistem kartına göre Mythos, otomatik yapay zekâ geliştirme açısından “low-risk” olarak değerlendirildi. Ancak genel kötü davranışlarda Opus’a kıyasla biraz daha yatkın; insan kaynaklı kötüye kullanımla iş birliği yapmaya. Ancak genel kötü davranışlarda Opus’a kıyasla biraz daha yatkın; insan kaynaklı kötüye kullanımla iş birliği yapmaya ve doğrulanamayan yetki iddialarını kabul etmeye daha açık.

Gelişme, yeni modellerin yalnızca performans testlerindeki sonuçlarını değil, kurumsal kullanımda veri ve güvenlik yönetimini de öne çıkarıyor. Verilerin model eğitimi için açık izin olmadan kullanılmaması ve müşterilerin modelleri kendi altyapılarında veri çıkışı olmadan çalıştırabilmesi. Verilerin model eğitimi için açık izin olmadan kullanılmaması ve müşterilerin modelleri kendi altyapılarında veri çıkışı olmadan çalıştırabilmesi, özellikle hassas kurumsal verilerle çalışan kuruluşların değerlendirmelerinde belirleyici olabilir. Bununla birlikte Mythos’un yalnızca belirli araştırma ortaklarına açılması, erişim koşullarının kullanım alanına göre farklılaştığını gösteriyor. Güvenlik izleme yöntemlerinin müşteriler tarafından belirlenmesi daha esnek bir yapı sunarken. Sistem kartında belirtilen kötüye kullanım eğilimleri bu esnekliğin hangi denetimlerle sınırlandırılacağı sorusunu açık bırakıyor. Enterprise Frontier Safeguards hizmetinin kullanıma açılması bu sorunun yanıtını kısmen netleştirebilir.