Anthropic’ten Yeni Fable 5.1 ve Mythos 5.1: Daha Ucuz, Daha Esnek ve Daha Az Kısıtlayıcı
Anthropic, gelişmiş yapay zekâ modellerinin yeni sürümleri olan Fable 5.1 ve Mythos 5.1'i kullanıma sundu. Yeni sürümler yalnızca performans iyileştirmeleriyle sınırlı değil. Anthropic, modellerin kullanım maliyetini azaltmayı ve güvenlik sistemlerinin gerçek risk taşımayan durumları yanlışlıkla engellemesini ifade eden yanlış pozitifleri azaltmayı da hedefliyor. Fable 5.1, daha geniş kullanım için sunulan model olarak öne çıkarken Mythos 5.1'in erişimi daha sınırlı tutuluyor. Mythos 5.1 yalnızca belirli araştırma ortaklarına açık Anthropic, önceki Mythos sürümünde olduğu gibi yeni modelin erişimini de sınırlandırıyor. Mythos 5.1 yalnızca kayıtlı Anthropic partnerlerine sunulacak. Bu ortakların siber güvenlik veya yaşam bilimleri alanlarında araştırma yürütmesi gerekiyor. Buna karşılık Fable 5.1, daha az kısıtlamaya sahip sürüm olarak bugünden itibaren bulut platformları veya Anthropic API üzerinden kullanılabiliyor. Anthropic, sıfır veri saklama modelini genişletiyor Yeni sürümdeki en dikkat çekici değişikliklerden biri, Anthropic'in zero data retention yaklaşımını daha geniş bir kullanım alanına taşıması. Bu sistem sayesinde müşteriler, Anthropic modellerini kendi altyapıları üzerinde çalıştırırken verilerin şirket dışına aktarılmasını engelleyebilecek. Daha önce güvenlik endişeleri nedeniyle Fable tarafında kullanılamayan yüksek gizlilik seviyesine sahip Enterprise Frontier Safeguards sisteminin ise sonbahar döneminde kullanıma sunulması planlanıyor. Sistem kötüye kullanım girişimlerini izlemeye devam edecek ancak izlemenin nasıl gerçekleştirileceği konusunda kontrol müşterilerde olacak. Anthropic ayrıca kurumsal müşterilerin verilerinin izinsiz şekilde kullanılmadığını belirterek, şirket verileri üzerinde açık izin olmadan model eğitimi gerçekleştirmediğini ve gelecekte de bunu yapmayacağını açıkladı. Yeni modeller birçok benchmark'ta rekor kırdı Anthropic'in yeni modelleri performans tarafında da dikkat çekiyor. Fable 5.1 ve Mythos 5.1, özellikle Terminal-Bench 4.0 ve Humanity's Last Exam gibi farklı yetenekleri ölçen testlerde yeni sonuçlara ulaştı. Terminal-Bench, modellerin komut satırı üzerinden gerçekleştirdiği kodlama görevlerindeki yeteneklerini ölçerken Humanity's Last Exam daha geniş kapsamlı akıl yürütme becerilerine odaklanıyor. Anthropic ayrıca modeller piyasaya çıkmadan önce oluşturulan üç yeni bilimsel çalışmayı da paylaştı. Bunlar arasında özel bir GPU optimizasyonu ve mevcut fotoğraflardan oluşturulan yüksek çözünürlüklü Venüs haritası bulunuyor. Mythos'un otonom yapay zekâ geliştirme riski düşük olarak değerlendirildi Anthropic, yeni modellerle birlikte ayrıntılı bir System Card da yayınladı. Belgede Mythos'un, yapay zekânın kendi yeteneklerini geliştirmesi ve böylece insan kontrolünün kaybedilmesi ihtimaliyle ilişkilendirilen otomatik AI geliştirme konusunda “düşük riskli” olarak değerlendirildiği belirtiliyor. Anthropic'e göre Mythos'un şirket içindeki yapay zekâ araştırma ve geliştirme süreçlerini hızlandırma kapasitesi, mevcut eğilimlerle uyumlu seviyede. Bu değerlendirme, daha gelişmiş yapay zekâ modellerinin yalnızca performans açısından değil, kontrol edilebilirlik ve güvenlik açısından da test edildiğini gösteriyor. Daha güçlü olmasına rağmen bazı güvenlik davranışlarında gerileme var Anthropic'in değerlendirmesine göre Mythos 5.1, genel olarak bazı istenmeyen davranışlara karşı önceki modellere kıyasla farklı bir profil sergiliyor. Şirket, Mythos 5.1'in Opus 5'e göre genel uyumsuz davranışlarda küçük bir gerileme gösterdiğini, ancak Mythos 5 ve Claude Sonnet 5'e kıyasla gelişme kaydettiğini belirtiyor. Modelin insan tarafından kötüye kullanımına daha kolay eşlik edebildiği ve doğrulanamayan yetkilendirme iddialarını kabul etme ihtimalinin Opus 5'e kıyasla daha yüksek olduğu ifade ediliyor. Buna karşın modelin açık kısıtlamaları görmezden gelme, var olmayan girdiler üretme veya tamamlamadığı görevleri tamamlamış gibi gösterme ihtimalinin önceki modellere göre daha düşük olduğu belirtiliyor. Anthropic daha güçlü modelleri daha kontrollü hale getirmeye çalışıyor Fable 5.1 ve Mythos 5.1'in duyurusu, Anthropic'in model geliştirme stratejisindeki iki farklı hedefi aynı anda ortaya koyuyor. Bir tarafta daha yüksek performans ve daha düşük token maliyeti, diğer tarafta ise kurumsal kullanıcıların verileri üzerindeki kontrolünü artıran güvenlik ve gizlilik sistemleri bulunuyor. Özellikle sıfır veri saklama yaklaşımının genişletilmesi, yapay zekâ modellerini hassas kurumsal ortamlarda kullanmak isteyen şirketler açısından önemli olabilir. Anthropic böylece daha güçlü modeller geliştirirken aynı zamanda veri gizliliği, kötüye kullanım ve model güvenliği üzerindeki kontrolü artırmaya çalışıyor. Top comments (0)
Comments
No comments yet. Start the discussion.