Anthropic, Claude Fable 5.1 ve Claude Mythos 5.1 modellerini duyurdu. Şirket, bu modellerin kodlama ve bilgi çalışmaları için dünyanın en gelişmiş modelleri olduğunu ve araştırma yeteneklerinin, yapay zekanın bilimsel ilerlemeye nasıl katkı sağlayacağına dair erken bir bakış sunduğunu belirtiyor.

Fable 5.1 ve Mythos 5.1 aynı modelin farklı güvenlik önlemlerine sahip sürümleri. Fable 5.1 genel kullanıma açıkken, Mythos 5.1 yalnızca güvenilir erişim programları aracılığıyla sunuluyor ve siber güvenlik ile yaşam bilimleri alanlarındaki çalışmaları desteklemek üzere tasarlanmış.

Fable 5.1, fiyatlandırma, veri saklama ve güvenlik önlemleri konularında müşteri geri bildirimlerini ele alıyor. Token başına faturalandırılan tipik iş yüklerinde Fable 5.1'in maliyeti Fable 5'e kıyasla tahmini %25 daha düşük olacak. Önbellek okuma fiyatlarındaki indirim sayesinde, yüksek düzeyde aracı (agentic) işlerde tasarruf %45'e kadar çıkabiliyor.

Veri saklama tarafında, Enterprise Frontier Safeguards (EFS) sistemi, müşterilere sıfır veri saklama politikasıyla aynı düzeyde tam gizlilik sunarken, kötüye kullanımı önlemede son teknoloji olmayı sürdürüyor. EFS, verileri Anthropic'in değil, tamamen müşterinin kontrolündeki bulut altyapısında saklıyor. Kurumsal müşterilere bu sonbaharın ilerleyen dönemlerinde aşamalı olarak sunulacak. EFS kullanıma sunulana kadar uygun müşteriler Fable 5.1'i sıfır veri saklama ile kullanabilecek.

Güvenlik önlemleri iyileştirildi: siber güvenlikte yanlış pozitifler (zararsız içeriğin işaretlenmesi) %60 daha az engelleniyor. Fable 5.1 artık yazılım açıklarını keşfedebiliyor ancak bunları istismar edecek araçlar geliştiremiyor. Biyoloji alanında, ABD hükümetiyle ortaklaşa geliştirilen bir erişim programı, Claude Mythos 5.1'in ileri düzey biyoloji yeteneklerine erişim sağlayacak. Bilim insanları için kayıtların yakında açılması bekleniyor.

Fable 5.1, kodlama, bilgi çalışması ve uzun soluklu problem çözme görevlerinde yeni bir standart belirliyor. Düşük veya orta efor seviyelerinde, Fable 5.1 selefi Fable 5'in sonuçlarına benzer veya daha iyi performans gösterirken maliyeti çok daha düşük. Claude Code'da varsayılan olarak yüksek efor, Claude Cowork ve Claude.ai'de ise orta efor kullanılıyor.

Şirketin paylaştığı kıyaslama sonuçlarına göre, Fable 5.1 Terminal-Bench-Science 0.1'de %52.6, Terminal-Bench 4.0'da %55.8, GDPval-AA v2'de 1853 puan, OSWorld 2.0'da %77.9 (kısmi) ve %41.7 (tam), Humanity's Last Exam'de %60.9 (araçsız) ve %65.0 (araçlı), AutomationBench'te %31.4 ve CursorBench 3.2.0'da %73.4 başarı elde etti. Bu sonuçlar, Fable 5, Opus 5 ve GPT-5.6 Sol gibi rakip modellerin çoğunun üzerinde.

Erken erişim ortakları da modelin performansına dair olumlu geri bildirimlerde bulundu. Jane Street Capital'den Craig Falls, Fable 5.1'in iç kıyaslamalarda Fable 5 veya Opus 5'ten daha fazla kodlama problemini çözdüğünü ve ticaret sezgisinde son teknolojiye ulaştığını belirtti. Cognition'dan Walden Yan, Opus 5 trafiğini Devin'de lansman gününde Fable 5.1'e taşıyacaklarını söyledi. Millennium'dan Damien, Fable 5.1'in ekibinin yıllardır açıklayamadığı nadir bir çökmenin nedenini bulduğunu aktardı. MongoDB'den Ron Sanzone, modelin yaklaşık üç günde karmaşık bir prototip geliştirdiğini ifade etti. Every'den Dan Shipper, Fable 5.1'in Fable düzeyinde zeka, Opus düzeyinde fiyat ve Sonnet hızı sunduğunu, Opus 5'ten yaklaşık iki kat daha hızlı ve yarı yarıya daha az token kullandığını söyledi.

Diğer geri bildirimler arasında, IMC'den Marquis Wong modelin yaratıcı problem çözmede yeni bir eksende çözüm ürettiğini, Red Hat'ten Josh Boyer tüm kırık derlemelerin kök nedenini doğru tespit ettiğini, Rakuten'den Felix Giovanni Virgo üç öncü modelin onayladığı bir klinik araştırma projesinde gözden kaçan bir boşluk bulduğunu, Square'den Willem Avé simüle işletme değerlendirmesinde token başına çok daha verimli olduğunu, Ramp'ten Dwight Temple 38 saatlik kesintisiz bir çalışmada makine öğrenimi problemini teşhis edip düzelttiğini, Canva'dan Danny Wu yazma kalitesinin daha iyi olduğunu ve ritim oyunu geliştirdiğini, Hebbia'dan Aabhas Sharma PowerPoint ve alıntı değerlendirmelerinde en iyi sonuçları aldığını, Plaid'den Aditya Gupta sekiz hizmeti kapsayan bir değişikliği uçtan uca doğru haritaladığını, Glean'den Nilesh Dalvi cevapların Fable 5'e göre yaklaşık 2'ye 1 tercih edildiğini ve iGent'ten Sea ise zorlu problemlerde diğer modellerden net şekilde ayrıştığını ve Fable 5'in takıldığı bir çekirdeği yaklaşık %35 optimize ettiğini belirtti.

Neden önemli

Fable 5.1'in fiyatlandırması ve veri saklama politikaları, kurumsal müşterilerin yapay zeka modellerini benimsemesindeki iki önemli engeli hedefliyor. Önbellek okuma fiyatlarındaki indirim, özellikle uzun ve aracılı iş yükleri için maliyetleri ciddi şekilde düşürüyor. EFS sistemi ise veri gizliliği endişelerini, verileri müşterinin kontrolündeki altyapıda tutarak çözmeyi amaçlıyor.

Modelin kodlama ve araştırma yeteneklerindeki artış, işletmelerin yapay zekaya devrettiği görevlerin kapsamını genişletebilir. Millennium örneğindeki gibi, insan mühendislerin yıllardır çözemediği sorunları çözebilmesi, yapay zekanın sadece bir yardımcı değil, bağımsız bir problem çözücü olarak rolünü güçlendiriyor. Ancak Mythos 5.1'in yalnızca güvenilir erişim programlarıyla sunulması, gelişmiş yeteneklerin kötüye kullanım riskine karşı alınan önlemlerin sürdüğünü gösteriyor.

Fable 5.1'in siber güvenlikte açık keşfi yapabilmesi ancak istismar geliştirememesi, biyoloji alanında ise hükümet ortaklığıyla erişim programı kurulması, güvenlik ile fayda arasında dengeli bir yaklaşımın işareti. Bu, yapay zeka modellerinin yetenekleri arttıkça, güvenlik önlemlerinin de aynı hızda gelişmesi gerektiğini ortaya koyuyor.