Anthropic, 24 Temmuz 2026'da büyük dil modeli (LLM) Claude Opus 5'i hem sohbet robotu hizmetine hem de geliştirici platformuna sundu. Şirket, yeni modelin birçok alanda en üst düzey algoritması Mythos 5'in çıktı kalitesine yaklaştığını, ancak önemli ölçüde daha düşük maliyetle çalıştığını belirtiyor. Mythos 5, siber güvenlik riskleri nedeniyle kamuya açılmadı; Anthropic bunun yerine Mythos 5'in özelliklerini paylaşan ancak daha düşük risk taşıyan Fable 5 modelini satıyor.
Anthropic, Fable 5 ile Opus 5'i 13 farklı kıyaslama testinde karşılaştırdı. Opus 5, sekiz testte daha yüksek puan alırken maliyeti yaklaşık %50 daha düşük. Özellikle Frontier-Bench ve AutomationBench testlerinde belirgin bir üstünlük sağladı. Frontier-Bench, fizik, kimya ve kriptografi gibi alanlarda 74 görevi kapsıyor; Opus 5 bu testte Fable 5'ten %9,7 daha iyi performans gösterdi. AutomationBench'te ise fark %8,5 oldu.
Opus 5'in performansındaki en önemli faktörlerden biri, kendi çıktısını doğrulama yeteneği. Frontier-Bench'te modelden üç boyutlu bir makine parçası şeması oluşturması istendiğinde, çizimi görme imkânı olmadığı için doğrulama yapamıyordu. Model bu sorunu, "ham piksellerden geometriyi çıkarmak için bir bilgisayarlı görü işlem hattı yazarak" aştı. Bu özellik, biyoloji araştırmalarında da kendini gösteriyor: Anthropic, Opus 5'in önceki model Opus 4.8'e göre tüm dahili yaşam bilimleri kıyaslamalarında daha iyi performans sergilediğini ve özellikle otomatik protein araştırmalarında başarılı olduğunu belirtiyor.
Neden önemli
Opus 5, Anthropic'in en güvenli modeli olarak tanımlanıyor. Öncekilere kıyasla aldatıcı davranışlara ve geri dönüşü zor hatalara daha az eğilimli. Mythos 5, bilgisayar korsanlarının siber saldırı başlatmak için kullanabileceği güvenlik açıklarını bulma ve bunlardan yararlanma iş akışları geliştirme kapasitesine sahip olduğu için kamuya açılmazken, Opus 5, Anthropic'in güvenlik açıklarından yararlanma yeteneğini ölçen dahili kıyaslamasında sıfır puan aldı. Şirket, Opus 5'e Fable 5'ten daha esnek güvenlik önlemleri ekledi. Müşteriler Opus 5'i kodda güvenlik sorunları aramak için kullanabilirken, model bilgisayar korsanlarının yaygın olarak kullandığı güvenlik açığı tarama yöntemlerini engelliyor. Anthropic, güvenlik önlemlerinin Fable 5'e kıyasla %85 daha az sıklıkta devreye gireceğini tahmin ediyor.
Opus 5, Claude sohbet hizmetinin üst düzey Max katmanında varsayılan model haline geldi ve orta seviye Pro planında da kullanılabiliyor. Geliştiriciler, Anthropic'in uygulama programlama arayüzü (API) üzerinden Opus 5'i yazılımlarına bağlayabilir. Güncellemeyle birlikte API'ye, bir LLM'yi iş akışının ortasında kesintiye uğratma ve kullandığı araçları değiştirme özelliği eklendi. Ayrıca, Anthropic'in güvenlik önlemleri tarafından engellenen istemleri farklı bir modele yönlendirebilen yeni bir yetenek de sunuldu.