Yapay Zeka

Anthropic Claude Fable 5.1 ve Mythos 5.1’i tanıttı: Kodlama performansı arttı, maliyet yüzde 45’e kadar düştü

Anthropic, Claude ailesinin yeni üst seviye modelleri Claude Fable 5.1 ve Claude Mythos 5.1’i resmen duyurdu. Şirketin açıklamasına göre yeni modeller özellikle uzun süreli yapay zeka ajanları, kodlama, araştırma ve bilgi yoğun işlerde önceki nesle kıyasla önemli performans artışları getiriyor.

Yeni sürümün dikkat çeken tarafı yalnızca performans değil. Anthropic, önbellekten veri okuma ücretini ciddi ölçüde azaltarak Fable 5.1’in tipik iş yüklerinde yaklaşık yüzde 25, yoğun araç kullanımına ve uzun otonom süreçlere dayanan agentic görevlerde ise yüzde 45’e varan oranda daha düşük maliyetle çalışabileceğini belirtiyor.

Claude Fable 5.1 ile Mythos 5.1 arasındaki fark ne?

Anthropic’in açıklamasına göre Claude Fable 5.1 ve Claude Mythos 5.1, temelde aynı ana model mimarisini kullanıyor. İki model arasındaki temel ayrım, uygulanan güvenlik katmanlarında ortaya çıkıyor.

Claude Fable 5.1, genel kullanıma açık sürüm olarak konumlandırılıyor. Mythos 5.1 ise özellikle siber güvenlik ve yaşam bilimleri gibi çift kullanımlı alanlarda daha geniş kabiliyetlere erişilmesine imkân tanıyan, daha sınırlı erişime sahip bir model.

Mythos 5.1 şimdilik Anthropic’in doğrulanmış kuruluşlara yönelik programları üzerinden sunuluyor. Şirket, mevcut erişimin ağırlıklı olarak ABD merkezli belirli kuruluşlarla sınırlandırıldığını ve ilerleyen dönemde kapsamın genişletilmesinin planlandığını belirtiyor.

Fable 5.1’in fiyatı düşmedi ama kullanım maliyeti azalıyor

Burada önemli bir ayrıntı bulunuyor. Anthropic, Fable 5.1’in standart giriş ve çıkış token fiyatlarını doğrudan düşürmüş değil.

Claude Fable 5.1 için API fiyatlandırması:

Kullanım Fable 5.1 fiyatı
1 milyon giriş tokeni 10 dolar
1 milyon çıkış tokeni 50 dolar
1 milyon cache read tokeni 0,25 dolar

Asıl maliyet avantajı cache read, yani daha önce işlenmiş bağlamın yeniden okunması tarafında geliyor. Anthropic, bu fiyatı 1 dolar seviyesinden 0,25 dolara indirerek yüzde 75 düşürdü.

Bu değişiklik özellikle Claude Code benzeri, aynı bağlamı sürekli kullanan ve çok sayıda araç çağrısı yapan yapay zeka ajanlarında önem kazanıyor. Şirketin gerçek kullanım verilerine dayandırdığı tahmine göre standart iş yüklerinde toplam maliyet yaklaşık yüzde 25 azalırken, uzun ve araç yoğun görevlerde tasarruf yüzde 45 civarına kadar çıkabiliyor.

Karşılaştırma açısından Claude Opus 5’in standart API fiyatı 1 milyon giriş tokeni için 5 dolar, çıkış için ise 25 dolar seviyesinde bulunuyor. Dolayısıyla Fable 5.1 hâlâ token başına daha pahalı bir model olsa da Anthropic, özellikle cache kullanımının yoğun olduğu görevlerde aradaki gerçek maliyet farkını azaltmayı hedefliyor.

Kodlama ve bilimsel araştırma testlerinde büyük sıçrama

Fable 5.1’in en dikkat çekici geliştirmeleri agentic kodlama ve bilimsel araştırma testlerinde görülüyor.

Anthropic tarafından açıklanan Terminal-Bench-Science 0.1 sonuçlarında Fable 5.1 yüzde 52,6 başarı oranına ulaşırken önceki Fable 5 yüzde 24,7’de kaldı. Aynı testte Claude Opus 5 yüzde 29,0, GPT-5.6 Sol ise yüzde 22,4 olarak raporlandı.

Agentic kodlama odaklı Terminal-Bench 4.0 testinde ise:

Model Terminal-Bench 4.0
Claude Mythos 5.1 %60,9
Claude Fable 5.1 %55,8
Claude Opus 5 %52,3
Claude Fable 5 %42,0
GPT-5.6 Sol %37,3

Anthropic ayrıca Fable 5.1’in bilgi işi, bilgisayar kullanımı, iş akışı otomasyonu ve CursorBench gibi farklı testlerde de önceki Fable sürümünün üzerine çıktığını belirtiyor.

Bununla birlikte benchmark sonuçlarını gerçek kullanım performansının birebir karşılığı olarak değerlendirmemek gerekiyor. Test altyapısı, kullanılan araçlar, efor seviyesi ve güvenlik filtreleri sonuç üzerinde önemli ölçüde etkili olabiliyor. Anthropic de bazı benchmarklarda güvenlik sistemlerinin model davranışını etkilediğini açıkça belirtiyor.

Fable 5.1 daha doğal yazmaya odaklanıyor

Yeni sürümde yalnızca sayısal performans geliştirilmemiş. Anthropic’in erken erişim ortaklarından gelen değerlendirmelerde Fable 5.1’in uzun görevlerde daha okunabilir çıktılar ürettiği ve yazım yönergelerine daha iyi uyduğu vurgulanıyor.

Canva’nın testlerinde modelin özellikle yazı kalitesinin daha anlaşılır hale geldiği ve verilen stil talimatlarını önceki Fable sürümünden daha iyi takip ettiği belirtiliyor. Başka erken erişim kullanıcıları da uzun araştırma ve kodlama görevlerinde modelin ilerleme raporlarını daha kısa ve takip edilebilir biçimde sunduğunu aktarıyor.

Bu değişiklik günlük Claude kullanıcıları açısından benchmark puanlarından bile daha hissedilir olabilir. Çünkü büyük dil modellerinin sık sık gereğinden fazla madde işareti, kalın yazı veya tekrar kullanması kullanıcı deneyimini doğrudan etkileyebiliyor.

Siber güvenlik filtreleri daha az yanlış alarm verecek

Fable 5 ile birlikte getirilen katı siber güvenlik ve biyoloji filtreleri, zararsız isteklerde de zaman zaman devreye girdiği için eleştiriliyordu. Anthropic, Fable 5.1 ile bu sistemlerin daha hassas hale getirildiğini söylüyor.

Şirketin verilerine göre yeni siber güvenlik korumaları, Claude Code oturumlarında eski Fable 5 filtrelerine kıyasla ortalama yaklaşık yüzde 60 daha az müdahale gerçekleştiriyor.

Fable 5.1 ayrıca artık savunma amaçlı olarak kaynak kodundaki yazılım açıklarını tespit etmek için kullanılabiliyor.

Ancak bazı yetenekler hâlâ kısıtlı. Penetrasyon testleri, exploit oluşturma ve binary tabanlı güvenlik açığı tarama gibi çift kullanımlı görevler Fable üzerinde tamamen serbest bırakılmış değil ve gerektiğinde diğer Claude modellerine yönlendirilebiliyor.

Biyoloji tarafında da benzer bir değişiklik yapılmış durumda. Anthropic, zararsız temel biyoloji ve tıbbi sorularda güvenlik mekanizmalarının Fable 5’in ilk sürümüne göre yüzde 85 daha az devreye girdiğini açıklıyor.

Claude Mythos 5.1 bilimsel araştırmalara odaklanıyor

Mythos 5.1’in farkı özellikle ileri düzey araştırmalarda ortaya çıkıyor.

Anthropic, modelin protein tasarımı deneylerinde yüksek bağlanma kabiliyetine sahip moleküler tasarımlar oluşturabildiğini söylüyor. Şirket ayrıca Mythos 5.1’in bazı açık kaynak biyoloji modelleri için özel GPU kernel’ları yazarak çalışma hızını 2,5 kata kadar artırdığını, belirli geniş ölçekli analizlerde tahmini GPU maliyetlerinin yüzde 30 ila yüzde 60 arasında azaltılabildiğini bildiriyor.

Fable 5.1 tarafında verilen dikkat çekici örneklerden biri de Venüs araştırması. Anthropic’e göre model, NASA’nın Magellan radar verilerini kullanarak gezegenin yaklaşık üçte biri için daha yüksek çözünürlüklü bir yükseklik haritası oluşturulmasına katkıda bulundu.

Bunlar Anthropic tarafından açıklanan araştırma sonuçları olduğu için bağımsız çalışmalarla doğrulanacak performansın ayrıca takip edilmesi gerekecek.

Claude çıktılarında görünmez filigran dönemi başladı

Fable 5.1 ve Mythos 5.1, Anthropic’in yeni metin filigranı sistemini taşıyan modeller arasında yer alıyor.

Şirket bunu Avrupa Birliği Yapay Zeka Yasası kapsamındaki yapay zeka tarafından üretilmiş içeriğin şeffaflığına ilişkin yükümlülüklerle ilişkilendiriyor. Anthropic’e göre kullanılan sistem kullanıcı tarafından görülemeyen bir sayısal filigran niteliğinde ve metnin Claude tarafından oluşturulmuş olma olasılığını tespit etmeye yardımcı oluyor.

Filigranda kullanıcıya, kuruluşa veya Claude konuşmasına ait kişisel bilgi bulunmadığı belirtiliyor.

Anthropic aynı zamanda filigranı doğrulayabilecek bir Detection API geliştiriyor. Sistem şimdilik özel önizleme aşamasında ve düzenleyici kurumlar, medya kuruluşları, doğrulama platformları, araştırmacılar ve belirli kuruluşlar için erişilebilir durumda. Şirket erişimi zaman içinde genişletmeyi planlıyor.

Distillation saldırılarına karşı yeni önlem

Fable 5.1 ile birlikte model yeteneklerinin başka sistemlere kopyalanmasını hedefleyen model distillation saldırılarına karşı da yeni teknik önlemler getirildi.

Anthropic, yeni oluşturulan API hesaplarının çok turlu konuşmalarda Claude’un önceki bağlamını manuel biçimde değiştirirken modelin önceki düşünme kaydını korumasına artık izin verilmediğini belirtiyor. Şirkete göre bu yöntem, model davranışlarını sistematik biçimde çıkarmak için kullanılabilen bilinen bir distillation tekniğini zorlaştırıyor.

Değişiklik şimdilik yeni API hesaplarına uygulanıyor ve mevcut hesaplara kademeli olarak genişletilecek.

Claude Fable 5.1 nasıl kullanılabilir?

Claude Fable 5.1, 1 Eylül 2026 itibarıyla kullanıma sunulmuş durumda. Anthropic modelin kendi platformlarının yanı sıra Amazon Web Services, Google Cloud ve Microsoft Azure üzerinden de kullanılabildiğini doğruluyor.

Geliştiriciler Claude API üzerinden modele şu kimlikle erişebiliyor:

claude-fable-5-1

Mythos 5.1 ise genel kullanıcıya açılmış değil. Model, doğrulanmış siber güvenlik ve yaşam bilimleri kuruluşları için özel erişim programları kapsamında dağıtılıyor.

Anthropic için Fable 5.1 neden önemli?

Fable 5.1’in en önemli değişimi tek başına daha yüksek benchmark skorları olmayabilir. Asıl dikkat çekici nokta, yüksek seviyeli bir yapay zeka modelini uzun süre çalışan ajanlarda ekonomik hale getirme çabası.

Kod yazan, terminal kullanan, belgeleri inceleyen, web veya kurumsal sistemlerle çalışan yapay zeka ajanları aynı bağlamı defalarca okumak zorunda kalıyor. Bu nedenle cache maliyetindeki yüzde 75’lik düşüş, klasik tek seferlik chatbot konuşmalarından çok otonom ajan sistemleri için anlam taşıyor.

Anthropic’in açıkladığı rakamlar gerçek kullanımda da karşılığını bulursa Fable 5.1, yapay zeka modelleri arasındaki rekabeti yalnızca “hangisi daha yüksek benchmark puanı aldı?” seviyesinden çıkararak bir görevi hangi maliyetle tamamladığı tartışmasını daha da önemli hale getirebilir.

Kaynak
The Decoder

İlgili Haberler

Bir yanıt yazın

E-posta adresiniz yayınlanmayacak. Gerekli alanlar * ile işaretlenmişlerdir

Başa dön tuşu