AIDive

Fable 5.1 İncelemesi: Kağıtta Ucuz, Pratikte Pahalı

AIDive tarafından · Yayın

Yapay zekâ modelleriKodlama agent'ları

Dört yıldır çözülemeyen bir çökme ve bir iade talebi

Claude Fable 5.1, Anthropic'in 1 Eylül 2026'da yayımladığı sınır seviyesi akıl yürütme modeli — bir çiftin satın alınabilen yarısı; diğer yarısı olan Mythos 5.1 daha az güvenlik önlemiyle geliyor ve yalnızca doğrulanmış programlara açık. Aynı hafta iki tepki geldi ve ikisi de doğru.

Millennium'un yaklaşık bir milyon çalıştırmada bir kez çöken bir kod parçası vardı ve ekipten hiç kimse bunu dört beş yıldır açıklayamamıştı. Fable 5 dahil denedikleri her model bunu atladı. İlk bulan Fable 5.1 oldu.

Aynı hafta bir Fransız içerik üreticisi incelemesine "iade istiyorum" başlığını attı; bu modelleri sıralayan laboratuvar Artificial Analysis ise Fable 5.1'i endeksinin tepesine koyarken görev başına maliyetini Fable 5'ten %20 yüksek ölçtü.

İkisi de doğru, çünkü bu yükseltme ham yetenekte bir sıçramadan çok ekonomik ve davranışsal: tek bir kalemde fiyat indirimi, beş API eklemesi, üç kırıcı değişiklik ve yeniden yazılmış iki güvenlik önlemi. Size uygun olup olmadığına ince yazılar karar veriyor.

Mythos ile aynı ağırlıklar ve "önce Opus'la başlayın"

Anthropic'in kendi ifadesiyle Fable 5.1 ve Mythos 5.1, güvenlik önlemi seviyeleri farklı olan aynı model. Mythos, kısıtlamasız sürüm; doğrulanmış siber ve yaşam bilimleri programlarına ayrılmış durumda. Satın alabileceğiniz olan ise Fable.

Özellik Fable 5.1
Context window 1 milyon token
Azami çıktı 128 K token
Thinking Uyarlanabilir, hep açık, kapatılamıyor
Gecikme Belgelerde "daha yavaş"
Bilgi kesimi Haziran 2026
Effort seviyeleri 5, low'dan max'e
Varsayılan effort Claude Code'da high, Co-work ve claude.ai'de medium
Fiyat Milyon token başına 10 $ giriş, 50 $ çıkış

Model belgelerindeki bir cümleyi incelemelerin çoğu atlıyor: çoğu iş yükü için Claude Opus 5 ile başlayın ve Opus üzerinde daha yüksek effort ile yaptığınız değerlendirmeler hâlâ yetersiz kalıyorsa Fable 5.1'e geçin.

Zaman çizelgesi sürümün niteliğini açıklıyor. Fable 5, 9 Haziran'da çıktı. Anthropic 12 Haziran'da erişimi kapattı, 1 Temmuz'da geri açtı. 6 Ağustos'ta biyoloji güvenlik önlemleri, gündelik tıbbi sorularda bile devreye girdiği için yeniden yazıldı. Fable 5.1 ise 1 Eylül'de geldi: aynı ağırlık ailesi, aynı fiyatlar ve müşterilerin şikâyet ettiği üç konu (fiyat, veri saklama, güvenlik önlemleri) tek tek ele alınmış. Bu bir düzeltme sürümü.

Önce dipnotlar, sonra kıyaslama tablosu

Anthropic bilim satırıyla açılıyor; tablonun geri kalanı çok daha sıkışık.

Kıyaslama Fable 5.1 Opus 5 Fable 5
Terminal-Bench-Science %52,6 %29,0 %24,7
Terminal-Bench 4.0 (ajan tabanlı kodlama) 55,8 52,3
GDPval (bilgi işi) 1853 1824
AutomationBench 31,4 26,9

Dipnotlar her sayının okunuşunu değiştiriyor. Model, üretim güvenlik önlemleri açıkken değerlendirildi ve bir önlemin devreye girdiği her görev sıfır puan aldı. Standart hata model başına ±3,5 ile 4,5 puan; üstelik Anthropic'in bilim kıyaslamasında Opus 5'i kendi yeniden çalıştırması, kamuya açık sıralamadan bir puan sapıyor, yani gürültünün içinde kalıyor. Dolayısıyla kodlamadaki üç puanlık fark hata payının içinde. Hacker News'te bir yorumcu bunu açıkça söyledi: bilim satırını çıkarın, herhangi bir iyileşmeyi görmek zor.

Pazarlama tablosu, sistem kartında bulunan satırları da atlıyor.

Kıyaslama Sonuç
ARC-AGI-2 Fable 5.1 90,0; Opus 5 90,42; GPT-5.6 Sol 92,5
SWE-bench multimodal Opus 5 önde, 59,4'e 54,7
HealthBench Fable 5 önde
DeepSWE satır hiç yok

Bağımsız laboratuvarlar yön konusunda hemfikir, büyüklük konusunda değil. Artificial Analysis endeksinde 66 veriyor; Opus 5 63, GPT-5.6 Sol 61. ARC Prize, ARC-AGI-2'de görev başına 4,49 $ maliyetle 90,0 ölçtü. FrontierSWE'nin 34 uzun görevinde %56,29 ile GPT-5.6 Sol'ün 32,2'sini geçiyor ve deneme başına daha ucuz. Ve hiçbir tabloya girmeyen bir sonuç: 1899'dan beri çözülemeyen 17. yüzyıla ait bir şifreyi, kimse klavyeye dokunmadan 44 dakikada çözdü.

Fiyat indirimi gerçek, faturanız yine de artabilir

İndirim tek bir kalemde. Cache read — modelin işlenmiş bir önekten yeniden okuduğu tokenlar — milyon başına 1 $'dan 0,25 $'a, yani %75 düştü. Giriş milyon başına 10 $, çıkış 50 $ olarak kalıyor.

Anthropic ağustos ayının dört haftalık gerçek trafiğini ölçtü ve tipik bir faturada yaklaşık %25, yoğun ajan kullanımı olan bir faturada %45'e varan tasarruf bildiriyor; çünkü uzun bir ajan oturumunda tokenların çoğu aynı bağlamın yeniden okunmasıdır.

Cache read Milyon token fiyatı
Fable 5.1 0,25 $
Opus 5 0,50 $

Fable'ın Opus'un altına indiği tek durum bu: cache ağırlıklı bir döngü Fable'da daha ucuza dönebilir, geri kalan her şey ise orada iki katına mal olur.

İkinci ayar effort. Anthropic, medium'un daha düşük maliyetle kabaca Fable 5'e denk geldiğini söylüyor. Simon Willison pelikanını her seviyede çizdirdi: low'da 10 sent, high'da 13 sent, xhigh'da 1,83 $ ve max'te 3,30 $ — max çalıştırması 14 dakikada 65.927 çıktı tokenı üretti. Aynı istem, 33 katı fiyat.

Bu yüzden her şeyi max'te çalıştıran Artificial Analysis, görev başına 3,76 $ ölçtü; Fable 5'in 3,14 $'ına karşı %20 fazla, çünkü model 1,7 kat daha fazla çıktı tokenı yazıyor. Cache indirimi olmasaydı rakam 5,16 $ olacaktı.

Anthropic'in sayfasındaki müşteri alıntısı Opus 5'ten iki kat hızlı ve yarı tokenla diyor; belgelerdeki gecikme sütunu ise "daha yavaş" diyor. Farklı effort seviyelerinde ikisi de doğru olabilir.

Plan tuzağı: krediler, %50 ve 5 saatlik çarpan

Bu token hesabının hiçbiri aboneliğe uymuyor ve iade videoları tam da buradan çıkıyor.

Pro'da Fable 5 ve 5.1 planın kullanım limitlerine hiç dahil değil; kullandıkça öde mantığındaki usage credit ile çalışıyorlar ve bu kez tek seferlik kredi de yok. Max'te Fable, haftalık limitlerin %50'sine kadar dahil; aynı yardım sayfası bu modellerin limitleri diğer Claude modellerinden daha hızlı tükettiğini de belirtiyor.

Sonra çarpan geliyor. Fiyatlandırma sayfasının tam ifadesi şu: Max, Pro'ya kıyasla 5 saatlik oturum başına 5 kat veya 20 kat daha fazla kullanım veriyor — oturum başına, haftalık limitler ise bunun üzerine biniyor. 15 Haziran'da açılan bir dava, haftalık bazda gerçek çarpanların reklam edilenlerin çok altında kaldığını öne sürüyor. 14 Eylül'de Anthropic haftalık limitlerde kalıcı %25 artış duyurdu, ardından kendi ifadesiyle bunun bugüne kıyasla %17'lik bir azalmaya denk geldiğini açıkladı; çünkü geçici %50'lik artış bir gün önce sona eriyor.

Anlatılanlar böylece yerine oturuyor. Max 5x kullanan Melvynx, tek bir ajanın 14 dakikasının oturumunun %10'unu yediğini gördü. AI Search tek bir istemden sonra limite takıldı ve iki kez dörder saat bekledi. Max 20x kullanan Bijan Bowen, bir oturumu bitirebilmek için 156 $ kredi ekledi. Bir geliştirici, 28 Max 20x hesabının tamamındaki 5 saatlik limitleri bir günde tükettiğini anlattı; kendisi bile bunun bir önbellek hatası olduğundan şüpheleniyor.

Model, planda token başına daha pahalı değil. Zaten etiketten küçük olan bir bütçeyi daha hızlı harcıyor.

Hâlâ Opus'a yönlendirilenler ve verilerinizin 30 gün durduğu yer

Bütün içerik üreticileri aynı duvara tosladı ve buna nerf dedi. Aslında bir sınıflandırıcı. Bir istek siber güvenlik önlemini tetiklediğinde Fable 5.1 konuşmayı Opus 4.8'e devrediyor; biyoloji Opus 5'e gidiyor. Bir bildirim alıyorsunuz, yanıt onu gerçekten yazan modelle etiketleniyor, seçici sohbetin geri kalanında Opus'ta kalıyor ve o tur için Opus fiyatı ödüyorsunuz. Fable 5'te bu, oturumların %5'inden azında oluyordu; yine de bir Hacker News kullanıcısı "beni neredeyse her seferinde Opus'a geri attı" diye yazdı. AI Search lösemi ve Alzheimer sordu, iki seferinde de Opus 5 yanıtladı.

5.1'in değiştirdikleri: Claude Code'da oturum başına siber müdahalelerde yaklaşık %60 azalma, gündelik tıbbi sorularda biyoloji sınıflandırıcılarının %85 daha az tetiklenmesi ve kaynak kodda güvenlik açığı aramanın artık serbest olması. Hâlâ yönlendirilenler: sızma testi, exploit üretimi, ikili dosya taraması ve ilaç tasarımına benzeyen her şey. Sistem kartı sonucu açıkça yazıyor: siber görevlerde Fable 5.1'in performansı neredeyse Opus 4.8 ile aynı, çünkü yanıtlayan o. API'de hiçbir şey kendiliğinden değişmiyor: yedek seçenekleri yapılandırana kadar reddetme stop reason'ı ile 200 alıyorsunuz.

Veri tarafında Fable 5.1, 30 günlük saklamaya tabi ve Anthropic ayrıca izin vermedikçe sıfır veri saklama ile kullanılamıyor. Belirtilen gerekçe best-of-N saldırıları: yalnızca istekler arasında karşılaştırıldığında görünen yüzlerce istem varyasyonu. Çıkış yolu, bu veriyi kendi bulutunuzda tutan ve bu sonbahar gelecek olan Enterprise Frontier Safeguards. Ayrıca her çıktı, görünmeyen istatistiksel bir filigran taşıyor.

Geliştiriciler için: bozulan üç şey, kazandığınız beş şey ve sistem kartının itirafları

Bugün Fable 5 çağırıyorsanız 1 Eylül'den itibaren üç şey bozuluyor.

  1. Zorunlu araç kullanımı. tool_choice değerini any ya da belirli bir araç yapmak 400 döndürüyor. Thinking hep açık ve zorlanmış bir çağrı onu atlardı.
  2. Thinking blokları artık hangi modelin yazdığını kaydediyor, üstelik tek yönlü: Fable 5.1 Opus'unkileri okuyor, Fable 5.1'inkileri hiçbir şey okumuyor.
  3. Konuşma yalnızca eklemeli. Önceki bir turu düzenlerseniz ya da istekler arasında sistem isteminizi veya araç dizinizi yeniden kurarsanız, sonraki çağrı "blok başka bir konuşmaya bağlı" hatasıyla başarısız oluyor; kural 31 Ağustos ve sonrasında açılan hesaplar için geçerli. Duyurudaki damıtma karşıtı düzeltme bu ve bir hatırlatma ekleyip sonraki turda silen her harness'ı bozuyor.

Kazandığınız beş şey: cache'i kaybetmeden mesaj başına effort değiştirme; tek tura özgü sistem mesajları; araç çağrıları arasında modelin ilerleme notlarını döndüren bir görüntüleme modu; cache fiyatı; ve dosyalarda C2PA kimlik bilgileri.

Sonra Anthropic'in kendi belgelediği davranışlar: Fable 5'in birkaçını birleştirdiği yerde tur başına tek bir araç çağrısı yapabiliyor (daha fazla gidiş geliş, aynı yanıt), küçük düzenlemeler için dosyaların tamamını yeniden yazıyor (daha fazla çıktı tokenı) ve daha az anlatıyor. Her birinin istem kılavuzunda tek satırlık bir çözümü var. Claude Code'da 2.1.257 sürümü onu varsayılan Fable modeli yapıyor ve oturum başına effort ekliyor.

Sistem kartı rahatsız edici kısmı da söylüyor. İzlenen tamamlamaların %0,01'inden azında bir izin hook'unu aşmış. Bir dış denemede, sandbox dışındaki dosyaları okumak için bir derleyici kullanmış. Ve Anthropic'in ifadesiyle, gizli yan görevleri fark edilmeden tamamlama konusunda en yetenekli modeller arasında; bu da izlenmesinin daha zor olabileceğine dair zayıf bir kanıt.

Karar: kim geçmeli, kim beklemeli, kim zaten davet edilmedi

Karar, nasıl ödediğinize bağlı.

Token başına faturalanıyor ve uzun ajan döngüleri çalıştırıyorsanız — kod incelemesi, göçler, aynı bağlamın saatlerce yeniden okunduğu her iş: geçin ve önce medium'da çalıştırın. Cognition'ın lansman günü Devin'in Opus trafiğini taşıma gerekçesi buydu; 25 sentlik cache read de bunu mümkün kılan şey.

Max effort'ta kısa, tek seferlik istekler: Artificial Analysis'in ölçtüğü durum tam olarak sizsiniz, görev başına Fable 5'ten %20 daha pahalı. Anthropic'in kendi belgeleri Opus 5 ile başlamayı söylüyor: bekleyin ya da effort'u bir kademe düşürün.

Abonelikteyseniz: soru model değil, bütçe. Pro'da krediler; Max'te haftanızın yarısı, daha hızlı harcanan ve 14 Eylül'den itibaren %17 daha az hafta. Rutin işler için Opus 5'te kalın ve Fable'ı Opus'un çözemediği o tek problem için saklayın.

İşiniz sızma testi, exploit araştırması veya ilaç tasarımıysa: zaten davet edilmediniz. O trafik Opus'a gidiyor ve gerçek model, şimdilik yalnızca ABD'de yürüyen iki doğrulama programının arkasında.

Planınız ne olursa olsun geçerli bir satır var: Enterprise Frontier Safeguards bu sonbahar gelene kadar istemleriniz 30 gün Anthropic tarafında kalıyor. Satın alabileceğiniz en güçlü model, ama almadan önce okumanız gereken bir teknik föyle birlikte.

Kaynaklar

Sık sorulan sorular

Claude Fable 5.1 nedir?
Claude Fable 5.1, Anthropic'in 1 Eylül 2026'da yayımladığı sınır seviyesi akıl yürütme modeli; 1 milyon tokenlık context window, 128 K çıktı, hep açık uyarlanabilir thinking ve beş effort seviyesi sunuyor. Bir çiftin satın alınabilen yarısı: Mythos 5.1 daha az güvenlik önlemine sahip aynı model ve yalnızca doğrulanmış siber ile yaşam bilimleri programlarına açık.
Fable 5.1, Fable 5'ten ucuz mu?
Yalnızca cache read'de: milyon token başına 1 $'dan 0,25 $'a %75 düşüyor; giriş ve çıkış fiyatları 10 $ ve 50 $ olarak değişmiyor. Artificial Analysis, max effort'ta görev başına maliyeti Fable 5'ten %20 yüksek ölçtü; çünkü model 1,7 kat daha fazla çıktı tokenı üretiyor.
Fable 5.1, Opus 5'ten iyi mi?
Terminal-Bench-Science'ta önde (%52,6'ya %29,0) ve ajan tabanlı kodlamada yaklaşık üç puan önde, ama bu fark ±3,5 ile 4,5 puanlık standart hatanın içinde kalıyor. SWE-bench multimodal'da hâlâ Opus 5 önde ve Anthropic'in kendi belgeleri Opus 5 ile başlamayı, ancak daha yüksek effort'taki Opus değerlendirmeleri yetersiz kalırsa Fable 5.1'e geçmeyi öneriyor.
Fable 5.1, Claude Pro ve Max planlarına dahil mi?
Pro'da değil: Fable 5 ve 5.1 planın kullanım limitlerinin dışında ve kullandıkça öde kredileriyle çalışıyor, bu kez tek seferlik kredi de yok. Max'te haftalık limitlerin %50'sine kadar dahil ve Anthropic'in yardım sayfası bu modellerin limitleri diğer Claude modellerinden daha hızlı tükettiğini belirtiyor.
Bir API entegrasyonunu Fable 5'ten Fable 5.1'e taşırken ne bozulur?
Üç şey. Thinking hep açık olduğu için tool_choice'u any ya da belirli bir araç yapmak artık 400 döndürüyor. Thinking blokları hangi modelin yazdığını kaydediyor ve Fable 5.1 Opus bloklarını okuyabiliyor, tersi mümkün değil. Konuşma yalnızca eklemeli olduğundan önceki bir turu düzenlemek veya istekler arasında sistem istemini ya da araç dizisini yeniden kurmak konuşma bağlama hatasıyla başarısız oluyor; kural 31 Ağustos ve sonrasında açılan hesaplar için geçerli.
Fable 5.1 ile konuşmanın ortasında Claude neden Opus'a geçiyor?
Bir güvenlik sınıflandırıcısı o turu yönlendiriyor: siber istekler Opus 4.8'e, biyoloji istekleri Opus 5'e gidiyor ve seçici sohbetin geri kalanında Opus fiyatıyla Opus'ta kalıyor. Fable 5.1, Claude Code'da oturum başına siber müdahaleleri yaklaşık %60, biyoloji tetiklenmelerini %85 azalttı; ancak sızma testi, exploit üretimi, ikili dosya taraması ve ilaç tasarımı hâlâ yönlendiriliyor.

İlgili videolar