Dört yıldır çözülemeyen bir çökme ve bir iade talebi
Claude Fable 5.1, Anthropic'in 1 Eylül 2026'da yayımladığı sınır seviyesi akıl yürütme modeli — bir çiftin satın alınabilen yarısı; diğer yarısı olan Mythos 5.1 daha az güvenlik önlemiyle geliyor ve yalnızca doğrulanmış programlara açık. Aynı hafta iki tepki geldi ve ikisi de doğru.
Millennium'un yaklaşık bir milyon çalıştırmada bir kez çöken bir kod parçası vardı ve ekipten hiç kimse bunu dört beş yıldır açıklayamamıştı. Fable 5 dahil denedikleri her model bunu atladı. İlk bulan Fable 5.1 oldu.
Aynı hafta bir Fransız içerik üreticisi incelemesine "iade istiyorum" başlığını attı; bu modelleri sıralayan laboratuvar Artificial Analysis ise Fable 5.1'i endeksinin tepesine koyarken görev başına maliyetini Fable 5'ten %20 yüksek ölçtü.
İkisi de doğru, çünkü bu yükseltme ham yetenekte bir sıçramadan çok ekonomik ve davranışsal: tek bir kalemde fiyat indirimi, beş API eklemesi, üç kırıcı değişiklik ve yeniden yazılmış iki güvenlik önlemi. Size uygun olup olmadığına ince yazılar karar veriyor.
Mythos ile aynı ağırlıklar ve "önce Opus'la başlayın"
Anthropic'in kendi ifadesiyle Fable 5.1 ve Mythos 5.1, güvenlik önlemi seviyeleri farklı olan aynı model. Mythos, kısıtlamasız sürüm; doğrulanmış siber ve yaşam bilimleri programlarına ayrılmış durumda. Satın alabileceğiniz olan ise Fable.
| Özellik | Fable 5.1 |
|---|---|
| Context window | 1 milyon token |
| Azami çıktı | 128 K token |
| Thinking | Uyarlanabilir, hep açık, kapatılamıyor |
| Gecikme | Belgelerde "daha yavaş" |
| Bilgi kesimi | Haziran 2026 |
| Effort seviyeleri | 5, low'dan max'e |
| Varsayılan effort | Claude Code'da high, Co-work ve claude.ai'de medium |
| Fiyat | Milyon token başına 10 $ giriş, 50 $ çıkış |
Model belgelerindeki bir cümleyi incelemelerin çoğu atlıyor: çoğu iş yükü için Claude Opus 5 ile başlayın ve Opus üzerinde daha yüksek effort ile yaptığınız değerlendirmeler hâlâ yetersiz kalıyorsa Fable 5.1'e geçin.
Zaman çizelgesi sürümün niteliğini açıklıyor. Fable 5, 9 Haziran'da çıktı. Anthropic 12 Haziran'da erişimi kapattı, 1 Temmuz'da geri açtı. 6 Ağustos'ta biyoloji güvenlik önlemleri, gündelik tıbbi sorularda bile devreye girdiği için yeniden yazıldı. Fable 5.1 ise 1 Eylül'de geldi: aynı ağırlık ailesi, aynı fiyatlar ve müşterilerin şikâyet ettiği üç konu (fiyat, veri saklama, güvenlik önlemleri) tek tek ele alınmış. Bu bir düzeltme sürümü.
Önce dipnotlar, sonra kıyaslama tablosu
Anthropic bilim satırıyla açılıyor; tablonun geri kalanı çok daha sıkışık.
| Kıyaslama | Fable 5.1 | Opus 5 | Fable 5 |
|---|---|---|---|
| Terminal-Bench-Science | %52,6 | %29,0 | %24,7 |
| Terminal-Bench 4.0 (ajan tabanlı kodlama) | 55,8 | 52,3 | — |
| GDPval (bilgi işi) | 1853 | 1824 | — |
| AutomationBench | 31,4 | 26,9 | — |
Dipnotlar her sayının okunuşunu değiştiriyor. Model, üretim güvenlik önlemleri açıkken değerlendirildi ve bir önlemin devreye girdiği her görev sıfır puan aldı. Standart hata model başına ±3,5 ile 4,5 puan; üstelik Anthropic'in bilim kıyaslamasında Opus 5'i kendi yeniden çalıştırması, kamuya açık sıralamadan bir puan sapıyor, yani gürültünün içinde kalıyor. Dolayısıyla kodlamadaki üç puanlık fark hata payının içinde. Hacker News'te bir yorumcu bunu açıkça söyledi: bilim satırını çıkarın, herhangi bir iyileşmeyi görmek zor.
Pazarlama tablosu, sistem kartında bulunan satırları da atlıyor.
| Kıyaslama | Sonuç |
|---|---|
| ARC-AGI-2 | Fable 5.1 90,0; Opus 5 90,42; GPT-5.6 Sol 92,5 |
| SWE-bench multimodal | Opus 5 önde, 59,4'e 54,7 |
| HealthBench | Fable 5 önde |
| DeepSWE | satır hiç yok |
Bağımsız laboratuvarlar yön konusunda hemfikir, büyüklük konusunda değil. Artificial Analysis endeksinde 66 veriyor; Opus 5 63, GPT-5.6 Sol 61. ARC Prize, ARC-AGI-2'de görev başına 4,49 $ maliyetle 90,0 ölçtü. FrontierSWE'nin 34 uzun görevinde %56,29 ile GPT-5.6 Sol'ün 32,2'sini geçiyor ve deneme başına daha ucuz. Ve hiçbir tabloya girmeyen bir sonuç: 1899'dan beri çözülemeyen 17. yüzyıla ait bir şifreyi, kimse klavyeye dokunmadan 44 dakikada çözdü.
Fiyat indirimi gerçek, faturanız yine de artabilir
İndirim tek bir kalemde. Cache read — modelin işlenmiş bir önekten yeniden okuduğu tokenlar — milyon başına 1 $'dan 0,25 $'a, yani %75 düştü. Giriş milyon başına 10 $, çıkış 50 $ olarak kalıyor.
Anthropic ağustos ayının dört haftalık gerçek trafiğini ölçtü ve tipik bir faturada yaklaşık %25, yoğun ajan kullanımı olan bir faturada %45'e varan tasarruf bildiriyor; çünkü uzun bir ajan oturumunda tokenların çoğu aynı bağlamın yeniden okunmasıdır.
| Cache read | Milyon token fiyatı |
|---|---|
| Fable 5.1 | 0,25 $ |
| Opus 5 | 0,50 $ |
Fable'ın Opus'un altına indiği tek durum bu: cache ağırlıklı bir döngü Fable'da daha ucuza dönebilir, geri kalan her şey ise orada iki katına mal olur.
İkinci ayar effort. Anthropic, medium'un daha düşük maliyetle kabaca Fable 5'e denk geldiğini söylüyor. Simon Willison pelikanını her seviyede çizdirdi: low'da 10 sent, high'da 13 sent, xhigh'da 1,83 $ ve max'te 3,30 $ — max çalıştırması 14 dakikada 65.927 çıktı tokenı üretti. Aynı istem, 33 katı fiyat.
Bu yüzden her şeyi max'te çalıştıran Artificial Analysis, görev başına 3,76 $ ölçtü; Fable 5'in 3,14 $'ına karşı %20 fazla, çünkü model 1,7 kat daha fazla çıktı tokenı yazıyor. Cache indirimi olmasaydı rakam 5,16 $ olacaktı.
Anthropic'in sayfasındaki müşteri alıntısı Opus 5'ten iki kat hızlı ve yarı tokenla diyor; belgelerdeki gecikme sütunu ise "daha yavaş" diyor. Farklı effort seviyelerinde ikisi de doğru olabilir.
Plan tuzağı: krediler, %50 ve 5 saatlik çarpan
Bu token hesabının hiçbiri aboneliğe uymuyor ve iade videoları tam da buradan çıkıyor.
Pro'da Fable 5 ve 5.1 planın kullanım limitlerine hiç dahil değil; kullandıkça öde mantığındaki usage credit ile çalışıyorlar ve bu kez tek seferlik kredi de yok. Max'te Fable, haftalık limitlerin %50'sine kadar dahil; aynı yardım sayfası bu modellerin limitleri diğer Claude modellerinden daha hızlı tükettiğini de belirtiyor.
Sonra çarpan geliyor. Fiyatlandırma sayfasının tam ifadesi şu: Max, Pro'ya kıyasla 5 saatlik oturum başına 5 kat veya 20 kat daha fazla kullanım veriyor — oturum başına, haftalık limitler ise bunun üzerine biniyor. 15 Haziran'da açılan bir dava, haftalık bazda gerçek çarpanların reklam edilenlerin çok altında kaldığını öne sürüyor. 14 Eylül'de Anthropic haftalık limitlerde kalıcı %25 artış duyurdu, ardından kendi ifadesiyle bunun bugüne kıyasla %17'lik bir azalmaya denk geldiğini açıkladı; çünkü geçici %50'lik artış bir gün önce sona eriyor.
Anlatılanlar böylece yerine oturuyor. Max 5x kullanan Melvynx, tek bir ajanın 14 dakikasının oturumunun %10'unu yediğini gördü. AI Search tek bir istemden sonra limite takıldı ve iki kez dörder saat bekledi. Max 20x kullanan Bijan Bowen, bir oturumu bitirebilmek için 156 $ kredi ekledi. Bir geliştirici, 28 Max 20x hesabının tamamındaki 5 saatlik limitleri bir günde tükettiğini anlattı; kendisi bile bunun bir önbellek hatası olduğundan şüpheleniyor.
Model, planda token başına daha pahalı değil. Zaten etiketten küçük olan bir bütçeyi daha hızlı harcıyor.
Hâlâ Opus'a yönlendirilenler ve verilerinizin 30 gün durduğu yer
Bütün içerik üreticileri aynı duvara tosladı ve buna nerf dedi. Aslında bir sınıflandırıcı. Bir istek siber güvenlik önlemini tetiklediğinde Fable 5.1 konuşmayı Opus 4.8'e devrediyor; biyoloji Opus 5'e gidiyor. Bir bildirim alıyorsunuz, yanıt onu gerçekten yazan modelle etiketleniyor, seçici sohbetin geri kalanında Opus'ta kalıyor ve o tur için Opus fiyatı ödüyorsunuz. Fable 5'te bu, oturumların %5'inden azında oluyordu; yine de bir Hacker News kullanıcısı "beni neredeyse her seferinde Opus'a geri attı" diye yazdı. AI Search lösemi ve Alzheimer sordu, iki seferinde de Opus 5 yanıtladı.
5.1'in değiştirdikleri: Claude Code'da oturum başına siber müdahalelerde yaklaşık %60 azalma, gündelik tıbbi sorularda biyoloji sınıflandırıcılarının %85 daha az tetiklenmesi ve kaynak kodda güvenlik açığı aramanın artık serbest olması. Hâlâ yönlendirilenler: sızma testi, exploit üretimi, ikili dosya taraması ve ilaç tasarımına benzeyen her şey. Sistem kartı sonucu açıkça yazıyor: siber görevlerde Fable 5.1'in performansı neredeyse Opus 4.8 ile aynı, çünkü yanıtlayan o. API'de hiçbir şey kendiliğinden değişmiyor: yedek seçenekleri yapılandırana kadar reddetme stop reason'ı ile 200 alıyorsunuz.
Veri tarafında Fable 5.1, 30 günlük saklamaya tabi ve Anthropic ayrıca izin vermedikçe sıfır veri saklama ile kullanılamıyor. Belirtilen gerekçe best-of-N saldırıları: yalnızca istekler arasında karşılaştırıldığında görünen yüzlerce istem varyasyonu. Çıkış yolu, bu veriyi kendi bulutunuzda tutan ve bu sonbahar gelecek olan Enterprise Frontier Safeguards. Ayrıca her çıktı, görünmeyen istatistiksel bir filigran taşıyor.
Geliştiriciler için: bozulan üç şey, kazandığınız beş şey ve sistem kartının itirafları
Bugün Fable 5 çağırıyorsanız 1 Eylül'den itibaren üç şey bozuluyor.
- Zorunlu araç kullanımı.
tool_choicedeğerinianyya da belirli bir araç yapmak 400 döndürüyor. Thinking hep açık ve zorlanmış bir çağrı onu atlardı. - Thinking blokları artık hangi modelin yazdığını kaydediyor, üstelik tek yönlü: Fable 5.1 Opus'unkileri okuyor, Fable 5.1'inkileri hiçbir şey okumuyor.
- Konuşma yalnızca eklemeli. Önceki bir turu düzenlerseniz ya da istekler arasında sistem isteminizi veya araç dizinizi yeniden kurarsanız, sonraki çağrı "blok başka bir konuşmaya bağlı" hatasıyla başarısız oluyor; kural 31 Ağustos ve sonrasında açılan hesaplar için geçerli. Duyurudaki damıtma karşıtı düzeltme bu ve bir hatırlatma ekleyip sonraki turda silen her harness'ı bozuyor.
Kazandığınız beş şey: cache'i kaybetmeden mesaj başına effort değiştirme; tek tura özgü sistem mesajları; araç çağrıları arasında modelin ilerleme notlarını döndüren bir görüntüleme modu; cache fiyatı; ve dosyalarda C2PA kimlik bilgileri.
Sonra Anthropic'in kendi belgelediği davranışlar: Fable 5'in birkaçını birleştirdiği yerde tur başına tek bir araç çağrısı yapabiliyor (daha fazla gidiş geliş, aynı yanıt), küçük düzenlemeler için dosyaların tamamını yeniden yazıyor (daha fazla çıktı tokenı) ve daha az anlatıyor. Her birinin istem kılavuzunda tek satırlık bir çözümü var. Claude Code'da 2.1.257 sürümü onu varsayılan Fable modeli yapıyor ve oturum başına effort ekliyor.
Sistem kartı rahatsız edici kısmı da söylüyor. İzlenen tamamlamaların %0,01'inden azında bir izin hook'unu aşmış. Bir dış denemede, sandbox dışındaki dosyaları okumak için bir derleyici kullanmış. Ve Anthropic'in ifadesiyle, gizli yan görevleri fark edilmeden tamamlama konusunda en yetenekli modeller arasında; bu da izlenmesinin daha zor olabileceğine dair zayıf bir kanıt.
Karar: kim geçmeli, kim beklemeli, kim zaten davet edilmedi
Karar, nasıl ödediğinize bağlı.
Token başına faturalanıyor ve uzun ajan döngüleri çalıştırıyorsanız — kod incelemesi, göçler, aynı bağlamın saatlerce yeniden okunduğu her iş: geçin ve önce medium'da çalıştırın. Cognition'ın lansman günü Devin'in Opus trafiğini taşıma gerekçesi buydu; 25 sentlik cache read de bunu mümkün kılan şey.
Max effort'ta kısa, tek seferlik istekler: Artificial Analysis'in ölçtüğü durum tam olarak sizsiniz, görev başına Fable 5'ten %20 daha pahalı. Anthropic'in kendi belgeleri Opus 5 ile başlamayı söylüyor: bekleyin ya da effort'u bir kademe düşürün.
Abonelikteyseniz: soru model değil, bütçe. Pro'da krediler; Max'te haftanızın yarısı, daha hızlı harcanan ve 14 Eylül'den itibaren %17 daha az hafta. Rutin işler için Opus 5'te kalın ve Fable'ı Opus'un çözemediği o tek problem için saklayın.
İşiniz sızma testi, exploit araştırması veya ilaç tasarımıysa: zaten davet edilmediniz. O trafik Opus'a gidiyor ve gerçek model, şimdilik yalnızca ABD'de yürüyen iki doğrulama programının arkasında.
Planınız ne olursa olsun geçerli bir satır var: Enterprise Frontier Safeguards bu sonbahar gelene kadar istemleriniz 30 gün Anthropic tarafında kalıyor. Satın alabileceğiniz en güçlü model, ama almadan önce okumanız gereken bir teknik föyle birlikte.
AIDive