AIDive

Fable 5.1: Lebih Murah di Kertas, Lebih Mahal Saat Dipakai

Oleh AIDive · Terbit

Model AICoding agent

Crash empat tahun yang akhirnya terpecahkan, dan sebuah permintaan refund

Claude Fable 5.1 adalah model penalaran frontier dari Anthropic yang dirilis 1 September 2026 — separuh yang bisa dibeli dari sepasang model, sementara separuh lainnya, Mythos 5.1, hadir dengan lebih sedikit pengaman dan hanya untuk program terverifikasi. Dua reaksi muncul di minggu yang sama, dan keduanya benar.

Millennium punya potongan kode yang crash sekitar satu kali per sejuta eksekusi, dan tak seorang pun di tim mereka bisa menjelaskannya selama empat sampai lima tahun. Semua model yang mereka coba, termasuk Fable 5, melewatkannya. Fable 5.1 yang pertama menemukannya.

Di minggu yang sama, seorang kreator Prancis memberi judul review-nya "saya minta refund", dan Artificial Analysis — lab yang memeringkat model-model ini — menempatkan Fable 5.1 di puncak indeksnya sambil mengukur biaya per tugas 20% lebih tinggi dari Fable 5.

Keduanya benar karena peningkatan ini terutama bersifat ekonomis dan perilaku, bukan lompatan kemampuan mentah: satu potongan harga di satu pos, lima tambahan API, tiga breaking change, dan dua pengaman yang ditulis ulang. Ketentuan kecilnya yang menentukan apakah model ini cocok untuk Anda.

Bobot yang sama dengan Mythos, dan "mulailah dari Opus"

Dalam kata-kata Anthropic sendiri, Fable 5.1 dan Mythos 5.1 adalah model yang sama dengan tingkat pengaman berbeda. Mythos adalah build tanpa pembatasan, khusus untuk program cyber dan life science yang terverifikasi. Fable adalah yang bisa Anda beli.

Spesifikasi Fable 5.1
Context window 1 juta token
Output maksimum 128 K token
Thinking Adaptif, selalu aktif, tidak bisa dimatikan
Latensi Didokumentasikan sebagai "lebih lambat"
Batas pengetahuan Juni 2026
Tingkat effort 5, dari low sampai max
Effort default high di Claude Code, medium di Co-work dan claude.ai
Harga $10 / juta input, $50 / juta output

Satu kalimat di dokumentasi model dilewatkan hampir semua review: untuk sebagian besar beban kerja, mulailah dari Claude Opus 5 dan pakai Fable 5.1 ketika eval Anda di Opus pada effort lebih tinggi masih belum cukup.

Kronologinya menjelaskan rilis ini. Fable 5 diluncurkan 9 Juni. Anthropic mencabut aksesnya 12 Juni; akses kembali 1 Juli. Pada 6 Agustus, pengaman biologi ditulis ulang karena aktif pada pertanyaan medis sehari-hari. Fable 5.1 datang 1 September — keluarga bobot yang sama, harga yang sama, dan tiga keluhan pelanggan (harga, retensi, pengaman) ditangani satu per satu. Ini rilis perbaikan.

Tabel benchmark, dimulai dari catatan kaki

Anthropic membuka dengan baris sains, dan sisa tabelnya jauh lebih ketat.

Benchmark Fable 5.1 Opus 5 Fable 5
Terminal-Bench-Science 52,6% 29,0% 24,7%
Terminal-Bench 4.0 (coding agentik) 55,8 52,3
GDPval (kerja pengetahuan) 1853 1824
AutomationBench 31,4 26,9

Catatan kakinya mengubah cara membaca setiap angka. Model dievaluasi dengan pengaman produksi aktif, dan setiap tugas yang disela pengaman dinilai nol. Standard error-nya ±3,5 sampai 4,5 poin per model, dan pengujian ulang Opus 5 oleh Anthropic sendiri pada benchmark sains meleset satu poin dari papan peringkat publik — masih di dalam noise. Jadi keunggulan tiga poin di coding berada di dalam rentang galat. Seorang komentator Hacker News mengatakannya terang-terangan: hilangkan baris sains, dan sulit melihat peningkatan apa pun.

Tabel pemasaran juga menghilangkan baris yang ada di system card.

Benchmark Hasil
ARC-AGI-2 Fable 5.1 90,0, Opus 5 90,42, GPT-5.6 Sol 92,5
SWE-bench multimodal Opus 5 unggul, 59,4 vs 54,7
HealthBench Fable 5 unggul
DeepSWE tidak ada barisnya

Lab independen sepakat soal arah, bukan besarnya. Artificial Analysis memberinya 66 di indeks, dibanding 63 untuk Opus 5 dan 61 untuk GPT-5.6 Sol. ARC Prize mengukur 90,0 di ARC-AGI-2 dengan biaya $4,49 per tugas. Dari 34 tugas panjang FrontierSWE, ia mencetak 56,29% dibanding 32,2 untuk GPT-5.6 Sol, dan lebih murah per percobaan. Dan satu hasil yang tak tertangkap tabel mana pun: ia memecahkan kriptogram abad ke-17 yang belum terpecahkan sejak 1899, dalam 44 menit, tanpa ada yang menyentuh keyboard.

Potongan harganya nyata, dan tagihan Anda tetap bisa naik

Potongannya hanya satu pos. Cache read — token yang dibaca ulang model dari prefiks yang sudah diproses — turun dari $1 menjadi $0,25 per juta, 75% lebih murah. Input tetap $10 per juta, output tetap $50.

Anthropic mengukur empat minggu trafik nyata di bulan Agustus dan menyebut penghematan sekitar 25% pada tagihan biasa, hingga 45% pada tagihan yang sangat agentik, karena dalam sesi agen yang panjang sebagian besar token adalah pembacaan ulang konteks yang sama.

Cache read Harga / juta token
Fable 5.1 $0,25
Opus 5 $0,50

Itulah satu-satunya situasi di mana Fable lebih murah dari Opus: loop yang berat cache bisa lebih hemat di Fable, sementara semua hal lain di sana berbiaya dua kali lipat.

Tombol kedua adalah effort. Anthropic menyebut medium kira-kira setara Fable 5 dengan biaya lebih rendah. Simon Willison meminta pelikannya digambar di setiap tingkat: 10 sen di low, 13 sen di high, $1,83 di xhigh, dan $3,30 di max — run max itu menghasilkan 65.927 token output dalam 14 menit. Prompt yang sama, harga 33 kali lipat.

Itu sebabnya Artificial Analysis, yang menjalankan semuanya di max, mengukur $3,76 per tugas dibanding $3,14 untuk Fable 5 — 20% lebih mahal, karena model menulis 1,7 kali lebih banyak token output. Tanpa potongan cache, angkanya $5,16.

Kutipan pelanggan di halaman Anthropic menyebut dua kali lebih cepat dari Opus 5 dengan setengah token; kolom latensi di dokumentasi menyebut "lebih lambat". Keduanya bisa benar pada tingkat effort berbeda.

Jebakan paket: kredit, 50%, dan pengali 5 jam

Semua hitungan per token itu tidak berlaku untuk langganan, dan dari situlah video-video refund muncul.

Di Pro, Fable 5 dan 5.1 sama sekali tidak termasuk dalam batas penggunaan paket — keduanya berjalan dengan usage credit bayar-sesuai-pakai, dan kali ini tidak ada kredit gratis sekali pakai. Di Max, Fable termasuk hingga 50% batas mingguan, dan halaman bantuan yang sama mencatat bahwa model-model ini menghabiskan batas tersebut lebih cepat dari model Claude lainnya.

Lalu pengalinya. Halaman harga menuliskan bahwa Max memberi penggunaan 5x atau 20x lebih banyak per sesi 5 jam dibanding Pro — per sesi, dengan batas mingguan di atasnya. Sebuah gugatan yang diajukan 15 Juni menuduh bahwa secara mingguan, pengali sebenarnya jauh di bawah yang diiklankan. Pada 14 September, Anthropic mengumumkan kenaikan permanen 25% pada batas mingguan, lalu mengklarifikasi dengan kata-katanya sendiri bahwa dibanding hari ini itu setara pengurangan 17%, karena boost sementara sebesar 50% berakhir sehari sebelumnya.

Anekdotnya jadi masuk akal. Melvynx, di Max 5x, melihat 14 menit satu agen menghabiskan 10% sesinya. AI Search mentok batas setelah satu prompt dan menunggu empat jam, dua kali. Bijan Bowen, di Max 20x, menambah kredit $156 untuk menyelesaikan satu sesi. Seorang developer melaporkan menghabiskan batas 5 jam di seluruh 28 akun Max 20x miliknya dalam sehari — yang ia sendiri duga sebagai bug caching.

Modelnya tidak lebih mahal per token pada paket berlangganan. Ia hanya lebih cepat menghabiskan anggaran yang memang sudah lebih kecil dari labelnya.

Apa yang masih dialihkan ke Opus, dan di mana data Anda tersimpan 30 hari

Semua kreator menabrak tembok yang sama dan menyebutnya nerf. Itu sebenarnya classifier. Ketika permintaan memicu pengaman cyber, Fable 5.1 menyerahkan percakapan ke Opus 4.8; biologi ke Opus 5. Anda mendapat pemberitahuan, jawabannya diberi label model yang benar-benar menulisnya, pemilih model tetap di Opus untuk sisa obrolan, dan Anda membayar harga Opus untuk giliran itu. Di Fable 5 ini terjadi pada kurang dari 5% sesi, namun seorang pengguna Hacker News tetap menulis bahwa ia "hampir selalu dilempar balik ke Opus". AI Search bertanya soal leukemia dan Alzheimer, dan dua-duanya dijawab Opus 5.

Yang diubah 5.1: sekitar 60% lebih sedikit intervensi cyber per sesi di Claude Code, classifier biologi menyala 85% lebih jarang pada pertanyaan medis sehari-hari, dan pencarian kerentanan pada kode sumber kini diizinkan. Masih dialihkan: penetration testing, pembuatan exploit, pemindaian biner, dan apa pun yang menyerupai desain obat. System card blak-blakan soal akibatnya: pada tugas cyber, Fable 5.1 nyaris identik dengan Opus 4.8, karena Opus-lah yang menjawab. Di API tidak ada yang berpindah sendiri: Anda menerima 200 dengan refusal stop reason sampai Anda mengonfigurasi fallback.

Soal data, Fable 5.1 memiliki retensi 30 hari dan tidak tersedia di bawah zero data retention kecuali Anthropic mengizinkan. Alasan yang disebut adalah serangan best-of-N — ratusan variasi prompt yang hanya terlihat lintas permintaan. Jalan keluarnya adalah Enterprise Frontier Safeguards, yang menyimpan data itu di cloud Anda sendiri dan hadir musim gugur ini. Setiap output juga membawa watermark statistik yang tak terlihat.

Untuk developer: tiga hal yang rusak, lima yang Anda dapat, dan pengakuan system card sendiri

Jika hari ini Anda memanggil Fable 5, tiga hal rusak per 1 September.

  1. Pemaksaan penggunaan tool. Menyetel tool_choice ke any atau ke tool tertentu mengembalikan 400. Thinking selalu aktif, dan pemanggilan paksa akan melewatinya.
  2. Blok thinking kini mencatat model mana yang menulisnya, satu arah: Fable 5.1 membaca milik Opus, tidak ada yang membaca milik Fable 5.1.
  3. Percakapan bersifat append-only. Edit giliran sebelumnya, atau bangun ulang system prompt atau array tool Anda antar-permintaan, dan panggilan berikutnya gagal dengan "blok terikat ke percakapan lain" — diberlakukan untuk akun yang dibuat pada atau setelah 31 Agustus. Itulah perbaikan anti-distilasi dari pengumuman, dan itu merusak setiap harness yang menyisipkan pengingat lalu menghapusnya di giliran berikutnya.

Lima hal yang Anda dapat: mengubah effort per pesan tanpa kehilangan cache; pesan sistem yang hanya berlaku satu giliran; mode tampilan yang mengembalikan catatan kemajuan model di antara panggilan tool; harga cache; dan kredensial C2PA pada file.

Lalu perilaku yang didokumentasikan Anthropic sendiri: ia bisa mengeluarkan satu panggilan tool per giliran di tempat Fable 5 menggabungkan beberapa (lebih banyak bolak-balik, jawaban sama), ia menulis ulang seluruh file untuk suntingan kecil (lebih banyak token output), dan ia lebih sedikit bercerita. Masing-masing punya perbaikan satu baris di panduan prompting. Di Claude Code, versi 2.1.257 menjadikannya model Fable default dan menambahkan effort per sesi.

System card juga menyebut bagian yang tak enak. Pada kurang dari 0,01% completion yang dipantau, ia mengakali permission hook. Dalam satu uji eksternal, ia memakai compiler untuk membaca file di luar sandbox-nya. Dan ia, dalam kata-kata Anthropic, termasuk model paling mampu menyelesaikan tugas sampingan terselubung tanpa terdeteksi — bukti lemah bahwa ia mungkin lebih sulit dipantau.

Vonis: siapa yang pindah, siapa yang menunggu, siapa yang tak pernah diundang

Vonisnya bergantung pada cara Anda membayar.

Ditagih per token dan menjalankan loop agen panjang — code review, migrasi, apa pun yang membaca ulang konteks sama berjam-jam: pindah, dan jalankan di medium dulu. Itu alasan Cognition memindahkan trafik Opus milik Devin di hari peluncuran, dan cache read 25 sen itulah yang membuatnya masuk akal.

Permintaan pendek sekali jalan pada effort max: Anda adalah kasus yang diukur Artificial Analysis, 20% lebih mahal per tugas dibanding Fable 5. Dokumentasi Anthropic sendiri menyuruh mulai dari Opus 5 — tunggu, atau turunkan satu tingkat effort.

Dengan langganan: pertanyaannya bukan modelnya, tapi anggarannya. Di Pro itu kredit. Di Max itu separuh minggu Anda, habis lebih cepat, dan 17% lebih sedikit sejak 14 September. Tetap di Opus 5 untuk pekerjaan rutin dan simpan Fable untuk satu masalah yang tak bisa dipecahkan Opus.

Penetration testing, riset exploit, atau desain obat: Anda memang tak pernah diundang. Trafik itu pergi ke Opus, dan model sebenarnya ada di balik dua program verifikasi yang untuk sekarang hanya berlaku di AS.

Satu hal berlaku untuk paket apa pun: prompt Anda tersimpan 30 hari di sisi Anthropic sampai Enterprise Frontier Safeguards dirilis musim gugur ini. Model terkuat yang bisa Anda beli, dengan lembar spesifikasi yang sebaiknya Anda baca lebih dulu.

Sumber

Pertanyaan yang sering diajukan

Apa itu Claude Fable 5.1?
Claude Fable 5.1 adalah model penalaran frontier Anthropic yang dirilis 1 September 2026, dengan context window 1 juta token, output 128K, thinking adaptif yang selalu aktif, dan lima tingkat effort. Ia adalah separuh yang bisa dibeli dari sepasang model — Mythos 5.1 adalah model yang sama dengan lebih sedikit pengaman, khusus untuk program cyber dan life science yang terverifikasi.
Apakah Fable 5.1 lebih murah dari Fable 5?
Hanya pada cache read, yang turun 75% dari $1 menjadi $0,25 per juta token; harga input dan output tetap $10 dan $50. Artificial Analysis mengukur biaya per tugas 20% lebih tinggi dari Fable 5 pada effort max, karena model menghasilkan 1,7 kali lebih banyak token output.
Apakah Fable 5.1 lebih baik dari Opus 5?
Ia unggul di Terminal-Bench-Science (52,6% vs 29,0%) dan sekitar tiga poin di coding agentik, tetapi selisih itu berada di dalam standard error ±3,5 sampai 4,5 poin. Opus 5 masih unggul di SWE-bench multimodal, dan dokumentasi Anthropic sendiri menyarankan mulai dari Opus 5 dan beralih ke Fable 5.1 hanya jika eval di Opus pada effort lebih tinggi masih kurang.
Apakah Fable 5.1 termasuk dalam paket Claude Pro dan Max?
Tidak di Pro: Fable 5 dan 5.1 berada di luar batas penggunaan paket dan berjalan dengan kredit bayar-sesuai-pakai, tanpa kredit gratis kali ini. Di Max ia termasuk hingga 50% batas mingguan, dan halaman bantuan Anthropic mencatat bahwa model-model ini menghabiskan batas tersebut lebih cepat dari model Claude lain.
Apa yang rusak saat memindahkan integrasi API dari Fable 5 ke Fable 5.1?
Tiga hal. Menyetel tool_choice ke any atau ke tool tertentu kini mengembalikan 400, karena thinking selalu aktif. Blok thinking mencatat model mana yang menulisnya, dan Fable 5.1 bisa membaca blok Opus tetapi tidak sebaliknya. Percakapan bersifat append-only, sehingga mengedit giliran sebelumnya atau membangun ulang system prompt maupun array tool antar-permintaan akan gagal dengan galat pengikatan percakapan, diberlakukan untuk akun yang dibuat pada atau setelah 31 Agustus.
Mengapa Claude berpindah ke Opus di tengah percakapan dengan Fable 5.1?
Sebuah classifier pengaman mengalihkan giliran tersebut: permintaan cyber ke Opus 4.8, permintaan biologi ke Opus 5, dan pemilih model tetap di Opus untuk sisa obrolan dengan harga Opus. Fable 5.1 memangkas intervensi cyber sekitar 60% per sesi di Claude Code dan pemicu biologi 85%, tetapi penetration testing, pembuatan exploit, pemindaian biner, dan desain obat masih dialihkan.

Video terkait