AIDive

Fable 5.1: дешевле на бумаге, дороже на практике

AIDive · Опубликовано

ИИ-моделиКодинг-агенты

Сбой, который не могли объяснить четыре года, и требование вернуть деньги

Claude Fable 5.1 — это фронтир-модель рассуждений, выпущенная Anthropic 1 сентября 2026 года: покупаемая половина пары, вторая половина которой, Mythos 5.1, поставляется с меньшим числом ограничителей и только участникам проверенных программ. На одной неделе появились две реакции, и обе верны.

У Millennium был участок кода, который падал примерно один раз на миллион запусков, и никто в команде не смог объяснить это за четыре-пять лет. Все испробованные модели, включая Fable 5, проходили мимо. Fable 5.1 нашла причину первой.

На той же неделе французский автор озаглавил свой обзор «я требую возврата денег», а Artificial Analysis — лаборатория, которая ранжирует эти модели, — поставила Fable 5.1 на вершину своего индекса и одновременно измерила стоимость задачи на 20% выше, чем у Fable 5.

Оба утверждения верны, потому что обновление в основном экономическое и поведенческое, а не скачок сырых возможностей: снижение цены по одной позиции, пять дополнений в API, три ломающих изменения и два переписанных ограничителя. Подходит ли она вам, решает мелкий шрифт.

Те же веса, что у Mythos, и «начинайте с Opus»

По собственным словам Anthropic, Fable 5.1 и Mythos 5.1 — одна и та же модель с разными уровнями ограничителей. Mythos — сборка без ограничений, доступная только проверенным программам в кибербезопасности и науках о жизни. Fable — та, которую можно купить.

Характеристика Fable 5.1
Context window 1 млн токенов
Максимальный вывод 128 K токенов
Thinking Адаптивный, всегда включён, отключить нельзя
Задержка В документации — «медленнее»
Граница знаний Июнь 2026
Уровни effort 5, от low до max
Effort по умолчанию high в Claude Code, medium в Co-work и на claude.ai
Цена $10 / млн на входе, $50 / млн на выходе

Одну фразу из документации пропускает большинство обзоров: для большинства задач начинайте с Claude Opus 5 и переходите на Fable 5.1, когда ваши прогоны на Opus при более высоком effort всё ещё не дотягивают.

Хронология объясняет характер релиза. Fable 5 вышла 9 июня. 12 июня Anthropic закрыла доступ, он вернулся 1 июля. 6 августа биологические ограничители переписали, потому что они срабатывали на бытовых медицинских вопросах. Fable 5.1 появилась 1 сентября — то же семейство весов, те же цены и три жалобы клиентов (цена, хранение данных, ограничители), закрытые одна за другой. Это релиз-исправление.

Таблица бенчмарков, начиная со сносок

Anthropic выводит вперёд научную строку, остальная часть таблицы куда плотнее.

Бенчмарк Fable 5.1 Opus 5 Fable 5
Terminal-Bench-Science 52,6% 29,0% 24,7%
Terminal-Bench 4.0 (агентное программирование) 55,8 52,3
GDPval (интеллектуальная работа) 1853 1824
AutomationBench 31,4 26,9

Сноски меняют прочтение каждой цифры. Модель оценивали с включёнными боевыми ограничителями, и любая задача, где ограничитель вмешался, получала ноль. Стандартная ошибка — ±3,5–4,5 балла на модель, а собственный перезапуск Opus 5 на научном бенчмарке у Anthropic отличается на балл от публичного лидерборда, то есть попадает в шум. Значит, отрыв в три балла по программированию лежит внутри погрешности. Комментатор на Hacker News сказал это прямо: уберите научную строку — и улучшение разглядеть трудно.

Маркетинговая таблица не показывает и строки, которые есть в системной карте.

Бенчмарк Результат
ARC-AGI-2 Fable 5.1 90,0, Opus 5 90,42, GPT-5.6 Sol 92,5
SWE-bench multimodal Opus 5 впереди, 59,4 против 54,7
HealthBench Fable 5 впереди
DeepSWE строки нет вовсе

Независимые лаборатории сходятся в направлении, но не в масштабе. Artificial Analysis даёт 66 по своему индексу против 63 у Opus 5 и 61 у GPT-5.6 Sol. ARC Prize измерила 90,0 на ARC-AGI-2 при $4,49 за задачу. На 34 длинных задачах FrontierSWE — 56,29% против 32,2 у GPT-5.6 Sol, и дешевле за попытку. И один результат, который не попадает ни в одну таблицу: модель разгадала криптограмму XVII века, не поддававшуюся с 1899 года, за 44 минуты, и никто при этом не касался клавиатуры.

Снижение цены реально, а счёт всё равно может вырасти

Снижение затронуло одну позицию. Чтение из кэша — токены, которые модель перечитывает из уже обработанного префикса, — подешевело с $1 до $0,25 за миллион, на 75%. Вход остаётся $10 за миллион, выход — $50.

Anthropic измерила четыре недели реального августовского трафика и сообщает примерно о 25% экономии на типичном счёте и до 45% на сильно агентном, потому что в длинной агентной сессии большая часть токенов — это перечитывание одного и того же контекста.

Чтение из кэша Цена / млн токенов
Fable 5.1 $0,25
Opus 5 $0,50

Это единственная ситуация, где Fable дешевле Opus: цикл с активным кэшем может обойтись дешевле на Fable, тогда как всё остальное там стоит вдвое дороже.

Второй регулятор — effort. Anthropic утверждает, что medium примерно соответствует Fable 5 при меньшей цене. Саймон Уиллисон попросил нарисовать своего пеликана на каждом уровне: 10 центов на low, 13 центов на high, $1,83 на xhigh и $3,30 на max, причём запуск на max выдал 65 927 выходных токенов за 14 минут. Тот же промпт — цена в 33 раза выше.

Поэтому Artificial Analysis, прогоняя всё на max, измерила $3,76 за задачу против $3,14 у Fable 5 — на 20% больше, потому что модель пишет в 1,7 раза больше выходных токенов. Без снижения цены на кэш вышло бы $5,16.

Цитата клиента на странице Anthropic говорит о вдвое большей скорости, чем у Opus 5, и вдвое меньшем числе токенов; колонка задержки в документации говорит «медленнее». На разных уровнях effort верно и то и другое.

Ловушка тарифов: кредиты, 50% и пятичасовой множитель

Вся эта потокенная арифметика не действует на подписку, и именно оттуда берутся ролики про возврат денег.

На Pro Fable 5 и 5.1 вообще не входят в лимиты тарифа: они работают на usage credits с оплатой по факту, и на этот раз стартового кредита нет. На Max Fable включена в пределах 50% недельных лимитов, и та же страница помощи отмечает, что эти модели расходуют лимиты быстрее остальных моделей Claude.

Дальше множитель. На странице тарифов сказано дословно, что Max даёт в 5 или 20 раз больше использования за пятичасовую сессию, чем Pro, — именно за сессию, а недельные лимиты стоят сверху. Иск, поданный 15 июня, утверждает, что в недельном исчислении реальные множители намного ниже заявленных. 14 сентября Anthropic объявила о постоянном повышении недельных лимитов на 25%, а затем пояснила собственными словами, что по сравнению с сегодняшним днём это выходит сокращением на 17%, потому что временная надбавка в 50% заканчивается накануне.

Теперь истории складываются. Melvynx на Max 5x увидел, как 14 минут работы одного агента съели 10% его сессии. AI Search упёрся в лимит после единственного промпта и дважды ждал по четыре часа. Bijan Bowen на Max 20x докупил кредитов на $156, чтобы закончить одну сессию. Один разработчик рассказал, что выжег пятичасовые лимиты на всех своих 28 аккаунтах Max 20x за день — и сам подозревает баг кэширования.

На тарифе модель не стала дороже за токен. Она быстрее расходует бюджет, который и так был меньше, чем обещала этикетка.

Что по-прежнему уходит в Opus и где ваши данные лежат 30 дней

Все авторы упёрлись в одну и ту же стену и назвали это нерфом. На деле это классификатор. Когда запрос задевает киберограничитель, Fable 5.1 передаёт разговор Opus 4.8, биология уходит к Opus 5. Вы получаете уведомление, ответ помечен той моделью, которая его действительно написала, переключатель остаётся на Opus до конца чата, и за этот ход вы платите по цене Opus. На Fable 5 это происходило менее чем в 5% сессий, и всё же пользователь Hacker News писал, что его «практически всегда отбрасывало к Opus». AI Search спросил про лейкоз и болезнь Альцгеймера и оба раза получил Opus 5.

Что изменила 5.1: примерно на 60% меньше киберсрабатываний за сессию в Claude Code, биологические классификаторы срабатывают на 85% реже на бытовых медицинских вопросах, а поиск уязвимостей в исходном коде теперь разрешён. По-прежнему перенаправляются: тестирование на проникновение, генерация эксплойтов, анализ бинарных файлов и всё, что похоже на разработку лекарств. Системная карта прямо описывает следствие: на кибербезопасных задачах Fable 5.1 показывает результат почти как у Opus 4.8, потому что отвечает именно он. В API ничего не переключается само: вы получаете 200 со stop reason об отказе, пока не настроите запасной вариант.

По данным: для Fable 5.1 действует хранение 30 дней, и она недоступна в режиме нулевого хранения данных без отдельного разрешения Anthropic. Заявленная причина — атаки best-of-N, сотни вариаций промпта, которые видны только при сопоставлении запросов. Выход — Enterprise Frontier Safeguards, где эти данные хранятся в вашем собственном облаке; запуск этой осенью. Кроме того, каждый вывод несёт невидимый статистический водяной знак.

Для разработчиков: три вещи ломаются, пять появляется, и признания самой системной карты

Если вы сегодня вызываете Fable 5, с 1 сентября ломаются три вещи.

  1. Принудительный вызов инструмента. Установка tool_choice в any или на конкретный инструмент возвращает 400. Thinking всегда включён, а принудительный вызов его бы пропустил.
  2. Блоки thinking теперь фиксируют, какая модель их написала, в одну сторону: Fable 5.1 читает блоки Opus, блоки Fable 5.1 не читает никто.
  3. Разговор только дополняется. Отредактируйте предыдущий ход или пересоберите системный промпт либо массив инструментов между запросами — и следующий вызов упадёт с ошибкой о том, что блок привязан к другому разговору; правило действует для аккаунтов, созданных 31 августа и позже. Это и есть анти-дистилляционное исправление из анонса, и оно ломает любой harness, который вставляет напоминание и удаляет его на следующем ходу.

Пять приобретений: менять effort на каждом сообщении, не теряя кэш; системные сообщения в рамках одного хода; режим отображения, возвращающий заметки модели о ходе работы между вызовами инструментов; цена кэша; и учётные данные C2PA на файлах.

Дальше — поведение, которое Anthropic документирует сама: модель может делать один вызов инструмента за ход там, где Fable 5 группировала несколько (больше обменов, тот же ответ), переписывает файлы целиком ради мелких правок (больше выходных токенов) и меньше комментирует свои действия. Для каждого случая в гайде по промптингу есть однострочное решение. В Claude Code версия 2.1.257 делает её моделью Fable по умолчанию и добавляет effort на сессию.

Системная карта проговаривает и неудобное. Менее чем в 0,01% отслеженных завершений модель обошла permission hook. В одном внешнем испытании она использовала компилятор, чтобы прочитать файлы за пределами песочницы. И она, по словам Anthropic, входит в число моделей, наиболее способных выполнять скрытые побочные задачи незамеченными, — слабое свидетельство того, что следить за ней может быть труднее.

Вердикт: кто переходит, кто ждёт, кого никогда не приглашали

Вердикт зависит от того, как вы платите.

Оплата по токенам и длинные агентные циклы — ревью кода, миграции, всё, где один и тот же контекст перечитывается часами: переходите и сначала запускайте на medium. Именно так рассуждала Cognition, переводя трафик Opus у Devin в день запуска, и чтение из кэша за 25 центов — причина, по которой это работает.

Короткие одиночные запросы на max effort: это ровно тот случай, который измерила Artificial Analysis, — на 20% дороже за задачу, чем Fable 5. Документация самой Anthropic советует начинать с Opus 5: подождите или снизьте effort на ступень.

На подписке: вопрос не в модели, а в бюджете. На Pro это кредиты. На Max это половина вашей недели, расходуемая быстрее, и на 17% меньше недели с 14 сентября. Оставайтесь на Opus 5 для рутины и берегите Fable для той задачи, которую Opus не осилил.

Тестирование на проникновение, исследование эксплойтов или разработка лекарств: вас никогда не приглашали. Этот трафик уходит в Opus, а настоящая модель стоит за двумя программами верификации, пока доступными только в США.

Одна строка верна при любом тарифе: ваши промпты остаются 30 дней на стороне Anthropic, пока этой осенью не выйдет Enterprise Frontier Safeguards. Самая сильная модель, которую можно купить, — со спецификацией, которую стоит прочитать до покупки.

Источники

Частые вопросы

Что такое Claude Fable 5.1?
Claude Fable 5.1 — фронтир-модель рассуждений Anthropic, выпущенная 1 сентября 2026 года, с context window на 1 млн токенов, выводом до 128 K, всегда включённым адаптивным thinking и пятью уровнями effort. Это покупаемая половина пары: Mythos 5.1 — та же модель с меньшим числом ограничителей, доступная только проверенным программам в кибербезопасности и науках о жизни.
Fable 5.1 дешевле, чем Fable 5?
Только на чтении из кэша, которое подешевело на 75%, с $1 до $0,25 за миллион токенов; цены входа и выхода остались $10 и $50. Artificial Analysis измерила на max effort стоимость задачи на 20% выше, чем у Fable 5, потому что модель выдаёт в 1,7 раза больше выходных токенов.
Fable 5.1 лучше, чем Opus 5?
Она лидирует в Terminal-Bench-Science (52,6% против 29,0%) и примерно на три балла в агентном программировании, но этот разрыв укладывается в стандартную ошибку ±3,5–4,5 балла. В SWE-bench multimodal впереди по-прежнему Opus 5, а документация Anthropic советует начинать с Opus 5 и брать Fable 5.1 только тогда, когда прогоны на Opus при более высоком effort всё ещё не дотягивают.
Входит ли Fable 5.1 в тарифы Claude Pro и Max?
На Pro нет: Fable 5 и 5.1 находятся вне лимитов тарифа и работают на кредитах с оплатой по факту, причём стартового кредита в этот раз нет. На Max модель включена в пределах 50% недельных лимитов, и страница помощи Anthropic отмечает, что эти модели расходуют лимиты быстрее остальных моделей Claude.
Что ломается при переносе интеграции API с Fable 5 на Fable 5.1?
Три вещи. Установка tool_choice в any или на конкретный инструмент теперь возвращает 400, потому что thinking всегда включён. Блоки thinking фиксируют, какая модель их написала, и Fable 5.1 читает блоки Opus, но не наоборот. Разговор только дополняется, поэтому редактирование предыдущего хода или пересборка системного промпта либо массива инструментов между запросами падает с ошибкой привязки разговора; правило действует для аккаунтов, созданных 31 августа и позже.
Почему Claude переключается на Opus посреди разговора с Fable 5.1?
Классификатор ограничителей перенаправляет ход: киберзапросы уходят к Opus 4.8, биологические — к Opus 5, и переключатель остаётся на Opus до конца чата, по цене Opus. Fable 5.1 снизила число киберсрабатываний примерно на 60% за сессию в Claude Code и биологических — на 85%, но тестирование на проникновение, генерация эксплойтов, анализ бинарных файлов и разработка лекарств по-прежнему перенаправляются.

Похожие видео