Реклама
Перетяжка // Коробка 3.0

Anthropic выпустила Claude Fable 5.1, лидера рейтинга Artificial Analysis

Одна модель, два набора ограничений, прежние цены на вход и выход, чтение кэша в четыре раза дешевле и первое место в независимом рейтинге в день релиза. Все цифры по Fable 5.1 в одном разборе.

Обложка: Anthropic выпустила Claude Fable 5.1, лидера рейтинга Artificial Analysis

Anthropic 1 сентября выпустила две модели с одним общим ядром: Claude Fable 5.1 для всех пользователей и Claude Mythos 5.1 для проверенных организаций. Если вы пишете код с Claude Code, Cursor или через API, вам доступна первая: цены на вход и выход те же, что у Fable 5, чтение кэша подешевело в четыре раза, а на двух агентных бенчмарках, Terminal-Bench-Science и AutomationBench, компания показывает рост почти вдвое. В тот же день независимая лаборатория Artificial Analysis поставила Fable 5.1 на первое место своего рейтинга из 184 моделей.

Практически миграция начинается с замены идентификатора модели на claude-fable-5-1, но документация перечисляет и несовместимости: изменения в принудительном вызове инструментов (forced tool use), несовместимость блоков размышлений между версиями и запрет редактирования прежних ходов диалога, раздел миграции стоит прочитать до переключения. Для российских разработчиков статус не изменился: по списку поддерживаемых стран Anthropic Россия в него не входит.

Ключевые выводы
  • Fable 5.1 и Mythos 5.1 — одна и та же базовая модель; у Mythos менее строгие защиты, и её выдают только участникам программы Project Glasswing.
  • Цены на вход и выход прежние: $10 за миллион входных токенов и $50 за миллион выходных; чтение кэша подешевело с $1 до $0,25; Batch API даёт скидку 50%.
  • Контекст 1 млн токенов, ответ до 128 тыс. токенов, знания по июнь 2026 года, идентификатор в API claude-fable-5-1.
  • Замеры Anthropic: Terminal-Bench-Science 0.1 вырос с 24,7% у Fable 5 до 52,6%, AutomationBench с 17,1% до 31,4%; стандартная ошибка для первого теста 3,5–4,5 процентного пункта.
  • Независимый замер на 1 сентября: 66 баллов в Artificial Analysis Intelligence Index против 63 у Opus 5, 62 у Fable 5 и 61 у GPT-5.6 Sol (max) и Grok 4.6.

Что изменилось в цене и характеристиках

По документации платформы, Fable 5.1 стоит столько же, сколько Fable 5: $10 за миллион входных и $50 за миллион выходных токенов. Подешевело чтение кэша: $0,25 за миллион вместо $1 у Fable 5; запись кэша на 5 минут стоит $12,50, на час 20 долларов. Batch API, как и раньше, режет цену входа и выхода вдвое. Контекстное окно 1 млн токенов, максимальный ответ 128 тыс. токенов, граница знаний июнь 2026 года.

Для агентных сценариев с повторяющимся системным промптом изменение цены кэша заметно: чтение кэша теперь в 40 раз дешевле обычного ввода, а часовой кэш дороже пятиминутного на 60%. Компания отдельно отмечает, что защитные ограничения по биологии срабатывают на 85% реже, чем у Fable 5, то есть меньше ложных отказов на безобидных запросах, например при работе с медицинскими или химическими данными в обычном коде.

Замеры Anthropic: удвоение на агентных задачах

Самая заметная цифра анонса — Terminal-Bench-Science 0.1, где модель решает научные задачи в терминале: Fable 5.1 набрала 52,6% против 24,7% у Fable 5 и 29,0% у Opus 5. На AutomationBench, наборе задач по автоматизации рутинных рабочих процессов, рост с 17,1% до 31,4% (у Opus 5 — 26,9%). Это замеры самого вендора; Anthropic приводит стандартную ошибку измерения для Terminal-Bench-Science, 3,5–4,5 процентного пункта, так что разницу в несколько пунктов между близкими моделями стоит читать с этим запасом.

Независимый замер: первое место в Artificial Analysis

Artificial Analysis прогоняет модели через публичные API сама и сводит девять тестов в один Intelligence Index. В версии 4.1.1 это задачи из офисной работы (GDPval-AA v2), банковские сценарии с инструментами (τ³-Banking), работа в терминале (Terminal-Bench v2.1), научный код (SciCode), Humanity's Last Exam и GPQA Diamond на знания, CritPt на физику, а также два собственных теста лаборатории: AA-Omniscience на фактическую точность и AA-LCR на длинный контекст. По таблице лидеров на 1 сентября Fable 5.1 в конфигурации «max with fallback» набрала 66 баллов, в конфигурации «xhigh with fallback» — 65; «with fallback» означает, что при срабатывании защит запрос уходит запасной модели.

Anthropic выпустила Claude Fable 5.1, лидера рейтинга Artificial Analysis_10
Intelligence Index v4.1.1 по состоянию на 1 сентября 2026 года. Изображение: Artificial Analysis.

Дальше в таблице Claude Opus 5 с 63 баллами, прежняя Fable 5 с 62, GPT-5.6 Sol (max) и Grok 4.6 по 61, Kimi K3 и GLM-5.3 по 60, Qwen 3.8 Max с 58. Лучшие открытые модели отстают от лидера на шесть баллов. Полезен и столбец стоимости: одна задача индекса обходится Fable 5.1 в $3,69 на максимальном усилии и в $2,65 на xhigh при разнице в один балл, то есть на 28% дешевле. Балл индекса зависит от того, сколько модели разрешили «думать».

Чего индекс не показывает: скорость и задержку (на 2 сентября лаборатория ещё не опубликовала замер для Fable 5.1) и устойчивость в долгих агентных сессиях на сотни шагов; отдельного русскоязычного теста в нём нет. Влияние защитных фильтров в результат уже входит: при их срабатывании модель получает ноль за задачу либо ответ даёт запасная модель. Лидеры этой таблицы меняются каждые несколько недель, поэтому первое место — повод проверить модель на своих задачах, а не аргумент в споре.

Почему модели две

Схема «одна модель, два уровня доступа» появилась у Anthropic в июне с Fable 5 и Mythos 5 и теперь закреплена. Компания прямо пишет, что Fable 5.1 и Mythos 5.1 — «одна и та же базовая модель» (перевод редакции). Разница в защитах: Fable блокирует пентест, генерацию эксплойтов и поиск уязвимостей по бинарникам, а задачи по «двойному назначению» в биологии и химии перенаправляет на модели Opus. Mythos работает с менее строгими защитами, и её выдают под договор: участие в Project Glasswing, хранение данных 30 дней для мониторинга безопасности.

Для обычной разработки, рефакторинга, разбора логов и тестов Fable 5.1 совпадает с Mythos по базовым возможностям везде, где защиты не срабатывают. Для работы по безопасности часть запросов упрётся в фильтр: модель откажется генерировать эксплойт или анализировать бинарник на уязвимости, хотя, по словам Anthropic, уязвимости в исходном коде она находить умеет и делает это в Fable-версии.

Что проверить у себя

  • В API замените идентификатор модели на claude-fable-5-1; цены и лимиты те же, миграция сводится к одной строке конфигурации.
  • Длинные агентные сценарии (сборка, миграции, многошаговые правки) прогоните на новой модели: именно там Anthropic показывает удвоение результата.
  • Сравните режимы усилия: по индексу Artificial Analysis xhigh отстаёт от максимального на один балл, а задача обходится на 28% дешевле.
  • Пересчитайте бюджет с учётом кэша: при повторяющемся системном промпте чтение кэша в 40 раз дешевле обычного ввода.
  • Если модель раньше отказывала на медицинских или химических темах в безобидном контексте, попробуйте снова: порог срабатывания защиты снижен.
  • Подписчики Claude Pro и Max в поддерживаемых регионах получают модель в списке автоматически.

Что дальше

Fable 5.1 расширяет Fable 5 при тех же базовых ценах, так сказано в документации платформы; сроков вывода Fable 5 из API компания не называет. Mythos 5.1 позиционируется как инструмент для киберзащиты и биологических исследований, и расширять круг организаций с доступом Anthropic пока не обещает. В тот же вечер OpenAI объявила, что готовит модель Astra с «критическим» уровнем кибервозможностей и таким же ступенчатым доступом; сравнить обе на одинаковых задачах можно будет только после выхода Astra.

Источники: Claude Fable 5.1 and Claude Mythos 5.1 (Anthropic), Документация модели Fable 5.1, LLM Leaderboard (Artificial Analysis)

Изображение на обложке: скриншот anthropic.com