Ad
Искусственный интеллект

Anthropic выпустила Claude Fable 5.1 — на одном тесте результат вырос вдвое

Маша Даровская
By Маша Даровская , IT-редактор и автор
Anthropic выпустила Claude Fable 5.1 — на одном тесте результат вырос вдвое
Обложка © Anonhaven

Anthropic представила Claude Fable 5.1 и Claude Mythos 5.1. Компания называет их своими самыми продвинутыми моделями для программирования и интеллектуальной работы. За двумя названиями скрывается одна базовая модель с разными защитными ограничениями: Fable 5.1 предназначена для широкого использования, Mythos 5.1 — для проверенных организаций, которым нужны расширенные возможности в кибербезопасности и биологических исследованиях.

Главное обновление для разработчиков — рост результатов в сложных многоэтапных задачах и более дешёвая работа с большим контекстом. На научном тесте Terminal-Bench-Science 0.1 новая Fable получила 52,6% против 24,7% у Fable 5. Чтение уже обработанного контекста из кэша подешевело сразу на 75%, а фактические расходы при типичной нагрузке Anthropic оценивает примерно на четверть ниже. В релизе Anthropic компания подчеркивает, что базовые расценки на обычные входные и выходные токены не изменились.

Anthropic использует для Fable 5.1 и Mythos 5.1 одну базовую модель. Разница возникает на уровне защитных механизмов.

Fable 5.1 доступна обычным пользователям и разработчикам. Ее ограничения должны блокировать потенциально опасные сценарии в кибербезопасности, биологии и химии.

Mythos 5.1 предоставляет проверенным пользователям более широкий доступ к тем же возможностям. Сейчас Anthropic предлагает её ограниченному кругу специалистов по киберзащите и биологическим исследованиям через программы доверенного доступа. Доступ пока ограничен рядом организаций в США. На странице Claude Mythos компания также сообщает, что Mythos 5.1 уже используется в сервисе Claude Security для поиска уязвимостей в коде и подготовки исправлений для проверки человеком.

Обычным пользователям Claude Code доступна Fable 5.1. Mythos 5.1 остается моделью с ограниченным доступом.

Самая громкая цифра релиза получена на Terminal-Bench-Science 0.1 — наборе задач, где ИИ должен выполнять научную работу через терминал.

Fable 5.1 показала 52,6%, Fable 5 — 24,7%. Это рост примерно в 2,1 раза. В той же конфигурации Anthropic получила 29% для Opus 5 и 22,4% для GPT-5.6 Sol. Компания отдельно указывает статистическую погрешность примерно ±3,5–4,5 процентного пункта.

В Terminal-Bench 4.0, где проверяется автономная работа с программным кодом через терминал, Fable 5.1 набрала 55,8% против 42% у Fable 5. Mythos 5.1 получила 60,9% — часть разницы Anthropic связывает с менее строгими ограничениями для задач по информационной безопасности.

На CursorBench 3.2.0 результат вырос с 70,5 до 73,4%, а на тесте автоматизации рабочих процессов AutomationBench — с 17,1 до 31,4%. В Humanity's Last Exam без инструментов Fable 5.1 набрала 60,9% против 57,8% у Fable 5.

Сами результаты пока в основном исходят от Anthropic и ее партнеров. Это важно учитывать: речь о данных разработчика модели, а не о полном наборе независимо воспроизведенных испытаний.

Базовая цена Fable 5.1 осталась такой же, как у Fable 5: $10 за миллион входных токенов и $50 за миллион выходных.

Серьезно изменилась стоимость повторного использования уже обработанного контекста. Чтение миллиона токенов из кэша теперь стоит $0,25 вместо $1, то есть на 75% меньше. Документация Claude API также указывает для Fable 5.1 контекстное окно в 1 млн токенов и максимальный ответ до 128 тыс. токенов.

Кэш особенно важен для программирующих агентов. Если Claude часами работает с одним проектом, ей приходится снова обращаться к исходному коду, инструкциям, описаниям инструментов и предыдущему контексту. Без кэширования одни и те же данные пришлось бы многократно оплачивать по обычному тарифу.

Anthropic изучила реальное использование Fable в Claude Enterprise, Claude Code и API за четыре недели августа 2026 года. Компания оценила, что новая цена кэша снижает расходы примерно на 25% для типичной нагрузки и может дать экономию примерно до 45% в сложных автономных сценариях, где повторно используется особенно много контекста.

VentureBeat обращает внимание на необычную экономику новой модели: обычный вход Fable 5.1 стоит вдвое дороже Opus 5, но чтение кэша Fable уже обходится дешевле — $0,25 против $0,50 за миллион токенов. Поэтому разница особенно заметна именно в длительных задачах, где модель многократно возвращается к одной кодовой базе.

Fable 5.1 уже доступна в продуктах Anthropic, включая Claude Code, а разработчики могут обращаться к ней через API по идентификатору claude-fable-5-1. Модель также появилась в инфраструктуре AWS, Google Cloud и Microsoft Azure.

В Claude Code для нее по умолчанию используется высокий уровень вычислительных усилий. В Claude.ai и Claude Cowork стандартным вариантом остаётся средний уровень. Anthropic утверждает, что при низких и средних настройках Fable 5.1 способна показывать результаты, сопоставимые с Fable 5 или превосходящие их, при меньших затратах.

Часть самых интересных примеров Anthropic получила от компаний, тестировавших модель до релиза. Инвестиционная компания Millennium дала Fable 5.1 старую ошибку, вызывавшую сбой примерно раз на миллион запусков. Проблему не могли объяснить четыре-пять лет. Модель разобрала стороннюю библиотеку, сопоставила её код с дампом памяти и связала сбой с ошибкой внутри этой библиотеки.

MongoDB сообщила о другом испытании: Fable 5.1 примерно за три дня подготовила сложный прототип, предварительно изучив код сервисов и документацию. Некоторые этапы она выполняла часами без постоянного участия инженера.

Ramp запускала модель на задаче машинного обучения на 38 часов без присмотра. За это время Claude пересмотрела предыдущий результат, обнаружила проблему в разметке, запустила шесть экспериментов и вернулась с выводами и следующими шагами.

Anthropic также переработала ограничения Fable 5.1 для задач информационной безопасности. Модель теперь разрешено использовать для поиска уязвимостей непосредственно в исходном коде. Пентест, создание эксплойтов и поиск уязвимостей через анализ исполняемых файлов всё ещё могут перенаправляться на другие модели или блокироваться.

Для Claude Code компания ожидает примерно на 60% меньше вмешательств защитной системы за одну сессию по сравнению с первоначальными ограничениями Fable 5. Речь идет именно о срабатываниях фильтров, а не о снижении количества ошибок модели на 60%.

Фильтры для простых запросов по биологии и медицине тоже стали менее агрессивными: Anthropic сообщает о снижении ложных срабатываний примерно на 85% по сравнению с защитой, с которой изначально вышла Fable 5. Более чувствительные исследовательские запросы по-прежнему могут передаваться моделям Opus или требовать доступа к Mythos.

Mythos 5.1 использует ту же основу, что Fable 5.1, но получила менее жесткие ограничения в областях, где возможности продвинутой модели могут использоваться как в защитных, так и в опасных целях.

Модель предназначена прежде всего для проверенных специалистов по кибербезопасности и исследователей в области наук о жизни. Anthropic развивает для этого Cyber Verification Program и Life Sciences Verification Program. На старте доступ к Mythos 5.1 ограничен рядом американских организаций.

Цена начинается с тех же $10 за миллион входных и $50 за миллион выходных токенов, однако оплатить API недостаточно — организации сначала требуется получить соответствующий доступ.

В релиз Anthropic включила несколько экспериментов, которые выходят далеко за пределы программирования.

Mythos 5.1 использовали для проектирования белков, способных связываться с заданными молекулярными мишенями. Полученные конструкции отправили двум внешним организациям на лабораторную проверку. На трёх мишенях Anthropic сообщает о показателях связывания примерно в десять раз лучше лучших результатов соответствующих соревнований Adaptyv Bio. Доля работоспособных конструкций почти достигла 50% на наборе из 12 мишеней.

Fable 5.1 получила другую задачу: построить новую карту высот части Венеры на основе радиолокационных данных аппарата NASA Magellan. Модель обучила нейросеть и помогла получить карту примерно трети поверхности планеты. Детализация выросла с прежних 10–20 км до примерно 2–3 км, а полученные данные Anthropic опубликовала под свободной лицензией.

Mythos 5.1 также переписала вычислительные ядра семи открытых нейросетей, применяемых в биологии и геномике. Anthropic сообщает об ускорении отдельных моделей до 2,5 раза при сохранении идентичных результатов и об оценочном сокращении стоимости некоторых массовых вычислений на GPU на 30–60%.

Claude Fable 5.1 вышла 1 сентября 2026 года. Модель получила контекст до миллиона токенов, ответ до 128 тыс. токенов и сохранила базовую цену Fable 5.

Самый впечатляющий результат релиза — 52,6% против 24,7% у Fable 5 на Terminal-Bench-Science. Это действительно рост больше чем в два раза, но распространять его на все возможности модели нельзя. На других тестах улучшение составляет от нескольких до примерно четырнадцати процентных пунктов.

Вопросы и ответы

Что такое Claude Fable 5.1?

Это новая старшая общедоступная модель Anthropic для сложного программирования, интеллектуальной работы, исследований и длительных задач с использованием инструментов.

Fable 5.1 действительно в два раза лучше Fable 5?

Только на отдельном тесте. На Terminal-Bench-Science 0.1 результат вырос с 24,7 до 52,6%. На большинстве других испытаний прирост гораздо меньше.

Чем Fable 5.1 отличается от Mythos 5.1?

Они используют одну базовую модель. Fable 5.1 получает более строгие защитные ограничения, а Mythos 5.1 предоставляет прошедшим проверку специалистам расширенные возможности в кибербезопасности и биологических исследованиях.

Можно ли выбрать Mythos 5.1 в обычном Claude Code?

Нет. Fable 5.1 доступна широкому кругу пользователей, Mythos 5.1 распространяется через программы доверенного доступа.

Сколько стоит Fable 5.1?

$10 за миллион обычных входных токенов, $50 за миллион выходных и $0,25 за миллион токенов при чтении из кэша.

Почему Anthropic говорит об экономии 25%, если базовая цена не изменилась?

Из-за кэширования. Чтение ранее обработанного контекста подешевело на 75%. На реальной нагрузке Anthropic оценивает общую экономию примерно в 25% для типичных задач и до 45% в сложных сценариях с большим количеством повторно используемого контекста.

Можно ли использовать Fable 5.1 для поиска уязвимостей?

Да, анализ исходного кода и поиск уязвимостей разрешены. Создание эксплойтов, пентест и некоторые другие чувствительные сценарии остаются ограниченными.

Есть новость? Станьте автором.

Мы сотрудничаем с независимыми исследователями и специалистами по кибербезопасности. Отправьте нам новость или предложите статью на рассмотрение редакции.