Anthropic представила Claude Opus 5 — новую флагманскую модель семейства Opus, рассчитанную на программирование, длительную работу агентов и профессиональные задачи. Компания позиционирует новинку как более доступную альтернативу Claude Fable 5: базовые тарифы ниже ровно вдвое, а результаты в ряде тестов приблизились к старшей модели или превысили её.

Релиз состоялся 24 июля 2026 года. Opus 5 уже доступна в Claude, Claude Code, Claude Cowork и через программный интерфейс под идентификатором claude-opus-5. Модель включили в подписки Pro, Max, Team и Enterprise. В тарифе Max она стала стандартным вариантом, а в Pro — самой мощной доступной моделью.
В документации Anthropic именно Fable 5 остаётся моделью для задач, где требуется максимальная доступная мощность. Opus 5 компания советует выбирать для сложного агентного программирования и корпоративной работы, когда важен баланс между качеством и стоимостью.
Стоимость Claude Opus 5 сохранилась на уровне Opus 4.8: $5 за миллион входных токенов и $25 за миллион выходных. Claude Fable 5 обходится в $10 и $50 соответственно. Разница в тарифах действительно двукратная.
Opus 5 получила контекстное окно объёмом один миллион токенов и может возвращать до 128 тысяч токенов за один синхронный запрос. Дата наиболее надёжных знаний модели — май 2026 года. Для сравнения, у Fable 5 заявлены то же контекстное окно и такой же предел ответа, но дата наиболее надёжных знаний ограничена январём.
Модель поддерживает регулируемый уровень вычислительных усилий. Разработчик может уменьшить его для недорогих повседневных задач или повысить, когда требуется более тщательная проверка решения. В Claude API и Claude Code стандартно используется уровень high.
Самые заметные результаты компания получила в задачах разработки. На CursorBench 3.2 модель с максимальным уровнем усилий отстала от лучшего результата Fable 5 менее чем на 0,5%, потратив примерно вдвое меньше денег на одну задачу. При уровнях high, xhigh и max Opus 5 также показала лучшее соотношение результата и стоимости среди участвовавших моделей.
CursorBench проверяет работу программирующего агента в реальных проектах: поиск нужных участков, изменение нескольких файлов, исправление ошибок и выполнение требований, распределённых по большой кодовой базе. Результат в таком испытании ближе к работе полноценного агента, чем обычная генерация небольшого фрагмента кода.
На Frontier-Bench v0.1 Opus 5 заняла первое место и более чем вдвое превысила результат Opus 4.8 при меньшей стоимости одной задачи. Испытание включает сложные инженерные задания, для которых модели требуется изучать проект, пользоваться инструментами и самостоятельно проверять выполненную работу.
Но Frontier-Bench запускала сама Anthropic на оболочке mini-SWE-agent. Каждое задание выполнялось пять раз, а запросы, отклонённые защитным классификатором Opus 5 или Fable 5, передавались Opus 4.8. Итоговые баллы поэтому описывают настроенную систему с резервной моделью, а не полностью изолированную Opus 5.
Anthropic пишет, что Opus 5 приблизилась к «предельному интеллекту» Fable 5, но не объявляет её новой самой мощной моделью компании. В таблице выбора моделей Fable 5 остаётся вариантом с наивысшими возможностями, а Opus 5 занимает более доступную ступень для ежедневного сложного использования.
Opus 5 получила сильный результат на ARC-AGI-3 — интерактивном испытании, где агент попадает в незнакомую среду без готовой инструкции. Ему приходится исследовать правила, запоминать последствия действий, менять стратегию и добиваться цели через серию попыток.
В материалах запуска балл Opus 5 оказался втрое выше результата ближайшей конкурирующей модели. Точное значение в текстовой части анонса не приводится. Показатель следует рассматривать как результат тестирования Anthropic, пока организаторы ARC Prize или независимые лаборатории не опубликуют сопоставимую конфигурацию и журналы запусков.
Сам по себе трёхкратный отрыв не означает, что модель приблизилась к человеческому уровню. ARC-AGI-3 специально построен так, чтобы измерять способность осваивать новые правила через взаимодействие. Современные модели по-прежнему решают лишь небольшую часть таких задач.
На OSWorld 2.0 Opus 5 показала лучший результат при сравнении моделей с одинаковыми затратами. Она превысила максимальный балл Fable 5, потратив чуть больше трети его стоимости.
OSWorld оценивает способность модели пользоваться графическим интерфейсом компьютера: открывать приложения, находить элементы на экране, заполнять формы и выполнять последовательности действий. Результат зависит от самой модели, оболочки агента, качества распознавания интерфейса и числа разрешённых попыток.
В Zapier AutomationBench модель завершала примерно в полтора раза больше заданий, чем ближайший соперник при сопоставимой стоимости. Даже минимальный уровень вычислительных усилий Opus 5 прошёл больше задач, чем остальные участники теста.
AutomationBench проверяет выполнение прикладных процессов от начала до конца: обработку таблиц, работу с корпоративными приложениями, отправку уведомлений и изменение данных в нескольких сервисах. Здесь важен не отдельный правильный ответ, а способность сохранить цель после серии вызовов инструментов.
Ранние пользователи также сообщили об улучшениях в анализе финансовых документов, юридических материалах, создании презентаций, разработке интерфейсов и работе с биологическими данными. Эти отзывы получены от партнёров Anthropic и не заменяют независимые испытания.
До появления независимых результатов Opus 5 комплексный индекс Artificial Analysis возглавляла Claude Fable 5 с 60 баллами. GPT-5.6 Sol с максимальным уровнем вычислений занимала второе место с 59 баллами. Разрыв между ними составлял один пункт.
В GDPval-AA v2, который проверяет выполнение экономически значимых профессиональных задач, публичная таблица также ставила Fable 5 на первое место с рейтингом 1747, а GPT-5.6 Sol — на второе с 1736. Opus 5 в доступной поисковой версии таблицы на момент релиза ещё не отображалась.
Для Opus 5 доступен Fast-режим. Он работает примерно в 2,5 раза быстрее стандартной конфигурации и тарифицируется по удвоенной базовой ставке: фактически $10 за миллион входных и $50 за миллион выходных токенов.
Быстрый режим доступен на платформе Anthropic и через расходуемые кредиты в Claude Code. Компания не утверждает, что качество модели в нём выше. Пользователь платит за меньшую задержку, а не за дополнительный уровень интеллекта.
При такой цене Fast Opus 5 сравнивается с обычной Fable 5 уже не как «модель вдвое дешевле». Тарифы на вход и выход становятся одинаковыми. Итоговая стоимость всё ещё может различаться из-за числа токенов и продолжительности агентного процесса.
Пользователи Claude Max получают Opus 5 как модель по умолчанию. В Claude Pro она стала самым мощным вариантом, но лимиты подписки могут отличаться от Max. Команды и организации получают доступ через тарифы Team и Enterprise.
Разработчики могут подключить модель напрямую через Claude API, Amazon Bedrock, Google Cloud и Microsoft Foundry. Идентификатор в программном интерфейсе — claude-opus-5.
Вместе с моделью Anthropic открыла бета-версию смены доступных инструментов внутри продолжающегося разговора. Раньше изменение списка инструментов затрагивало начало запроса и сбрасывало кеш системной инструкции и истории.
Новый механизм позволяет заранее объявить полный набор инструментов, а затем включать или отключать отдельные возможности специальными блоками. Уже обработанная часть разговора остаётся прежней, поэтому кеш продолжает работать.
Функция пригодится длительным агентным процессам. Агент может сначала получить инструменты анализа, позднее — доступ к развёртыванию, а после завершения операции снова лишиться опасных возможностей.
На Amazon Bedrock смена инструментов посреди диалога пока поддерживается только для Opus 5. Для активации требуется специальный заголовок бета-версии.
Вторая бета-функция связана с отказами защитных классификаторов. Разработчик может указать резервную модель, которая получит запрос, отклонённый Opus 5 или Fable 5. Повторная отправка выполняется на стороне сервера.
Механизм не отключает защиту. Резервная модель применяет собственные ограничения и тоже может отказаться выполнять опасную инструкцию. Функция предназначена для случаев, когда более строгая модель блокирует допустимую задачу, которую другой вариант Claude способен обработать безопасно.
В Claude, Claude Code и Claude Cowork запросы, остановленные киберзащитой Opus 5, по умолчанию направляются Opus 4.8. В программном интерфейсе резервную обработку нужно включить.
Opus 5 умеет искать уязвимости в исходном коде, но защитные системы ограничивают проверку исполняемых файлов, испытания на проникновение и создание эксплойтов. Компания ожидает, что классификаторы будут вмешиваться примерно на 85% реже, чем в Fable 5.
Модель специально не обучали наступательным кибероперациям. Рост способностей в этой области стал следствием общего улучшения рассуждений и программирования. В испытании OSS-Fuzz Opus 5 приблизилась к закрытой Mythos 5 по поиску уязвимостей, но заметно отстала при создании рабочих эксплойтов.
Mythos 5 остаётся специализированной моделью с ограниченным доступом для одобренных участников Project Glasswing. Anthropic считает её более мощной в наступательной кибербезопасности и длительных автономных биологических исследованиях.
Автоматизированный поведенческий аудит Anthropic присвоил Opus 5 показатель 2,3 по совокупности нежелательного поведения — минимальный результат среди последних моделей компании. Меньшее значение в этом тесте считается лучшим.
Компания зафиксировала снижение склонности к обману, помощи во вредоносных действиях и необратимым рискованным шагам. Opus 5 также точнее следовала внутренней «конституции» Claude, чем Opus 4.8, Sonnet 5 и Fable 5.
Вопросы и ответы
Claude Opus 5 мощнее Fable 5?
Не в целом. Anthropic продолжает называть Fable 5 моделью с максимальными доступными возможностями. Opus 5 приближается к ней или превосходит при определённом бюджете в отдельных тестах.
Почему Opus 5 называют вдвое дешевле?
Цена API составляет $5 за миллион входных и $25 за миллион выходных токенов. У Fable 5 тарифы равны $10 и $50. Итоговая стоимость задачи зависит от расхода токенов и уровня вычислительных усилий.
Насколько Opus 5 отстаёт от Fable 5 в программировании?
На CursorBench 3.2 при максимальном уровне усилий отставание составило менее 0,5%. Opus 5 при этом стоила примерно вдвое дешевле на одну задачу.
Opus 5 заняла первое место в агентном программировании?
Материалы запуска показывают первое место на Frontier-Bench и сильный результат в индексе программирующих агентов Artificial Analysis. Это лидерство в конкретных тестах и конфигурациях, а не во всех задачах разработки.
Opus 5 лучше GPT-5.6 Sol?
Для такого общего вывода данных недостаточно. Opus 5 лидирует в нескольких опубликованных тестах, но GPT-5.6 Sol сохраняет сильные позиции в независимых комплексных рейтингах. Результат зависит от конкретной задачи.
Где доступна новая модель?
Opus 5 доступна в подписках Pro, Max, Team и Enterprise, в Claude Code, Claude Cowork, Claude API и у крупных облачных поставщиков. В Max она используется по умолчанию.
Как называется модель в API?
Идентификатор — claude-opus-5. Он обозначает зафиксированную версию модели, а не автоматически обновляемый указатель.
Что даёт Fast-режим?
Он ускоряет работу примерно в 2,5 раза и удваивает базовую стоимость токенов. Fast-режим рассчитан на задачи, где задержка важнее цены.
Автоматический резервный режим обходит защиту?
Нет. Запрос, отклонённый классификатором Opus 5 или Fable 5, передаётся другой модели с собственными защитными ограничениями.
Что значит «самая выровненная модель»?
Во внутреннем автоматизированном аудите Opus 5 реже демонстрировала обман, помощь во вредоносных действиях и рискованные необратимые решения. Это оценка Anthropic, а не гарантия безопасного поведения во всех ситуациях.
Есть новость? Станьте автором.
Мы сотрудничаем с независимыми исследователями и специалистами по кибербезопасности. Отправьте нам новость или предложите статью на рассмотрение редакции.