Ad
Искусственный интеллект

DeepSeek тихо переключила V4 Pro на сборку 0813: миллион токенов контекста и $0,87 за миллион выхода

Маша Даровская
By Маша Даровская , IT-редактор и автор
DeepSeek тихо переключила V4 Pro на сборку 0813: миллион токенов контекста и $0,87 за миллион выхода
Обложка © Anonhaven

DeepSeek обновила старшую модель V4 Pro без отдельного большого анонса. В актуальной документации API алиас deepseek-v4-pro теперь указывает на DeepSeek-V4-Pro-0813. Модель получила контекстное окно в 1 млн токенов, максимальный ответ до 384 тыс. токенов и поддержку Responses API.

Сам способ обращения к модели не поменялся: разработчики по-прежнему указывают deepseek-v4-pro, а конкретную сборку выбирает DeepSeek на своей стороне.

Обновление хорошо видно при сравнении разных снимков документации. Более ранняя версия страницы ещё показывала просто DeepSeek-V4-Pro, причём Responses API для Pro был отключён с обещанием добавить поддержку в начале августа. Сейчас на той же странице стоит версия 0813, а Responses API отмечен как доступный.

Технические ограничения впечатляют даже без сравнения с конкурентами.

DeepSeek указывает для V4 Pro 0813 контекстное окно в 1 млн токенов и максимальный объём генерации в 384 тыс. токенов. Модель поддерживает обычный режим и режим рассуждений, который используется по умолчанию.

В API доступны вызов инструментов, вывод JSON, Responses API, совместимость с Anthropic API, продолжение ответа по заданному префиксу и заполнение пропущенного фрагмента кода. Последняя возможность работает только без режима рассуждений.

DeepSeek также ограничивает Pro 500 одновременно выполняемыми запросами на аккаунт. Для более компактной V4 Flash предел заметно выше — 2500. Компания разрешает запросить увеличение лимита отдельно.

Самая заметная часть предложения DeepSeek — стоимость. Миллион входных токенов V4 Pro 0813 стоит $0,435, если нужного префикса нет в кеше. При попадании в кеш цена падает до $0,003625 за миллион токенов. Миллион выходных токенов стоит $0,87.

То есть кешированный вход обходится примерно в 120 раз дешевле обычного. Здесь важно понимать механику: низкая цена действует именно на повторно используемую часть запроса, которая попала в кеш DeepSeek, а не автоматически на каждый длинный запрос.

Китайская версия документации приводит эквивалентные внутренние тарифы: 3 юаня за миллион входных токенов без кеша, 0,025 юаня при попадании и 6 юаней за миллион выходных.

Долго рассчитывать на эти цены, похоже, не стоит. На странице тарифов появилось прямое предупреждение: DeepSeek планирует существенно повысить общую стоимость API в ближайшее время. Конкретных новых цен пока нет.

Для сравнения подходит Grok 4.6, который xAI вывела в API 12 августа 2026 года. Его контекстное окно составляет 500 тыс. токенов. Модель принимает текст и изображения и возвращает текст.

При запросах короче 200 тыс. токенов xAI берёт $2 за миллион входных, $0,50 за кешированный вход и $6 за миллион выходных токенов.

Если размер входного запроса достигает 200 тыс. токенов, Grok 4.6 переходит на длинный тариф: $4 за вход, $1 за кешированный вход и $12 за выход. Повышенная ставка применяется ко всему запросу.

При коротком контексте обычный вход DeepSeek сейчас примерно в 4,6 раза дешевле, а выход — примерно в 6,9 раза дешевле.

Сравнивать только ценники всё же недостаточно: модели отличаются архитектурой, мультимодальностью, скоростью и качеством на конкретных задачах. Grok 4.6, к примеру, принимает изображения, а API V4 Pro остаётся текстовым.

История V4 Pro 0813 продолжает июльское обновление младшей модели.

DeepSeek V4 Flash сейчас работает в API как DeepSeek-V4-Flash-0731. У неё те же миллион токенов контекста и максимум 384 тыс. токенов ответа, но API заметно дешевле: $0,14 за миллион входных токенов без кеша, $0,0028 при попадании и $0,28 за выход.

Июльская Flash привлекла внимание прежде всего резким ростом результатов в задачах программных агентов. Для неё распространялись данные о 82,7 балла в Terminal Bench 2.1, 54,2 в NL2Repo и 54,4 в DeepSWE. Эти результаты относились к прогонам с агентной оболочкой DeepSeek Harness и максимальным режимом рассуждений; часть тестов DeepSeek использовала собственные наборы.

V4 Pro 0813 стала следующим обновлением этой линии.

В соцсетях сейчас расходится сравнительная таблица V4 Pro 0813 с V4 Pro Preview, Flash 0731, GLM-5.2, Kimi K3, Claude Opus 4.8 и Fable 5.

Часть цифр воспроизводится сразу несколькими агрегаторами. Для V4 Pro 0813 указывают, например, 62,7 в DeepSWE и 61,5 в NL2Repo. Для внутреннего DSBench-FullStack встречается результат 71,1.

Проблема в происхождении данных. На текущей странице тарифов и моделей DeepSeek нет таблицы результатов V4 Pro 0813. Официальный Hugging Face тоже не обновлялся под эту сборку.

Особенно заметен DeepSWE. У предварительной V4 Pro в июльских сравнениях фигурировало около 12,8, у новой 0813 — 62,7. Это рост на 49,9 процентного пункта, или почти в 4,9 раза по абсолютному значению результата.

Artificial Analysis уже добавила DeepSeek V4 Pro 0813 в свой текущий рейтинг. В режиме максимального рассуждения модель получила 53 балла в Artificial Analysis Intelligence Index. Для сравнения, там же Grok 4.6 получает 61, GPT-5.6 Sol — 61, Claude Fable 5 — 62.

Но в Artificial Analysis на странице V4 Pro 0813 сейчас указаны 284 млрд общих и 13 млрд активных параметров — это характеристики V4 Flash, а не V4 Pro. Официальная модельная карточка V4 Pro указывает 1,6 трлн параметров и 49 млрд активных. Такое расхождение похоже на ошибку в метаданных Artificial Analysis.

Открытые веса DeepSeek V4 Pro существуют. DeepSeek выпустила предварительную V4 Pro ещё в апреле. Официальная модельная карточка описывает MoE-модель на 1,6 трлн параметров, из которых 49 млрд активируются при обработке токена. Контекст — миллион токенов. Репозиторий распространяется по лицензии MIT. Но отдельные веса V4 Pro 0813 сейчас не опубликованы.

История официального репозитория на Hugging Face показывает, что сами файлы модели были загружены в апреле. Последнее изменение всего репозитория датировано 22 июня и касается технического отчёта. Записей от августа и отдельного чекпойнта 0813 нет.

Апрельская V4 Pro — MoE-модель с 1,6 трлн общих и 49 млрд активных параметров. Она использует гибридную схему внимания из Compressed Sparse Attention и Heavily Compressed Attention. DeepSeek заявляет, что при контексте в миллион токенов такая архитектура требует около 27% вычислений на один новый токен и 10% объёма KV-кеша относительно V3.2. Текущая документация API для 0813 не публикует число параметров и не сообщает, менялась ли архитектура.

Есть новость? Станьте автором.

Мы сотрудничаем с независимыми исследователями и специалистами по кибербезопасности. Отправьте нам новость или предложите статью на рассмотрение редакции.