Ad
Искусственный интеллект

Grok 4.6 вышел: новый флагман сравнялся с GPT-5.6 Sol в Artificial Analysis

Маша Даровская
By Маша Даровская , IT-редактор и автор
Grok 4.6 вышел: новый флагман сравнялся с GPT-5.6 Sol в Artificial Analysis
Обложка © Anonhaven

SpaceXAI 12 августа выпустила Grok 4.6 — новую версию флагманской языковой модели для программирования, агентных сценариев и работы с информацией. Главным направлением обновления стали длинные многошаговые задачи: модель должна дольше работать без вмешательства пользователя, исследовать незнакомую тему, разбираться в кодовой базе, проверять сделанное и дорабатывать результат.

По независимому Artificial Analysis Intelligence Index Grok 4.6 в режиме high получил 61 балл. Такой же результат сейчас у GPT-5.6 Sol с максимальным уровнем рассуждения. Конфигурация Claude Fable 5 с максимальными вычислительными затратами получила 62 балла. Grok 4.5 в таблице разработчика набирает 56.

Получается заметный скачок за короткий срок: Grok 4.5 появился 16 июля, Grok 4.6 — 12 августа. Между двумя релизами прошло меньше месяца.

Базовые ставки действительно не изменились: $2 за миллион входных и $6 за миллион выходных токенов. Запросы с контекстом от 200 тысяч токенов стоят уже $4 и $12 соответственно. Такие же основные ставки применялись к Grok 4.5. При этом кешированный ввод у новой модели подорожал: с $0,30 до $0,50 за миллион токенов в обычном режиме и с $0,60 до $1 при длинном контексте.

SpaceXAI описывает Grok 4.6 прежде всего как развитие Grok 4.5, рассчитанное на long-running agents — агентов, способных долго выполнять последовательность связанных действий. В русскоязычном тексте корректнее говорить о длительно работающих агентах или длинных агентных сценариях.

Модель тестировали на задачах, где недостаточно выдать один блок кода и закончить работу. Grok должен исследовать предметную область, определить структуру проекта, реализовать основные функции, проверить результат и продолжить исправления. Разработчики отдельно отмечают, что в длинных заданиях модель чаще стала самостоятельно тестировать собственную работу перед переходом к следующему этапу.

Ещё одно направление — создание интерфейсов. SpaceXAI утверждает, что первый вариант визуальных и интерактивных проектов у Grok 4.6 получается сильнее, чем у Grok 4.5: модель способна с одного запроса задать структуру приложения и его визуальный язык, а затем продолжить доработку. Это пока оценка самого разработчика, а не результат отдельного универсального независимого теста.

Размер модели, количество параметров и подробную архитектуру компания не раскрывает. Grok 4.6 остаётся закрытой моделью.

Для Grok 4.6 провели более продолжительный этап дополнительного обучения, чем для предыдущей версии. В набор вошли отобранные синтетические данные для задач на рассуждение и сложных технических тем, инженерные материалы. Разработчики также изменили оптимизатор и схему обучения.

Любопытная деталь: Grok 4.5 использовали для повторной генерации обучающих траекторий следующей версии. Речь идёт о последовательностях решения задач при разных уровнях рассуждения, работе внутри агентных систем, программировании, естественных науках и профессиональных задачах. Проблемные примеры фильтровались автоматическими проверками на базе моделей.

После контролируемого дообучения использовалось обучение с подкреплением. Среди перечисленных сред — обычное программирование, работа с информацией, оптимизация кода ядра, веб-разработка и системы автоматизированного проектирования.

Grok 4.6 работает с контекстом до 500 тысяч токенов. То же значение было заявлено для Grok 4.5, поэтому увеличения контекстного окна в этом релизе нет.

Модель принимает текст и изображения, а выдаёт текст. Официальная документация указывает дату окончания основной обучающей базы — 1 февраля 2026 года.

Для рассуждений предусмотрены четыре режима: low, medium, high, xhigh.

По умолчанию API использует high. Именно вариант Grok 4.6 High фигурирует в сравнительной таблице разработчика.

Через API также доступны вызов функций, поиск в интернете, поиск по X и выполнение кода. Для длинных агентных циклов документация рекомендует сжатие контекста, чтобы история действий не разрасталась бесконечно.

Модель получила идентификатор API grok-4.6. Она работает через Responses API и Chat Completions.

Grok 4.6 доступен в Grok Build и Cursor, через собственный API, а также через OpenRouter, Vercel и Cloudflare. В Cursor модель заявлена для всех тарифных планов.

На первую неделю после релиза SpaceXAI удвоила включённый объём использования Grok 4.6 внутри Grok Build и Cursor.

Есть новость? Станьте автором.

Мы сотрудничаем с независимыми исследователями и специалистами по кибербезопасности. Отправьте нам новость или предложите статью на рассмотрение редакции.