Ad
Искусственный интеллект

Mistral открыла свою ИИ-платформу для сторонних моделей: первой стала китайская GLM-5.2

Маша Даровская
By Маша Даровская , IT-редактор и автор
Mistral открыла свою ИИ-платформу для сторонних моделей: первой стала китайская GLM-5.2
Обложка © Anonhaven

Французская Mistral AI начала размещать на собственной платформе модели других разработчиков. Первой стала GLM-5.2 от китайской Z.ai. Модель запускается на инфраструктуре Mistral и доступна через ее сервисы рядом с собственными разработками компании.

Для Mistral это важное изменение стратегии. Раньше продуктовая линейка компании строилась прежде всего вокруг собственных больших языковых и специализированных моделей. Теперь компания хочет предоставить заказчику более широкий слой инфраструктуры: вычислительные мощности, размещение моделей, API, выбор региона обработки запросов и гарантии доступности для производственных систем. Компания пишет, что продолжает создавать модели разных классов и открывает ту же инфраструктуру для сторонних систем. GLM-5.2 стала первым таким примером.

Основной анонс новой инфраструктурной стратегии Mistral опубликовала 11 августа 2026 года. Компания сообщила сразу о трёх изменениях: региональной обработке запросов, новом уровне обслуживания Priority Tier и поддержке сторонних моделей с открытыми весами. Первой в этом списке названа GLM-5.2. Отдельная карточка GLM-5.2 в документации Mistral датирована 6 августа 2026 года. 

В каталоге модель обозначена как Third-party Open и находится в режиме публичного предварительного доступа. Mistral размещает ее самостоятельно и указывает, что обслуживает модель без собственных изменений. По сути, пользователь получает GLM через инфраструктурный слой Mistral, не переходя к отдельному поставщику для запуска модели.

Так Mistral постепенно перестает быть компанией, продукт которой можно описать только набором собственных нейросетей. Вычислительная инфраструктура становится самостоятельной частью бизнеса.

Z.ai представила GLM-5.2 16 июня 2026 года. Разработчик создавал её прежде всего для программирования, работы с большими проектами и длительных задач, выполняемых ИИ-агентами.

Контекстное окно модели достигает 1 млн токенов, а Mistral указывает максимальный объем ответа в 128 тыс. токенов. Такой объем контекста рассчитан на задачи, где модели приходится долго работать с крупной кодовой базой, документацией или большим количеством промежуточной информации.

В GLM-5.2 используется механизм IndexShare. Он позволяет нескольким слоям разреженного внимания использовать общий индексатор. Z.ai заявляет, что такая схема снижает вычислительные затраты индексатора при обработке длинного контекста.

Открытые веса GLM-5.2 распространяются по лицензии MIT. Это подтверждают опубликованная лицензия модели и карточка NVIDIA NGC. Модель можно разворачивать самостоятельно, используя, например, vLLM, SGLang и другие системы выполнения.

На 17 августа 2026 года Mistral установила следующие базовые цены: $1,40 за миллион входных токенов, $0,14 за миллион закэшированных входных токенов и $4,40 за миллион выходных токенов.

В документации для модели указаны обычные диалоговые запросы через API, вызов функций, структурированный ответ, предсказанный вывод и пакетная обработка. Это тарифы самой Mistral за размещенную у неё версию GLM-5.2.

Компания делает ставку на корпоративную инфраструктуру вокруг модели. Большой организации мало получить файл с весами. Нужны GPU, развертывание, обновления, API, управление доступом, контроль нагрузки, мониторинг, требования к месту обработки данных и понятные условия доступности сервиса. Mistral пытается собрать эти компоненты в одной платформе.

Новая система Regional Endpoints позволяет выбирать регион выполнения запросов. Сейчас официальная документация перечисляет Европейский союз и США. Для них используются отдельные точки API. Региональная обработка стоит на 10% дороже стандартного тарифа.

Выбор региональной точки относится именно к обработке запросов моделью. Служебные сведения — настройки учетной записи, ключи API, биллинг, управление доступом и часть эксплуатационных метаданных — могут обрабатываться другими системами Mistral за пределами выбранного региона. Компания отдельно описывает это ограничение в документации.

Доступность конкретных моделей тоже может различаться по регионам. Перед переносом производственной нагрузки Mistral рекомендует проверять список моделей через выбранную региональную точку API.

Еще одно новшество — Mistral Priority Tier. Это вариант обслуживания для систем, которым требуется заранее оговоренный уровень доступности вычислительных ресурсов. Mistral обещает индивидуальные ограничения пропускной способности и соглашение об уровне доступности сервиса. Сейчас Priority Tier находится в режиме публичного предварительного доступа. На странице облачной платформы компания указывает для этого направления SLA доступности 99,9%.

Для корпоративного рынка такая возможность может оказаться не менее важной, чем выбор самой нейросети. Если приложение зависит от модели постоянно, доступность вычислительных ресурсов становится частью архитектуры продукта.

Поворот в сторону инфраструктуры начался раньше августовского анонса. Из собственной хронологии Mistral следует, что концепцию Mistral Compute компания утвердила в апреле 2025 года, а публично показала проект в июне того же года. Первые стойки с NVIDIA GB200 прибыли в июле 2025-го. В феврале 2026 года GB200 уже обслуживали рабочие нагрузки, а в марте компания подключила первых внешних клиентов.

Сейчас Mistral Compute позиционируется как GPU-облако для обучения моделей и их запуска. Компания перечисляет ускорители NVIDIA GB200, GB300 и B300, процессоры Grace и x86, средства мониторинга, управление доступом, журналы событий и инструменты корпоративной безопасности.

План компании — построить в ЕС вычислительные мощности до 1 ГВт к 2030 году. Речь идёт о заявленной целевой мощности инфраструктуры, а не о уже существующем дата-центре на 1 ГВт.

Третья часть объявления от 11 августа связана с European Compute Units — ECU. Mistral предлагает крупным организациям заключать многолетние соглашения на вычислительные мощности. Такие обязательства дают клиентам доступ к инфраструктуре Mistral на протяжении нескольких лет, а компании помогают заранее понимать будущий спрос при строительстве новых мощностей.

В анонсе инициативы фигурируют руководители Amadeus, ASML, Capgemini, Caisse des Dépôts и CMA CGM. Эти компании поддерживают расширение европейской вычислительной инфраструктуры Mistral.

Модель бизнеса здесь хорошо знакома рынку дата-центров: крупный клиент заранее гарантирует спрос, поставщик получает основание вкладываться в дорогостоящие GPU и площадки.

За несколько недель до августовского объявления Mistral получила еще одно подтверждение спроса на такой бизнес.

21 июля 2026 года Microsoft и Mistral расширили партнерство и заключили многомиллиардное соглашение, связанное с европейской ИИ-инфраструктурой. Microsoft намерена использовать часть дополнительных GPU-мощностей Mistral для разработки ИИ и обслуживания собственных облачных сервисов. Mistral, в свою очередь, расширяет парк оборудования, включая тысячи ускорителей NVIDIA поколения Vera Rubin.

Еще несколько лет назад главным событием в отношениях компаний было появление моделей Mistral в Azure. Теперь Microsoft сама становится крупным потребителем вычислительной инфраструктуры французской компании. Для Mistral это уже бизнес совсем другого масштаба, чем продажа токенов через API собственной языковой модели.

Mistral продолжает предлагать собственные модели Mistral Medium 3.5, Mistral Small 4, семейство Ministral, специализированные OCR- и аудиомодели. GLM-5.2 вынесена в отдельную категорию сторонних размещённых моделей. В августовском сообщении Mistral сообщает, что продолжает создавать собственные модели для разных типов задач и при этом расширяет платформу за пределы собственной линейки.

Уже 14 августа Z.ai представила GLM-5.3. Новая версия использует ту же базовую модель, что и GLM-5.2, а улучшения получены на этапе дополнительного обучения. Разработчик заявляет заметный рост результатов в программировании и длительных агентных задачах. GLM-5.3 уже доступна пользователям подписки GLM Coding Plan. При этом обычный API для GLM-5.3 в основной документации Z.ai на 17 августа все еще помечен как готовящийся к запуску.

Открытые веса GLM-5.3 компания собирается опубликовать примерно через две недели после релиза, после дополнительной проверки и усиления мер безопасности.

В каталоге Mistral на момент проверки остаётся GLM-5.2. В прайс-листе среди сторонних размещенных моделей также указана только она.

Есть новость? Станьте автором.

Мы сотрудничаем с независимыми исследователями и специалистами по кибербезопасности. Отправьте нам новость или предложите статью на рассмотрение редакции.