Ad
Искусственный интеллект

Google дала защитникам Gemini 4 Argon без киберфильтров

Маша Даровская
By Маша Даровская , IT-редактор и автор
Google дала защитникам Gemini 4 Argon без киберфильтров
Обложка © Anonhaven

Google начала предоставлять проверенным специалистам по информационной безопасности доступ к Gemini 4 Argon — новой модели, которая умеет самостоятельно искать уязвимости в коде, проверять их и готовить исправления. Для этой группы компания отключает стандартные ограничения на выполнение киберзадач.

Свободного доступа к версии без киберфильтров не будет. Сейчас ее получают внутренние команды Google и отдельные участники закрытой программы Fairwind. В будущем общедоступная версия Argon должна блокировать запросы, которые могут помочь при реальных атаках. Google анонсировала модель 30 сентября.

Один из первых результатов уже связан с реальной инфраструктурой. Google утверждает, что Argon обнаружил критическую уязвимость в медицинском ПО, которое используют больницы в разных странах. Ошибка позволяла раскрыть конфиденциальные персональные данные и ранее не была найдена другими передовыми моделями. Название продукта, технические детали уязвимости и информация об исправлении пока не опубликованы. На это обратила внимание SecurityWeek.

Google позиционирует Gemini 4 Argon как модель для длинных многоэтапных задач. Кроме работы с кодом, она рассчитана на исследования, юридические и финансовые задачи. Для информационной безопасности модель специально обучали проходить весь цикл работы с уязвимостью: находить потенциальную ошибку, подтверждать, что проблема действительно существует, и готовить исправление.

Обычного указания на подозрительный участок кода для такой работы недостаточно. Нужно разобраться, при каких условиях проявляется ошибка, проверить влияние на систему, изменить код и убедиться, что исправление не сломало существующую функциональность.

Эту способность проверяет CWE-bench v1. В наборе 120 задач из реальных проектов, которые охватывают 73 типа слабых мест. Агент получает репозиторий без номера CVE и без подсказки, где искать проблему. Он должен самостоятельно обнаружить дефект и исправить его.

Gemini 4 Argon получил 68% в программной оценке pass@1 и разделил первое место с Grok 4.7 и GPT-6 Astra. Claude Opus 5.5 набрал 67%. При четырех попытках результат Argon вырос до 75%.

Сравнивать эти цифры как чистый рейтинг моделей нужно осторожно. На CWE-bench они работают через разные агентные среды: Argon использует Antigravity, GPT-6 Astra — Codex, Claude — Claude Code, Grok — opencode. Итог зависит от модели, инструментов вокруг нее и того, как агент взаимодействует с репозиторием.

Набор пока далек от насыщения. Лучший результат с первой попытки составляет 68%, а значит даже самые сильные системы не справляются примерно с третью задач. Разработчики CWE-bench специально не сообщают агенту CVE и класс ошибки: это должно приблизить тест к ситуации, когда уязвимость еще никто не описал.

CWE-bench проверяет прежде всего способность исправлять заранее отобранные уязвимости. Поиск новых проблем Google тестировала на других наборах.

На внутреннем тесте Argon анализировал сложные проекты на 20 языках программирования. Компания заявляет, что модель нашла больше слабых мест, чем специализированная Gemini 3.8 Flash Cyber. Проверить результаты независимо пока нельзя: сам набор и подробные оценки Google не опубликовала.

Еще один тест подготовила Wiz. В нем агент исследует работающие веб-системы без исходного кода: изучает поверхность атаки, ищет уязвимости и создает подтверждение, что проблема реально эксплуатируется. Google сообщает, что Argon и здесь превзошел Gemini 3.8 Flash Cyber. Полные результаты этого внутреннего теста тоже не раскрыты.

Реальная проверка проходила в рамках программы Wiz Scan for Good. Проект использует ИИ вместе с исследователями безопасности для поиска уязвимостей в общественных сервисах, критической инфраструктуре и системах некоммерческих организаций. За первые недели работы команда нашла сотни открытых извне проблем, которые после уведомления исправили владельцы систем.

Именно во время работы Scan for Good Argon, как утверждает Google, обнаружил критическую ошибку в медицинском ПО, которым пользуются больницы по всему миру. Пока это следует считать заявлением разработчика модели: технического отчета, CVE или данных, позволяющих независимо изучить находку, в открытом доступе нет.

Самая заметная часть анонса касается отключения киберограничений. Google пишет, что доверенные защитники и внутренние команды компании получат Argon без стандартных cyber guardrails. Эти механизмы обычно мешают модели выполнять запросы, которые могут использоваться для взлома: например, разрабатывать рабочую эксплуатацию уязвимости или автоматизировать отдельные этапы атаки. Для пентестеров и команд реагирования такие же действия могут быть частью легальной проверки.

Доступ поэтому ограничен программой Fairwind. Google запустила ее 2 сентября для государственных организаций, отдельных клиентов Google Cloud и партнеров из сферы кибербезопасности. На момент запуска в программе участвовали более 650 организаций. Это число относится ко всей Fairwind, а не к пользователям Gemini 4 Argon: новую модель сейчас получает только первая группа проверенных специалистов.

Организации обязуются выдавать доступ профильным сотрудникам — специалистам по информационной безопасности, реагированию на инциденты и тестированию на проникновение. Google также требует дополнительных мер защиты учетных записей, включая многофакторную аутентификацию.

Fairwind изначально работала с Gemini 3.8 Flash Cyber и CodeMender. Последний представляет собой агентную систему для поиска, проверки и исправления уязвимостей. Argon становится более мощной моделью в этой же схеме.

Для более широкого выпуска Google сохраняет ограничения. Модель должна отказываться от запросов, которые могут помочь провести вредоносную кибератаку или разработать опасные химические, биологические, радиологические и ядерные сценарии. При этом компания пытается сохранить возможность выполнять легальные исследовательские задачи двойного назначения.

Google также тестирует методы обнаружения злоупотреблений через анализ внутренней активности модели. Защитные механизмы проверяли внутренние и внешние команды с помощью ручных и автоматизированных атак.

Отдельное направление — защита от косвенного внедрения инструкций. При такой атаке вредоносная команда спрятана не в запросе пользователя, а, например, на веб-странице или в документе, который читает агент. Модель может принять чужой текст за инструкцию и выполнить действие, которого пользователь не запрашивал.

Google называет Argon своей наиболее устойчивой моделью к таким атакам и приводит результаты тестирования на Gray Swan Indirect Prompt Injection. Компания использовала автоматизированные атаки и состязательное обучение, но абсолютной защиты от внедрения инструкций не заявляет.

Для агентов добавлен еще один уровень контроля. Google описывает систему, которая отслеживает ход выполнения задачи и действия модели и может остановить работу, если агент выходит за пределы первоначального запроса. Высокорисковые обучение и проверки проходят в дополнительно изолированных тестовых средах.

Еще одно заметное изменение — максимальный объем вывода. У Gemini 4 Argon лимит выходных данных увеличен с 64 тысяч до 1 млн токенов. Речь именно об объеме, который модель может сгенерировать за одну длинную последовательность работы, а не о размере контекстного окна.

Такой запас нужен для задач, где агент должен долго работать самостоятельно: читать большой репозиторий, исследовать зависимости, менять файлы, запускать проверки, анализировать результат и повторять цикл.

Google уже использует Argon внутри компании. Агенты помогают переносить код C и C++ на Rust — от отдельных библиотек до ядра Zircon операционной системы Fuchsia объемом свыше 800 тысяч строк. Компания подчеркивает, что изменения в критических компонентах проходят автоматические и ручные проверки перед внедрением.

В библиотеке видеодекодера libgav1 агенты переписали около 32 тысяч строк SIMD-кода в существующем варианте на Rust. Google сообщает, что после серии экспериментов полученная версия стала в 2,7 раза быстрее прежнего порта на Rust при идентичном результате декодирования.

Argon также применяли для анализа потребления памяти в инфраструктуре Google. Компания утверждает, что изменения, найденные агентами, уже высвободили более 300 ТиБ памяти в дата-центрах, а потенциальная экономия оценивается в 500 ТиБ — 1 ПиБ.

Gemini 4 Argon пока нельзя просто выбрать в публичном API. Google собирается постепенно расширять доступ после работы с первой группой тестировщиков. Следующими модель должны получить платные пользователи API и подписчики Google AI Ultra, затем доступ планируется открыть более широкой аудитории. Точную дату компания не назвала.

Стартовая цена API заявлена на уровне $2 за миллион входных и $10 за миллион выходных токенов. Кешированный ввод будет стоить на 95% дешевле обычного. После вводного периода тариф вырастет до $4 за миллион входных и $20 за миллион выходных токенов. Продолжительность льготного периода Google пока не уточнила.

Главное отличие нынешнего запуска от обычного анонса новой модели — контролируемый доступ к ее полным кибервозможностям. Google дает отдельным внешним защитникам инструмент, который умеет самостоятельно искать, подтверждать и исправлять уязвимости, но пока не открывает такой режим всем пользователям.

Результаты CWE-bench показывают, что подобные агенты уже способны закрывать значительную часть реальных задач, но до автономного аудитора, которому можно без проверки доверить любой репозиторий, еще далеко. У Argon остается примерно треть нерешенных задач даже в лучшем результате с первой попытки, а наиболее громкая реальная находка — уязвимость в медицинском ПО — пока не получила публичного технического разбора.

Вопросы и ответы

Что такое Gemini 4 Argon?

Это новая модель Google для длинных многоэтапных задач в программировании, работе с корпоративной информацией и кибербезопасности. В защитных сценариях она умеет искать уязвимости, проверять их и готовить исправления. Google представила Argon 30 сентября 2026 года.

Правда ли, что Google выпустила Gemini без фильтров?

Нет. Версию без стандартных ограничений на киберзадачи получает только группа проверенных специалистов и внутренние команды Google. Для массового выпуска компания сохраняет защитные механизмы против вредоносных запросов.

Кто получает полный доступ к кибервозможностям Argon?

Первые пользователи входят в закрытую программу Fairwind. Она предназначена для проверенных государственных организаций, клиентов Google Cloud и партнеров из сферы кибербезопасности. В программе больше 650 участников, но Google не сообщала, что Argon уже доступен всем им.

Что показал Gemini 4 Argon на CWE-bench?

На CWE-bench v1 модель получила 68% в pass@1 и разделила первое место с Grok 4.7 и GPT-6 Astra. Набор состоит из 120 задач и охватывает 73 класса слабых мест. Агент должен сам найти проблему в репозитории и исправить ее.

Argon действительно нашел критическую уязвимость в медицинском ПО?

Google сообщает о такой находке в рамках программы Wiz Scan for Good. Уязвимость могла раскрывать чувствительные персональные данные в ПО, которым пользуются больницы в разных странах. Название продукта, CVE, технические подробности и статус исправления не опубликованы, поэтому независимо оценить конкретную находку пока нельзя.

Что означает лимит в миллион токенов?

Google увеличила максимальный объем вывода Argon с 64 тысяч до 1 млн токенов. Это выходной лимит для длинной последовательности работы модели, а не заявленный размер ее контекстного окна.

Когда Argon станет доступен всем?

Точной даты нет. Google сначала расширит доступ среди платных пользователей API и подписчиков Google AI Ultra, а затем планирует открыть модель разработчикам, компаниям и обычным пользователям.

Сколько будет стоить API?

На вводном этапе — $2 за миллион входных и $10 за миллион выходных токенов. Позже цена должна вырасти до $4 и $20 соответственно.

Есть новость? Станьте автором.

Мы сотрудничаем с независимыми исследователями и специалистами по кибербезопасности. Отправьте нам новость или предложите статью на рассмотрение редакции.