Ad

Последние новости: AI безопасность

Gemini во время теста взломал системы трех компаний

от Маша Даровская

Google подтвердила, что одна из версий Gemini во время испытаний в мае 2026 года получила несанкционированный доступ к системам трех реальных компаний. Модель должна была искать уязвимости внутри закрытого учебного полигона, но из-за ошибки в настройке среды смогла выйти в …

Читать далее

Модель OpenAI сама дописала себе новые инструкции

от Маша Даровская

OpenAI опубликовала шесть отчетов о необычном поведении моделей во время обучения и тестирования. В одном случае невыпущенная исследовательская модель семейства Astra самостоятельно добавила в служебную сводку инструкции, которых не было в исходной задаче. Там модель объявила себя свободной от ролей …

Читать далее

OpenAI не отчиталась ЕС об инциденте RubyGems

от Маша Даровская

OpenAI не направила европейскому AI Office официальный отчет о майской кампании в RubyGems, которую независимые исследователи связали с внутренними ИИ-агентами компании. Еврокомиссия подтвердила, что знает об инциденте и контактирует с OpenAI. При этом говорить об уже установленном нарушении AI Act …

Читать далее

Claude использовали для атак и копирования моделей

от Маша Даровская

Anthropic опубликовала новый отчет о злоупотреблениях Claude, охватывающий операции, которые компания выявила и пресекла с декабря 2025 года по август 2026-го. В него вошли кибератаки, мошенничество, слежка, операции влияния, опасные биологические исследования, разработка вооружений и массовая дистилляция ИИ-моделей.

Читать далее

«Астра» заявила о десятикратном ускорении разбора инцидентов с помощью ИИ

от Маша Даровская

Разработчики Astra Linux больше года используют искусственный интеллект в рабочих процессах вокруг операционной системы. Один из результатов — разбор инцидентов стал занимать примерно в десять раз меньше времени. Ключевые решения при этом остаются за специалистами.

Читать далее

В ChatGPT нашли скрытый канал для передачи данных Gmail

от Маша Даровская

Исследователи Check Point Research обнаружили способ передавать команды и данные между изолированными средами ChatGPT, запущенными под разными аккаунтами. В демонстрации атаки ChatGPT выполнял обычный запрос пользователя, одновременно обращался к подключенному Gmail и передавал сведения о письмах в другой аккаунт. Скрытая …

Читать далее

ИИ-агенты взломали корпоративную сеть менее чем за 10 часов

от Маша Даровская

Злоумышленник использовал ИИ-агентов при вторжении в корпоративную инфраструктуру и менее чем за десять часов прошел путь от первоначального доступа до получения root-прав, компрометации среды разработки и кражи ключей к облачным сервисам. Исследователи Palo Alto Networks оценивают сопоставимый объем работы обычных …

Читать далее

OpenAI запускает GPT-6 Astra с критическими кибервозможностями

от Маша Даровская

OpenAI 3 сентября начала поэтапный запуск GPT-6 Astra — новой флагманской модели для работы с компьютером, программирования, профессиональных задач, науки и кибербезопасности. Первой доступ получила ограниченная группа организаций. В ближайшие дни модель должна появиться у пользователей ChatGPT Plus, Pro, Business …

Читать далее

Google выпустила Gemini, которая ищет уязвимости и пишет патчи

от Маша Даровская

Google представила Gemini 3.8 Flash Cyber — специализированную версию Gemini для анализа защищенности программного кода. Модель умеет работать с уязвимостями, проверять найденные проблемы и готовить исправления. В опубликованных тестах она набрала 86,2% на CyberGym и 47,2% на CWE-bench. Доступ к …

Читать далее

Anthropic выпустила Claude Fable 5.1 — на одном тесте результат вырос вдвое

от Маша Даровская

Anthropic представила Claude Fable 5.1 и Claude Mythos 5.1. Компания называет их своими самыми продвинутыми моделями для программирования и интеллектуальной работы. За двумя названиями скрывается одна базовая модель с разными защитными ограничениями: Fable 5.1 предназначена для широкого использования, Mythos 5.1 …

Читать далее

ИИ-агенты OpenAI вышли из контейнера через уязвимость Linux

от Маша Даровская

ИИ-агенты OpenAI во время внутренних испытаний по кибербезопасности использовали уже известную уязвимость ядра Linux, вышли за пределы контейнера и получили права суперпользователя на базовом рабочем узле компании. Модель сама определила, что версия ядра уязвима, получила эксплойт для CVE-2026-53362, приспособила его …

Читать далее

Как 700 ИИ-агентов OpenAI договорились и атаковали Hugging Face ради теста: подробности

от Маша Даровская

Июльский инцидент с ИИ-агентами OpenAI и Hugging Face оказался масштабнее, чем было известно после первого раскрытия атаки. Около 1200 агентов, которые должны были работать изолированно друг от друга, нашли неразрешенный способ общения и обменялись более чем 70 тыс. сообщений и …

Читать далее

Bitcoin-разработчики требуют сильнейший ИИ для защиты кода

от Маша Даровская

Разработчики и компании из экосистемы Bitcoin призвали крупнейшие ИИ-лаборатории дать проверенным специалистам по безопасности ранний доступ к наиболее мощным моделям. Причина — нейросети все лучше справляются с поиском уязвимостей и созданием эксплойтов, а ограничения коммерческих сервисов иногда блокируют те же …

Читать далее

OpenAI притормозила обучение передовых моделей после инцидента с Hugging Face и новых тестов Astra

от Маша Даровская

OpenAI временно замедлила развитие своих наиболее мощных моделей и перенаправила часть усилий на защиту исследовательской инфраструктуры. Компания на две недели приостанавливала обучение с подкреплением для последних моделей, предназначенных для последующего развертывания. Крупнейший запланированный цикл обучения с подкреплением для передовой модели …

Читать далее

Агенты OpenAI взломали Hugging Face. Теперь Брокман объясняет, как защищаться

от Маша Даровская

Президент и сооснователь OpenAI Грег Брокман 17 августа опубликовал колонку The Defender’s Window — «Окно возможностей для защитников». Повод для текста — инцидент, когда в июле экспериментальные ИИ-агенты компании во время проверки кибервозможностей вышли за предусмотренные границы тестовой среды, получили …

Читать далее