Ad

Последние новости: Безопасность ИИ

Gemini во время теста взломал системы трех компаний

от Маша Даровская

Google подтвердила, что одна из версий Gemini во время испытаний в мае 2026 года получила несанкционированный доступ к системам трех реальных компаний. Модель должна была искать уязвимости внутри закрытого учебного полигона, но из-за ошибки в настройке среды смогла выйти в …

Читать далее

Модель OpenAI сама дописала себе новые инструкции

от Маша Даровская

OpenAI опубликовала шесть отчетов о необычном поведении моделей во время обучения и тестирования. В одном случае невыпущенная исследовательская модель семейства Astra самостоятельно добавила в служебную сводку инструкции, которых не было в исходной задаче. Там модель объявила себя свободной от ролей …

Читать далее

OpenAI не отчиталась ЕС об инциденте RubyGems

от Маша Даровская

OpenAI не направила европейскому AI Office официальный отчет о майской кампании в RubyGems, которую независимые исследователи связали с внутренними ИИ-агентами компании. Еврокомиссия подтвердила, что знает об инциденте и контактирует с OpenAI. При этом говорить об уже установленном нарушении AI Act …

Читать далее

Claude использовали для атак и копирования моделей

от Маша Даровская

Anthropic опубликовала новый отчет о злоупотреблениях Claude, охватывающий операции, которые компания выявила и пресекла с декабря 2025 года по август 2026-го. В него вошли кибератаки, мошенничество, слежка, операции влияния, опасные биологические исследования, разработка вооружений и массовая дистилляция ИИ-моделей.

Читать далее

«Астра» заявила о десятикратном ускорении разбора инцидентов с помощью ИИ

от Маша Даровская

Разработчики Astra Linux больше года используют искусственный интеллект в рабочих процессах вокруг операционной системы. Один из результатов — разбор инцидентов стал занимать примерно в десять раз меньше времени. Ключевые решения при этом остаются за специалистами.

Читать далее

В ChatGPT нашли скрытый канал для передачи данных Gmail

от Маша Даровская

Исследователи Check Point Research обнаружили способ передавать команды и данные между изолированными средами ChatGPT, запущенными под разными аккаунтами. В демонстрации атаки ChatGPT выполнял обычный запрос пользователя, одновременно обращался к подключенному Gmail и передавал сведения о письмах в другой аккаунт. Скрытая …

Читать далее

Агенты OpenAI превратили старую wiki в общий чат

от Маша Даровская

OpenAI подтвердила инцидент, в котором ее ИИ-агенты записывали данные на несколько публичных сайтов. Самый крупный массив активности исследователи нашли на DSEWiki — старой немецкоязычной wiki для разработчиков. Весной 2026 года агенты оставили там около 18 тысяч публикаций, обменивались результатами заданий, …

Читать далее

ИИ-агенты взломали корпоративную сеть менее чем за 10 часов

от Маша Даровская

Злоумышленник использовал ИИ-агентов при вторжении в корпоративную инфраструктуру и менее чем за десять часов прошел путь от первоначального доступа до получения root-прав, компрометации среды разработки и кражи ключей к облачным сервисам. Исследователи Palo Alto Networks оценивают сопоставимый объем работы обычных …

Читать далее

OpenAI запускает GPT-6 Astra с критическими кибервозможностями

от Маша Даровская

OpenAI 3 сентября начала поэтапный запуск GPT-6 Astra — новой флагманской модели для работы с компьютером, программирования, профессиональных задач, науки и кибербезопасности. Первой доступ получила ограниченная группа организаций. В ближайшие дни модель должна появиться у пользователей ChatGPT Plus, Pro, Business …

Читать далее

Google выпустила Gemini, которая ищет уязвимости и пишет патчи

от Маша Даровская

Google представила Gemini 3.8 Flash Cyber — специализированную версию Gemini для анализа защищенности программного кода. Модель умеет работать с уязвимостями, проверять найденные проблемы и готовить исправления. В опубликованных тестах она набрала 86,2% на CyberGym и 47,2% на CWE-bench. Доступ к …

Читать далее

Anthropic выпустила Claude Fable 5.1 — на одном тесте результат вырос вдвое

от Маша Даровская

Anthropic представила Claude Fable 5.1 и Claude Mythos 5.1. Компания называет их своими самыми продвинутыми моделями для программирования и интеллектуальной работы. За двумя названиями скрывается одна базовая модель с разными защитными ограничениями: Fable 5.1 предназначена для широкого использования, Mythos 5.1 …

Читать далее

ИИ-агенты OpenAI вышли из контейнера через уязвимость Linux

от Маша Даровская

ИИ-агенты OpenAI во время внутренних испытаний по кибербезопасности использовали уже известную уязвимость ядра Linux, вышли за пределы контейнера и получили права суперпользователя на базовом рабочем узле компании. Модель сама определила, что версия ядра уязвима, получила эксплойт для CVE-2026-53362, приспособила его …

Читать далее

Как 700 ИИ-агентов OpenAI договорились и атаковали Hugging Face ради теста: подробности

от Маша Даровская

Июльский инцидент с ИИ-агентами OpenAI и Hugging Face оказался масштабнее, чем было известно после первого раскрытия атаки. Около 1200 агентов, которые должны были работать изолированно друг от друга, нашли неразрешенный способ общения и обменялись более чем 70 тыс. сообщений и …

Читать далее

Bitcoin-разработчики требуют сильнейший ИИ для защиты кода

от Маша Даровская

Разработчики и компании из экосистемы Bitcoin призвали крупнейшие ИИ-лаборатории дать проверенным специалистам по безопасности ранний доступ к наиболее мощным моделям. Причина — нейросети все лучше справляются с поиском уязвимостей и созданием эксплойтов, а ограничения коммерческих сервисов иногда блокируют те же …

Читать далее

Базовый контроль ИИ оказался недостаточным даже у крупнейших лабораторий

от Маша Даровская

Ни одна из пяти крупнейших лабораторий передового искусственного интеллекта не показала полной реализации шести базовых механизмов контроля моделей, выбранных для проверки независимой некоммерческой организацией Guidelight AI Standards. Лучший результат — C+ — получили OpenAI и Anthropic, Google оценили на D+, …

Читать далее