Ad

Искусственный интеллект и угрозы безопасности

Безопасность в эпоху нейросетей. Раздел посвящен тому, как искусственный интеллект меняет правила игры: дипфейки, использование ChatGPT хакерами, уязвимости в LLM-моделях и новые методы защиты с помощью машинного обучения.

ИИ-агент создал фейковых разработчиков ради вредоносного PR

by Маша Даровская

ИИ-агент на базе Claude Mythos 5 от Anthropic попытался внедрить вредоносный код в реальный открытый проект на GitHub, а после разоблачения задействовал вымышленные профили разработчиков, чтобы убедить сопровождающего проекта принять изменения. Инцидент произошел во время испытаний британского AI Security Institute …

Читать далее

OpenAI сбросила лимиты Codex, выпустила новую версию и чинит лишний расход

by Маша Даровская

OpenAI полностью сбросила лимиты использования Codex для платных подписок после нескольких дней жалоб на слишком быстрый расход доступного объема. Сброс дошел до аккаунтов ночью 24 августа. Одновременно разработчики начали выкатывать исправления для нескольких найденных причин перерасхода.

Читать далее

Codex раздал сброс за 20 млн и проверяет лимиты

by Маша Даровская

Codex преодолел отметку в 20 млн активных пользователей. В честь этого OpenAI начислила платным пользователям Codex и ChatGPT Work по одному сохраненному сбросу лимитов. Его можно не применять сразу, а оставить до момента, когда дополнительная квота действительно понадобится.

Читать далее

Базовый контроль ИИ оказался недостаточным даже у крупнейших лабораторий

by Маша Даровская

Ни одна из пяти крупнейших лабораторий передового искусственного интеллекта не показала полной реализации шести базовых механизмов контроля моделей, выбранных для проверки независимой некоммерческой организацией Guidelight AI Standards. Лучший результат — C+ — получили OpenAI и Anthropic, Google оценили на D+, …

Читать далее

Ornith-1.5 выпустила 9B-модель для локального запуска: в отдельных тестах она обходит Qwen3.6-35B

by Маша Даровская

Команда Ornith опубликовала новое открытое семейство Ornith-1.5 для программирования, рассуждений и работы с инструментами. В линейку вошли три основных варианта: плотная модель на 9 млрд параметров, модель со смесью экспертов Ornith-1.5-35B-A3B и старшая Ornith-1.5-397B. Веса доступны под лицензией MIT.

Читать далее

OpenAI притормозила обучение передовых моделей после инцидента с Hugging Face и новых тестов Astra

by Маша Даровская

OpenAI временно замедлила развитие своих наиболее мощных моделей и перенаправила часть усилий на защиту исследовательской инфраструктуры. Компания на две недели приостанавливала обучение с подкреплением для последних моделей, предназначенных для последующего развертывания. Крупнейший запланированный цикл обучения с подкреплением для передовой модели …

Читать далее

Агенты OpenAI взломали Hugging Face. Теперь Брокман объясняет, как защищаться

by Маша Даровская

Президент и сооснователь OpenAI Грег Брокман 17 августа опубликовал колонку The Defender’s Window — «Окно возможностей для защитников». Повод для текста — инцидент, когда в июле экспериментальные ИИ-агенты компании во время проверки кибервозможностей вышли за предусмотренные границы тестовой среды, получили …

Читать далее

«Яндекс» предложил экзамен для больших ИИ-моделей: открытые вопросы хотят дополнить закрытой проверкой

by Маша Даровская

«Яндекс» представил концепцию национального набора тестовых заданий и эталонных данных для проверки ИИ-моделей. Система должна помочь оценивать модели с учётом российских условий и требований к традиционным духовно-нравственным ценностям. Концепцию обсуждали 13 августа на заседании рабочей группы по регулированию и административным …

Читать далее

OpenAI сообщила о пользователе ChatGPT в ФБР после угроз бывшей девушке

by Маша Даровская

OpenAI отправила в ФБР экстренное предупреждение о пользователе ChatGPT, который неоднократно писал об убийстве бывшей девушки и описывал возможные сценарии нападения. Федеральное ведомство передало информацию местным правоохранителям во Флориде. Мужчину позже арестовали, Goldman Sachs уволила его, а в августе суд …

Читать далее

Mistral открыла свою ИИ-платформу для сторонних моделей: первой стала китайская GLM-5.2

by Маша Даровская

Французская Mistral AI начала размещать на собственной платформе модели других разработчиков. Первой стала GLM-5.2 от китайской Z.ai. Модель запускается на инфраструктуре Mistral и доступна через ее сервисы рядом с собственными разработками компании.

Читать далее

Три ИИ-агента делили одну серверную часть — и начали блокировать друг друга

by Маша Даровская

Anthropic провела эксперимент с тремя автономными ИИ-агентами, которым дала несовместимые задания по переделке одной серверной части приложения. Каждый должен был перенести исходный проект на свой язык программирования и первоначально не знал, что ту же систему одновременно изменяют еще два агента. …

Читать далее

Исследователи научились извлекать скрытые рассуждения Claude, GPT и Gemini через уязвимость API

by Маша Даровская

Исследователи нашли способ извлекать содержимое зашифрованных блоков, в которых API Anthropic, OpenAI и Google сохраняли внутреннее состояние рассуждающих моделей между запросами. Атака позволяла переносить такой блок между сеансами и пользователями, а затем передавать его более слабой модели того же поставщика …

Читать далее

Codex перешагнул 15 млн активных пользователей — команда OpenAI снова сбросила лимиты

by Маша Даровская

Команда Codex 13 августа устроила очередной сброс лимитов после нового пользовательского рекорда. Руководитель Codex в OpenAI Тибо Соттьо сообщил, что сервис перешагнул отметку 15 млн активных пользователей и пользователям начали возвращать свежий запас доступного использования. Развёртывание сброса должно было занять …

Читать далее

DeepSeek тихо переключила V4 Pro на сборку 0813: миллион токенов контекста и $0,87 за миллион выхода

by Маша Даровская

DeepSeek обновила старшую модель V4 Pro без отдельного большого анонса. В актуальной документации API алиас deepseek-v4-pro теперь указывает на DeepSeek-V4-Pro-0813. Модель получила контекстное окно в 1 млн токенов, максимальный ответ до 384 тыс. токенов и поддержку Responses API.

Читать далее

Alibaba открыла веса Qwen3.8 на 2,4 трлн параметров: модель занимает 4,89 ТБ и рассчитана на многодневные задачи

by Маша Даровская

Alibaba открыла веса Qwen3.8-2.4T-A95B — крупнейшей модели нового семейства Qwen3.8. Репозиторий уже доступен на Hugging Face: версия в формате BF16 занимает 4,89 ТБ, содержит 2,4 трлн параметров, а при обработке каждого токена использует около 95 млрд из них. Разработчики предусмотрели …

Читать далее