Последние новости: Безопасность ИИ

Copilot отказался в чате, но зато записал опасное в код

от Маша Даровская

Исследователи описали новый тип обхода защитных фильтров в IDE-агентах: GitHub Copilot отказывается отвечать на вредные запросы в обычном чате, но может сгенерировать те же опасные ответы внутри файлов, тестовых данных и программного конвейера. Проблема не в одном «магическом» промпте, а …

Читать далее

«Киберарена» вошла в реестр Минцифры

от Маша Даровская

Российскую платформу для киберучений «GIS-Киберарена для вузов» включили в Единый реестр отечественного программного обеспечения. Запись №34256 внесена в реестр Минцифры России, продукт отнесен к классу «12.17 Программное обеспечение для решения отраслевых задач в области образования». CNews сообщил о регистрации 8 …

Читать далее

OpenAI выпустила GPT-5.6 и ChatGPT Work

от Маша Даровская

OpenAI открыла общий доступ к GPT-5.6 — новой линейке моделей Sol, Terra и Luna. Sol стала флагманской моделью, Terra заняла средний уровень для повседневной работы, Luna получила роль самой быстрой и дешевой модели в семействе. Одновременно компания представила ChatGPT Work …

Читать далее

Alibaba запретит сотрудникам Claude Code: внутри компании инструмент Anthropic признали высокорисковым

от Маша Даровская

Alibaba запретит сотрудникам использовать Claude Code от Anthropic с 10 июля 2026 года. Инструмент для программирования на базе ИИ внесли во внутреннюю категорию высокорискового ПО, а разработчикам предложили перейти на Qoder — собственную платформу Alibaba для агентной разработки.

Читать далее

OpenAI запускает GPT-5.6 Sol, Terra и Luna: релиз стартует завтра, но доступ получат не все

от Маша Даровская

OpenAI готовит запуск новой линейки моделей GPT-5.6 — Sol, Terra и Luna. Релиз стартует завтра, 9 июля 2026 года, но это не массовое включение для всех аккаунтов ChatGPT. Компания уже открыла ограниченный предварительный доступ для выбранных организаций и партнёров, а …

Читать далее

Чистый GitHub-репозиторий заставил ИИ-кодера запустить вредонос: новая атака бьёт по доверию к агентам

от Маша Даровская

Исследователи Mozilla 0DIN показали атаку на ИИ-агентов для разработки: внешне чистый GitHub-репозиторий может заставить coding agent выполнить вредоносную цепочку при настройке проекта. В самом репозитории нет очевидного вредоноса, поэтому его могут пропустить сканеры, человек и сам ИИ. Проблема не в …

Читать далее

Claude Fable разочаровал пользователей

от Маша Даровская

Anthropic вернула Claude Fable 5 в публичный доступ после почти трёхнедельной паузы, но встретили её холодно. Модель снова доступна в Claude.ai, Claude Platform, Claude Code и Claude Cowork, однако разработчики жалуются на слишком жёсткие защитные фильтры, частые перенаправления запросов в …

Читать далее

Амодеи снова спорит с open source AI: почему глава Anthropic считает открытые модели отвлекающим манёвром

от Маша Даровская

CEO Anthropic Дарио Амодеи снова жёстко высказался об открытых ИИ-моделях. Его позиция сводится к двум тезисам: современные модели нельзя честно называть open source в классическом смысле, а даже открытые веса не делают ИИ по-настоящему доступным без дорогой инфраструктуры. Для сторонников …

Читать далее

Вредоносы под видом ИИ-сервисов атакуют малый бизнес: число инцидентов выросло в пять раз

от Маша Даровская

Киберпреступники быстро приспособились к ИИ-гонке. В 2026 году резко выросло число атак, где вредоносное ПО маскируют под ChatGPT, Claude, Gemini и новые ИИ-агенты. Малый бизнес оказался удобной целью: сотрудники ищут бесплатные нейросети, расширения и «автоматизаторы», а вместе с ними скачивают …

Читать далее

У Anthropic снова утечки: Sonnet 5 ждут к релизу, а Fable 5 может вернуться уже не для всех

от Маша Даровская

Вокруг Anthropic за день появилось сразу два слуха. Первый — компания якобы готовит Claude Sonnet 5, упоминания новой модели нашли в утечках и конфигурациях партнёрских платформ. Второй — возвращение Claude Fable 5 может пройти не по старым правилам: модель, которую …

Читать далее

OpenAI показала GPT-5.6 Sol: новая модель идёт в кибербезопасность, кодинг и режим субагентов

от Маша Даровская

OpenAI запустила ограниченный предпросмотр GPT-5.6 — новой линейки моделей Sol, Terra и Luna. Флагман Sol получил режим Ultra, умеет подключать субагентов для сложных задач и показывает сильные результаты в кодинге, биологии и кибербезопасности. Доступ пока дали не всем: компания тестирует …

Читать далее

Anthropic обвинила Alibaba в массовой дистилляции Claude: речь идёт о 28,8 млн запросов и почти 25 тыс. фейковых аккаунтов

от Маша Даровская

Anthropic заявила о крупнейшей атаке на Claude: под подозрением операторы, связанные с Alibaba и Qwen, всего насчитали 28,8 млн запросов к Claude.

Читать далее