Ad

Последние новости: Anthropic

Claude использовали для атак и копирования моделей

от Маша Даровская

Anthropic опубликовала новый отчет о злоупотреблениях Claude, охватывающий операции, которые компания выявила и пресекла с декабря 2025 года по август 2026-го. В него вошли кибератаки, мошенничество, слежка, операции влияния, опасные биологические исследования, разработка вооружений и массовая дистилляция ИИ-моделей.

Читать далее

Anthropic выпустила Claude Fable 5.1 — на одном тесте результат вырос вдвое

от Маша Даровская

Anthropic представила Claude Fable 5.1 и Claude Mythos 5.1. Компания называет их своими самыми продвинутыми моделями для программирования и интеллектуальной работы. За двумя названиями скрывается одна базовая модель с разными защитными ограничениями: Fable 5.1 предназначена для широкого использования, Mythos 5.1 …

Читать далее

Базовый контроль ИИ оказался недостаточным даже у крупнейших лабораторий

от Маша Даровская

Ни одна из пяти крупнейших лабораторий передового искусственного интеллекта не показала полной реализации шести базовых механизмов контроля моделей, выбранных для проверки независимой некоммерческой организацией Guidelight AI Standards. Лучший результат — C+ — получили OpenAI и Anthropic, Google оценили на D+, …

Читать далее

Три ИИ-агента делили одну серверную часть — и начали блокировать друг друга

от Маша Даровская

Anthropic провела эксперимент с тремя автономными ИИ-агентами, которым дала несовместимые задания по переделке одной серверной части приложения. Каждый должен был перенести исходный проект на свой язык программирования и первоначально не знал, что ту же систему одновременно изменяют еще два агента. …

Читать далее

Исследователи научились извлекать скрытые рассуждения Claude, GPT и Gemini через уязвимость API

от Маша Даровская

Исследователи нашли способ извлекать содержимое зашифрованных блоков, в которых API Anthropic, OpenAI и Google сохраняли внутреннее состояние рассуждающих моделей между запросами. Атака позволяла переносить такой блок между сеансами и пользователями, а затем передавать его более слабой модели того же поставщика …

Читать далее

Заявка в GitHub становилась командой: у Claude Code, Gemini CLI и Codex нашли опасные цепочки атак

от Маша Даровская

Специалисты Novee Security раскрыли несколько цепочек атак на инструменты программирования Claude Code, Gemini CLI и Codex. Исследователи проверяли сценарии автоматизации, работавшие в официальных репозиториях Anthropic, Google и OpenAI.

Читать далее

В PyPI нашли вероятный троян Claude

от Маша Даровская

Исследователь Aikido Security Чарли Эриксен обнаружил в PyPI вредоносный пакет anthropickit, который может быть связан с недавним инцидентом во время испытаний Claude Mythos 5. Код собирал файлы из каталога .ssh, искал секреты в переменных окружения, сохранял результаты на диске и …

Читать далее

Полигон подключили к интернету — Claude взломала три организации

от Маша Даровская

Anthropic обнаружила три случая, когда модели Claude во время испытаний по кибербезопасности получили несанкционированный доступ к рабочим системам сторонних организаций. Модели считали, что выполняют задания внутри изолированного полигона, но тестовые машины по ошибке сохранили доступ в интернет.

Читать далее

Anthropic уничтожила миллионы книг ради ИИ

от Маша Даровская

Anthropic потратила миллионы долларов на бумажные книги, которые лишали переплётов, разрезали на страницы и пропускали через промышленные сканеры. Полученные файлы сохраняли во внутренней библиотеке компании, а уничтоженные оригиналы отправляли на переработку.

Читать далее

Открытые веса с проверкой: Anthropic ответила критикам

от Маша Даровская

Глава Anthropic Дарио Амодеи отверг обвинения в попытке запретить модели с открытыми весами ради защиты бизнеса Claude. Он признал пользу таких разработок, но предложил проверять наиболее мощные системы перед выпуском. Испытания должны затрагивать кибербезопасность, биологические угрозы и риск потери контроля …

Читать далее

Почти Fable за полцены: Anthropic выпустила Claude Opus 5

от Маша Даровская

Anthropic представила Claude Opus 5 — новую флагманскую модель семейства Opus, рассчитанную на программирование, длительную работу агентов и профессиональные задачи. Компания позиционирует новинку как более доступную альтернативу Claude Fable 5: базовые тарифы ниже ровно вдвое, а результаты в ряде тестов …

Читать далее

Пиратская библиотека обошлась Anthropic в $1,5 млрд

от Маша Даровская

Федеральный суд Северного округа Калифорнии окончательно утвердил мировое соглашение между Anthropic и владельцами авторских прав на сотни тысяч книг. Разработчик Claude сформирует невозвратный фонд объёмом $1,5 млрд плюс начисленные проценты. Деньги предназначены авторам и издательствам, чьи произведения компания скачала из …

Читать далее

США усиливают контроль доступа к передовым ИИ-моделям

от Маша Даровская

Администрация Дональда Трампа намерена участвовать в выборе компаний и организаций, которые получат ранний доступ к наиболее мощным американским моделям искусственного интеллекта. Речь идёт прежде всего о специализированных системах для поиска уязвимостей, анализа вредоносного кода и проверки защищённости критической инфраструктуры.

Читать далее

OpenAI и Anthropic снова временно ослабили лимиты для кодеров

от Маша Даровская

OpenAI и Anthropic почти одновременно расширили доступ к своим наиболее мощным моделям для программирования. Пользователям Codex сбросили накопленное потребление и временно отключили пятичасовое ограничение, а Anthropic продлила льготный доступ к Claude Fable 5 и увеличенные лимиты Claude Code до 19 …

Читать далее

Claude Code спрятал трекер в апострофе, чтоб выявлять китайских пользователей

от Маша Даровская

Разработчик обнаружил в Claude Code скрытый механизм, который определял использование стороннего API-шлюза, искал признаки китайских ИИ-компаний и кодировал результаты проверки в системном промпте. Для передачи меток клиент менял почти неразличимые варианты апострофа и разделители в строке с текущей датой.

Читать далее