sejournal.io

Вот краткий заголовок для этой новости: Anthropic выпустила руководство Zero Trust для ИИ-агентов

1780840461299 707244 scaled

Вот перефразированная версия новости на русском языке:

Anthropic выпустила руководство по безопасному использованию ИИ-агентов в бизнесе

Команда Anthropic опубликовала в блоге Claude руководство под названием «Zero Trust for AI agents», посвящённое безопасному развёртыванию автономных ИИ-агентов в корпоративной среде. В документе описаны основные угрозы, связанные с агентными системами, и предложен подход к кибербезопасности для бизнеса.

ИИ ускорил атаки

По оценкам Anthropic, современные модели сократили время между обнаружением уязвимости и её использованием с нескольких месяцев до нескольких часов. Компания призывает учитывать не только ускоренные ИИ-атаки на инфраструктуру, но и риски, исходящие от самих агентов, которые могут самостоятельно ставить цели, выбирать инструменты и выполнять многошаговые действия без участия человека.

В основе руководства — принципы Zero Trust: не доверять по умолчанию, проверять каждое действие и исходить из того, что система может быть скомпрометирована. Anthropic ссылается на рекомендации NIST SP 800-207 (2020 год) и серию руководств по Zero Trust, выпускаемых АНБ с 2026 года. Подчёркивается, что это практический инструмент для команд безопасности, архитекторов и инженеров, а не универсальная схема для соблюдения нормативов.

Среди ключевых угроз в документе выделены: прямые и косвенные вмешательства через промпты, заражение инструментов, неправомерное использование идентификационных данных и привилегий, отравление памяти и контекста, а также атаки на цепочку поставок.

Прямое отравление промпта — это внедрение вредоносных инструкций через пользовательский ввод. Косвенное — через веб-страницы, письма, документы и другие внешние источники, которые агент обрабатывает в процессе работы.

Также рассматриваются подмена легитимного инструмента вредоносным и опасные цепочки вызовов, когда по отдельности безопасные средства в комбинации приводят к риску. Anthropic вводит понятия «радиус взрыва» (blast radius) и «наименьшая субъектность» (least agency). Речь идёт не только о минимальных правах доступа, но и о жёстком ограничении действий агента, частоты вызовов и областей, к которым он может обращаться.

Zero Trust для агентных систем

Для защиты компания предлагает трехуровневую модель зрелости и набор базовых технических мер. На начальном уровне рекомендуется выдавать каждому агенту уникальную криптографическую идентичность, использовать короткоживущие токены, применять принцип «запрет по умолчанию» и управление доступом на основе ролей. Для агентов, работающих с недоверенными данными (веб-контент, документы), метод «исполнения в песочнице» назван практически обязательным.

На более высоких уровнях предлагается использовать:
— стандарт mTLS с взаимной аутентификацией клиента и сервера через цифровые сертификаты;
— аппаратно привязанную идентичность через HSM или TPM, а также удалённую аттестацию.

Статические API-ключи и общие пароли сервисных аккаунтов признаны непригодными даже для базового уровня.

Большое внимание уделено наблюдаемости. Anthropic рекомендует подробно логировать все действия агента, включая вызовы инструментов, доступ к данным и внешние коммуникации, а затем передавать события в SIEM для корреляции в реальном времени. Среди ключевых метрик — dwell time и coverage. Для критических систем целевое время обнаружения отклонений — один час. Также предлагается создать «матрицу прослеживаемости», чтобы связать каждое действие агента с исходным запросом и восстановить полную цепочку решений.

Будущее SOC: агенты под контролем человека

В части реагирования Anthropic формулирует принцип: автоматизировать бюрократию вокруг инцидента, но не ключевые решения. Агентам и моделям предлагается поручать сбор и первичный отбор артефактов, ведение параллельных веток расследования и подготовку черновика постмортема. Решения о сдерживании, раскрытии инцидента и коммуникации с клиентами должны оставаться за людьми. Этот же подход применяется к «операциям защиты» — с упоминанием перехода от классического SOAR к агентному.

В документе приведены количественные ориентиры. Anthropic ссылается на исследование Microsoft Spotlighting, в котором успешность косвенных атак через отравление промпта в экспериментах снизилась с более чем 50% до менее 2%. Также компания приводит собственные результаты по использованию «конституционных классификаторов», которые, по её данным, блокируют более 95% попыток джейлбрейка при минимальном росте ложных отказов.

В блоке о цепочке поставок Anthropic рекомендует использовать AI-BOM, OpenSSF Scorecard, аудит зависимостей и анализ возможностей доступа. В качестве аргумента компания приводит собственное исследование, согласно которому 250 вредоносных документов достаточно, чтобы встроить бэкдор в модели размером от 600 млн до 13 млрд параметров.

В итоге Anthropic делает вывод, что для ИИ-агентов недостаточно точечных фильтров и периметровой защиты. Компания предлагает строить защиту вокруг идентичности, минимальных полномочий, заранее ограниченного ущерба и постоянной проверки действий. По оценке Anthropic, в лучшей позиции окажутся не организации с самым продвинутым ИИ, а те, у кого сильнее базовая архитектура безопасности.

Напомним, в июне команда Anthropic предупредила о рисках достижения рекурсивного самосовершенствования ИИ.

Главы ИИ-корпораций потребовали обязательной проверки заказов на синтетическую ДНК

1780564932438 505628 scaled

Вот перефразированный текст новости на русском языке:

Руководители компаний OpenAI, Anthropic, Google DeepMind и Microsoft AI подписали открытое письмо, в котором требуют на законодательном уровне ввести обязательную проверку клиентов и заказов для поставщиков синтетических ДНК и РНК. Об этом сообщает WIRED.

Как отмечает издание, обращение поддержали Сэм Альтман (OpenAI), Дарио Амодеи (Anthropic), Демис Хассабис (Google DeepMind) и Мустафа Сулейман (Microsoft AI). К ним присоединились ученые, специалисты по нацбезопасности и представители компаний, работающих в сфере генного синтеза.

Авторы инициативы предлагают обязать поставщиков проверять заказы на синтетические нуклеиновые кислоты и вести их учет. Особое внимание уделяется необходимости подтверждать личность клиентов и контролировать оборудование.

В тексте письма говорится, что быстрый прогресс ИИ снижает «порог знаний». Это дает потенциальную возможность злоумышленникам использовать нейросети для создания опасных патогенов и токсинов, обходя прежние ограничения. Проверка заказов называется одним из самых эффективных и «наименее обременительных» методов снижения биологических рисков.

WIRED уточняет, что некоторые компании (например, Twist Bioscience) уже добровольно проводят такие проверки в рамках отраслевого консорциума, однако в США до сих пор нет единых федеральных правил.

Ранее в Сенат был внесен двухпартийный законопроект, который обяжет всех поставщиков услуг генного синтеза в стране проверять своих клиентов на связи с террористическими группировками или попытки воссоздать опасные вирусы.

Напомним, в июне 2025 года крупная медицинская благотворительная организация Wellcome Trust выделила 10 миллионов фунтов стерлингов на запуск первого в мире проекта по созданию фрагментов или даже целой ДНК с нуля.

Anthropic выпустила Claude Opus 4.8 с динамическими рабочими процессами

1780044510033 780227 scaled

Вот перефразированная новость на русском языке:

Компания Anthropic выпустила модель Claude Opus 4.8, а также анонсировала функцию динамических рабочих процессов для инструмента Claude Code. Новая версия модели отличается более точными суждениями, большей честностью в оценке собственного прогресса и способностью работать автономно дольше, чем предыдущие версии. Стоимость осталась прежней.

Динамические рабочие процессы позволяют ИИ самостоятельно писать скрипты для координации десятков или сотен параллельных субагентов, а также проверять их работу перед тем, как передать результат пользователю. Эта функция предназначена для сложных задач в крупных кодовых базах, таких как аудит безопасности, поиск ошибок, миграция между фреймворками и языками программирования, а также модернизация проектов.

Функция доступна в режиме предварительного тестирования в интерфейсе командной строки Claude Code, настольной версии, расширении для VS Code, через API, а также в Amazon Bedrock, Vertex AI и Microsoft Foundry. Запустить её можно прямой командой на создание рабочего процесса или через режим ultracode, который повышает уровень вычислительных усилий до максимума и позволяет модели самостоятельно решать, когда использовать многошаговую схему.

В Anthropic предупредили, что динамические рабочие процессы потребляют значительно больше токенов, чем стандартная сессия Claude Code. Модель разбивает задачу на подзадачи, распределяет их между параллельными агентами, затем объединяет результаты после взаимной проверки и попыток опровергнуть найденные решения.

В качестве примера компания привела перенос Bun с языка Zig на Rust. Разработчик Джаред Самнер использовал динамические рабочие процессы для генерации около 750 000 строк Rust-кода. Порт прошёл 99,8% существующего набора тестов, а путь от первого коммита до слияния занял 11 дней. При этом в Anthropic уточнили, что версия пока не используется в продакшене.

Показатели новой модели Opus 4.8:
— 69,2% в SWE-Bench Pro;
— 49,8% в Humanity’s Last Exam без инструментов и 57,9% с ними;
— 83,4% в OSWorld-Verified;
— 1890 баллов в GDPval-AA;
— 53,9% в Finance Agent v2.

В Terminal-Bench 2.1 Opus 4.8 уступила GPT-5.5 — 74,6% против 78,2%.

В Anthropic заявили, что Opus 4.8 стала заметно «честнее» при выполнении агентных задач: модель чаще указывает на неопределённость, реже заявляет о неподтверждённом прогрессе и лучше замечает проблемы в собственном коде до передачи результата пользователю.

Напомним, в мае Anthropic опубликовала первый отчёт по Project Glasswing — программе поиска уязвимостей с помощью модели Claude Mythos.

Anthropic: ИИ нашел 23 000 уязвимостей в open source

1779699406363 973035 scaled

Компания Anthropic представила первый отчет в рамках Project Glasswing — программы по поиску уязвимостей, основанной на модели Claude Mythos.

За месяц около 50 партнеров обнаружили более 10 000 уязвимостей высокой и критической степени опасности. В компании отметили, что основная сложность заключалась не в скорости поиска, а в проверке и выпуске исправлений.

Нейросеть проанализировала более 1000 проектов с открытым исходным кодом и нашла 23 019 уязвимостей разного уровня. Из них 6202 изначально были отнесены к категориям «высокий» или «критический». После дополнительной проверки 90,6% находок подтвердились, причем 62,4% из них потребовали срочного вмешательства.

Компания уже уведомила разработчиков о 530 серьезных ошибках, еще 827 готовятся к публикации. Исправлено 75 уязвимостей, по 65 выпущены рекомендации. В среднем устранение одной серьезной проблемы занимает около двух недель.

Среди публичных примеров — уязвимость в библиотеке wolfSSL (CVE-2026-5194). По данным компании, модель смогла разработать атаку для подделки сертификатов.

Mozilla сообщила об исправлении 271 ошибки в Firefox 150 после тестирования Mythos. Cloudflare выявила около 2000 уязвимостей, включая 400 с пометкой «высокий» и «критический».

Anthropic заявила, что не планирует публичный релиз модели до создания более надежных защитных механизмов, и намерена расширить Project Glasswing, включая сотрудничество с правительствами США и их союзников.

Напомним, в апреле компания отказалась выпускать Mythos в открытый доступ из-за высоких рисков безопасности.

Нейросеть также используется Агентством национальной безопасности США.

Anthropic и OpenAI запретили вторичную торговлю своими акциями

1778673474728 698442 scaled

Anthropic и OpenAI обновили свою политику в отношении акций, запретив их вторичную торговлю.

На странице поддержки Anthropic говорится, что любая продажа или передача ценных бумаг без одобрения совета директоров считается недействительной: покупатель не будет признан акционером и не получит никаких прав.

В заявлении OpenAI содержится практически идентичная формулировка: без письменного согласия передача акций недействительна и не имеет экономической ценности.

Обе компании указали одинаковый перечень запрещённых схем: прямые продажи, специальные структуры целевого назначения (SPV), токенизированные доли и форвардные контракты.

SPV — это компании, создаваемые для владения акциями частной фирмы и привлечения капитала на их покупку. Такие структуры стали стандартным способом обойти ограничения для покупки бумаг ещё не публичных компаний.

Уязвимость этой схемы заключается в возможности создавать «многоуровневые SPV»: дополнительные компании для покупки акций аналогичной структуры. Это затрудняет проверку законности сделок с базовыми акциями.

Согласно новым правилам обеих компаний, если первоначальное перечисление средств в SPV не было одобрено советом директоров, вся цепочка сделок признаётся недействительной.

Anthropic опубликовала список конкретных заблокированных структур: Open Door Partners, Unicorns Exchange, Pachamama, Lionheart Ventures, Sydecar, Upmarket, Forge Global и Hiive. Последние две — наиболее известные платформы для вторичной торговли акциями частных компаний.

Forge Global — регулируемая площадка для аккредитованных инвесторов, на которой предполагаемая оценка Anthropic ранее достигала $1 трлн, опередив $880 млрд у OpenAI. В компании сообщили, что попали в список по ошибке.

«Мы работаем с Anthropic над удалением названия Forge из этого предупреждения. Наша компания не содействует сделкам с акциями каких-либо частных компаний без явного одобрения со стороны фирмы», — говорится в комментарии.

Реакция рынка

Рынок отреагировал быстро. После заявлений Anthropic и OpenAI их токены на платформе PreStocks, работающей на базе Solana, упали с $1400 до $873 и с $2000 до $1080 соответственно.

За последний год некоторые криптокомпании запустили инвестиционные продукты с доступом к акциям частных фирм. Чаще всего они представляют собой бессрочные фьючерсы — производные инструменты, которые отслеживают стоимость частных компаний на вторичных рынках, но не дают права собственности на реальные акции.

Зачем ввели запрет

В октябре 2025 года OpenAI провела санкционированное советом директоров тендерное предложение: нынешним и бывшим сотрудникам разрешили продать акции на сумму до $30 млн. Более 600 человек получили в совокупности $6,6 млрд в рамках одной сделки.

Около 75 человек решили обналичить всю сумму в $30 млн. Компания утроила прежний лимит в $10 млн на одного сотрудника, так как старое ограничение вызывало недовольство ведущих исследователей и разработчиков.

OpenAI организовала кампанию и одобрила каждую сделку — именно это право частные фирмы стараются защищать. Они стремятся контролировать вторичную продажу. Репрессии касаются всех, кто пытается обойти это правило.

Инвесторы, напротив, ищут доступ к быстрорастущей выручке ИИ-стартапов — именно те лазейки, которые OpenAI и Anthropic теперь закрыли.

Напомним, в июле 2025 года OpenAI опровергла информацию о запуске токенизированных акций фирмы, которые предложил Robinhood.

Anthropic обновила Claude: агенты научились «видеть сны» и работать в команде

1778162826437 1022155 scaled

Компания Anthropic представила обновление своей платформы для управления ИИ-агентами. В сервисе Claude появились три новые функции: «сновидения», оценка результатов и координация работы нескольких ботов.

Функция «сновидения» позволяет агентам анализировать предыдущие сеансы и выявлять закономерности. Система находит повторяющиеся ошибки и успешные сценарии, после чего обновляет алгоритмы без участия человека. Пользователь может настроить автоматическое обновление памяти ИИ или вносить изменения вручную.

Также разработчики добавили инструменты Outcomes и Webhooks. Теперь создатели приложений могут устанавливать критерии качества работы агента. Специальный «оценщик» проверяет результат на соответствие правилам отдельно от основного процесса выполнения задачи. Если результат не соответствует стандарту, агент начинает исправлять ошибки.

По данным Anthropic, Outcomes повысил эффективность выполнения сложных задач на 10%. Качество генерации документов в форматах .docx и .pptx выросло в среднем на 9%.

Третье обновление — это координация нескольких агентов. «Главный» ИИ может распределять подзадачи между узкопрофильными специалистами: один анализирует историю развертывания кода, другой — логи ошибок, третий — тикеты службы поддержки. Все они работают параллельно над общим набором файлов.

Новые функции уже тестируют партнёры компании. Платформа Harvey использует «сновидения» для подготовки юридических документов — скорость выполнения задач выросла в шесть раз. Команда Netflix задействовала мультиагентную систему для анализа логов сборки приложений.

Функция «сновидения» доступна в режиме предварительного просмотра по запросу. Outcomes и мультиагентная координация перешли в стадию публичного бета-тестирования.

Напомним, 4 мая сооснователь Anthropic Джек Кларк спрогнозировал появление «саморазвивающегося ИИ» к 2028 году.

ИИ научится создавать своих преемников к 2028 году

1777986058638 827986 scaled

Вот перефразированная новость на русском языке:

По прогнозу сооснователя компании Anthropic Джека Кларка, к 2028 году на рынке могут появиться ИИ-системы, способные самостоятельно создавать и обучать свои следующие поколения без участия человека. Кларк назвал этот сценарий «рубиконом в почти непредсказуемое будущее» и оценил его вероятность в 60% в ближайшие два года, отметив, что общество может быть не готово к таким переменам.

Он описал процесс полной автоматизации ИИ-исследований, при котором модель сама ставит задачи, проектирует эксперименты, пишет и тестирует код, оптимизирует обучение и улучшает архитектуру будущих версий ИИ.

Прогноз основан на резком росте показателей в ключевых тестах. Например, в бенчмарке SWE-Bench (решение инженерных задач) лучшие модели улучшили результат с 2% в конце 2023 года до 94% к весне 2026-го. В тесте CORE-Bench (воспроизведение научных статей) современные агенты показывают около 95,5%, а в MLE-Bench (задачи уровня Kaggle) — 64-65%. По словам Кларка, ИИ переходит от написания отдельных фрагментов кода к полноценному выполнению исследовательских и инженерных задач.

Также отмечается рост автономности ИИ: если в 2022 году системы справлялись с задачами на десятки секунд, то сейчас передовые модели могут вести инженерную работу до 12 часов подряд. Это связано с распространением агентных инструментов для программирования.

Кларк считает, что для автоматизации значительной части ИИ-разработок не требуется принципиально новых научных идей — большая часть работы похожа на рутинную инженерную деятельность. При этом у моделей уже появляются признаки научной интуиции: например, с помощью Gemini математики получили 13 решений задач Эрдеша, одно из которых сочли «слегка нетривиальным» вкладом в открытую проблему.

Если прогноз сбудется, индустрия перейдет к фазе, где каждое новое поколение ИИ будет ускоряет появление следующего. Кларк предупредил, что к концу 2028 года мир может столкнуться не только с технологическим скачком, но и с вопросами безопасности, распределения капитала и контроля над системами, развивающимися быстрее своих создателей. Если же этого не произойдет, потребуются новые человеческие изобретения.

Claude подключили к Blender, Adobe и Autodesk

1777466938357 563751 scaled

Вот перефразированная новость на русском языке:

Стартап Anthropic представил набор коннекторов, которые позволяют нейросети Claude напрямую взаимодействовать с популярными программами для дизайна и 3D-моделирования, такими как Blender, Adobe, Autodesk, Ableton, SketchUp и другими.

В компании отметили, что Claude не заменит чувство вкуса или фантазию, но поможет находить новые подходы к работе: быстрее генерировать идеи, осваивать широкий спектр навыков и браться за масштабные творческие проекты.

Вот список доступных инструментов:

* Ableton — использует ответы Claude на основе официальной документации продуктов Live и Push.
* Adobe — позволяет создавать изображения, видео и дизайн с помощью более чем 50 инструментов Creative Cloud, включая Photoshop и Express.
* Affinity от Canva — автоматизирует рутинные задачи в профессиональных творческих процессах.
* Autodesk Fusion — дает дизайнерам и инженерам с подпиской Fusion возможность создавать и редактировать 3D-модели через диалог с Claude.
* Blender — предоставляет интерфейс для Python API.
* Resolume Arena и Resolume Wire — позволяют художникам по визуальным эффектам управлять Arena, Avenue и Wire.
* SketchUp — превращает беседу с Claude в отправную точку для 3D-моделирования.
* Splice — дает музыкальным продюсерам возможность искать сэмплы в каталоге прямо из приложения Claude.

Разработчики Blender создали официальный MCP-коннектор для Claude. С его помощью 3D-художники могут анализировать и настраивать целые сцены, а также создавать скрипты для массового применения изменений к объектам. Anthropic также присоединилась к Blender Development Fund в качестве мецената для поддержки разработки Python API.

Примеры использования:

Компания привела несколько сценариев применения Claude в творчестве:

* Обучение работе с инструментами — нейросеть выступает персональным репетитором по сложному ПО, объясняя модификаторы, методы синтеза или незнакомые функции.
* Расширение возможностей через код — ИИ пишет скрипты, плагины и генеративные системы для программ.
* Интеграция инструментов в единый конвейер — Claude конвертирует форматы, реструктурирует данные и синхронизирует ресурсы в проекте.
* Автоматизация рутины — пакетная обработка ресурсов, настройка структуры проекта и применение процедурных изменений.

Anthropic также сотрудничает со студентами и преподавателями, предоставляя им доступ к Claude и новым коннекторам для внедрения в учебные программы.

Напомним, что в апреле Anthropic уже запускала экспериментальный продукт Claude Design — инструмент для генерации дизайна на базе искусственного интеллекта.

Anthropic закрывает доступ к сторонним интерфейсам по подписке

1775667381570 2658057 scaled

Компания Anthropic объявила, что с 3 апреля 2026 года подписка на Claude больше не будет покрывать использование искусственного интеллекта через сторонние интерфейсы, такие как OpenClaw. Для доступа к этим инструментам пользователям придется приобретать дополнительные пакеты услуг или использовать API-ключ.

Руководитель Claude Code Борис Черни объяснил это решение тем, что подписки изначально не были рассчитаны на сторонние инструменты, а вычислительные ресурсы компания предпочитает направлять на приоритетных клиентов, использующих собственные продукты Anthropic.

Создатель OpenClaw Питер Штайнбергер раскритиковал это изменение, заявив, что ему и сооснователю проекта Дэйву Морину удалось лишь ненадолго отсрочить его введение. Он выразил мнение, что компания сначала копирует популярные функции в свою закрытую систему, а затем блокирует доступ к открытым решениям.

В ответ Черни подчеркнул, что Anthropic поддерживает open-source, но вынуждена вводить ограничения из-за технических особенностей своих оптимизированных систем. Он также отметил, что недовольные клиенты могут отменить подписку и получить полный возврат средств.

Ранее, в апреле, Anthropic уже оказывалась в центре скандала, случайно удалив тысячи репозиториев на GitHub в попытке убрать из сети утекший исходный код Claude Code.

Anthropic по ошибке удалила тысячи репозиториев на GitHub

1775115349253 3319845 scaled

ИИ-стартап Anthropic случайно удалил тысячи репозиториев на GitHub, пытаясь убрать из сети утекший исходный код своего инструмента Claude Code. Об этом сообщает TechCrunch.

Утечку части кода компания подтвердила 31 марта. По словам представителя Anthropic, конфиденциальные данные клиентов не были раскрыты, а инцидент произошёл из-за человеческой ошибки при упаковке релиза, а не из-за взлома.

Этот случай может ослабить позиции компании, так как конкуренты и сторонние разработчики получили доступ к архитектуре популярного продукта.

Стартап отправил GitHub требование удалить репозитории на основании закона об авторском праве, что затронуло около 8100 архивов, включая форки официального хранилища. Это вызвало недовольство пользователей.

Руководитель направления Claude Code Борис Черны признал ошибку. В результате компания отозвала большинство требований на удаление, и GitHub восстановил доступ к затронутым проектам.

На фоне утечки энтузиасты запустили открытый проект OpenClaude, основанный на коде Anthropic. В него добавили поддержку API Anthropic и моделей, совместимых с OpenAI, а также сохранили оригинальные инструменты: веб-поиск, работу с файлами, анализ скриншотов и другие.

Напомним, в марте Anthropic превратила Claude в ИИ-агента, способного использовать компьютер для выполнения задач.