sejournal.io

Microsoft заставила GPT и Claude работать в паре

50e453f0 9bdf 461e 9138 70e48d12bd68 scaled

Корпорация Microsoft представила две новые функции — Critique и Council — для своего исследовательского инструмента Copilot Researcher. Их цель — повысить точность ответов, заставляя языковые модели GPT от OpenAI и Claude от Anthropic работать совместно над одним запросом.

Функция Critique — это система глубокого анализа, которая использует несколько нейросетей одновременно. Одна модель отвечает за планирование задачи, поиск информации и создание чернового ответа, а другая выступает в роли рецензента, проверяя и дорабатывая результат. Модели могут меняться этими ролями. По заявлению Microsoft, этот подход призван бороться с типичными проблемами ИИ: галлюцинациями, ошибками в цитировании и неточностями. В тестах DRACO Critique показала результат 57,4 балла против 42,7 у Claude Opus 4.6.

Функция Council работает иначе: она запускает GPT и Claude параллельно, чтобы они независимо готовили ответы на один вопрос. Затем третья модель-«судья» анализирует оба отчёта, сравнивает их и создаёт итоговое резюме, отмечая точки согласия и расхождения.

Таким образом, в режиме Critique модели сотрудничают, а в Council — соревнуются. Critique является стандартным режимом в Researcher, а Council можно выбрать вручную. Обе функции уже доступны для пользователей программы Microsoft Frontier.

Напомним, что ранее в марте Microsoft также анонсировала ИИ-агента Cowork для выполнения сложных задач в приложениях Microsoft 365, таких как Outlook, Teams и Excel.

Руководитель OpenAI ушла в отставку из-за сделки с Пентагоном

fa76bf61 ad6e 4bc0 bc6f d910a0f0740e scaled

Руководитель отдела аппаратного обеспечения OpenAI ушла в отставку из-за сделки с Пентагоном

Кейтлин Калиновски покинула пост главы отдела аппаратного обеспечения OpenAI. Причиной её ухода стало несогласие с заключённым компанией контрактом с Министерством обороны США.

В своём заявлении Калиновски отметила, что, хотя ИИ важен для национальной безопасности, такие вопросы, как слежка за гражданами без суда и применение автономного летального оружия без контроля человека, требуют более глубокого обсуждения, чем то, что было проведено. Она подчеркнула, что решение было принципиальным и не связано с личными отношениями в компании.

Представитель OpenAI, в свою очередь, заявил, что соглашение с Пентагоном устанавливает чёткие рамки для ответственного использования ИИ в оборонных целях, прямо запрещая внутреннюю слежку и создание автономного оружия.

Это событие произошло на фоне обострения отношений властей США с другой ИИ-компанией, Anthropic. Ранее Пентагон разорвал контракт с Anthropic из-за её жёсткой этической политики, запрещающей использование технологий для массовой слежки и автономных убийств. В ответ власти признали Anthropic «риском для цепочки поставок» и предписали госструктурам отказаться от её продуктов. Глава Anthropic Дарио Амодеи заявил, что компания будет оспаривать это решение в суде, так как предпочтёт не сотрудничать с военными, если это угрожает демократическим ценностям.

Ситуация также повлияла на пользователей: количество удалений приложения ChatGPT резко возросло, в то время как конкурирующий Claude, принадлежащий Anthropic, возглавил рейтинги магазинов приложений.

ИИ нашел 22 уязвимости в Firefox

1772880332285 6427856 scaled

Искусственный интеллект от Anthropic обнаружил критические уязвимости в браузере Firefox.

Специалисты компании Anthropic с помощью своей ИИ-модели Claude Opus 4.6 провели двухнедельный аудит безопасности браузера Firefox. В результате было выявлено 22 уязвимости, 14 из которых разработчик браузера, компания Mozilla, классифицировала как критические.

Это количество составляет примерно пятую часть всех серьёзных ошибок, исправленных в Firefox за весь 2025 год. ИИ проанализировал почти 6000 файлов исходного кода на C++ и сформировал 112 отчётов. Большинство найденных проблем уже устранены в выпуске Firefox 148.

Изначально модель исследовала JavaScript-движок браузера, а затем расширила проверку на другие компоненты. Первую уязвимость типа «Use After Free», позволяющую злоумышленникам изменять данные, Claude обнаружила всего за 20 минут.

При этом разработчики Anthropic отметили, что модель гораздо эффективнее ищет уязвимости, чем создаёт на их основе реальные эксплойты. В ходе сотен тестов, потратив около $4000 на вычислительные ресурсы, ИИ смог разработать примитивный вредоносный код только в двух случаях. Эксперты считают, что пока это даёт преимущество защитникам, но сам факт возможности создания эксплойтов вызывает беспокойство.

После этого сотрудничества специалисты Mozilla также начали экспериментировать с использованием Claude для задач безопасности.

Китайские стартапы обвинили в краже технологий у Anthropic

1771922882946 2822209 scaled

Компания Anthropic обвинила китайские стартапы в массовой краже технологий ИИ

Американская компания Anthropic заявила, что три китайских ИИ-стартапа — DeepSeek, Moonshot и MiniMax — провели масштабную кампанию по незаконному использованию их модели Claude. Целью было улучшение собственных нейросетей методом дистилляции.

Что произошло:
* Китайские лаборатории создали около 24 000 поддельных аккаунтов и сгенерировали через них более 16 миллионов запросов к Claude, нарушив условия использования.
* По данным Anthropic, атаки были нацелены на ключевые возможности модели: агентное рассуждение, использование инструментов и программирование.
* Компания связала эти действия с конкретными фирмами на основе анализа IP-адресов, метаданных и информации от партнёров.

Почему это серьёзно:
Метод дистилляции (обучение слабой модели на ответах сильной) сам по себе легален и широко используется. Однако в Anthropic подчёркивают, что незаконное копирование моделей конкурентами создаёт серьёзные риски:
1. Угроза безопасности: «Украденные» модели не наследуют встроенные защитные механизмы, которые препятствуют созданию биологического оружия, кибератак или инструментов для массовой слежки.
2. Подрыв экспортного контроля: Такие атаки позволяют обходить американские экспортные ограничения на передовые чипы и ИИ-технологии, сокращая технологический разрыв.
3. Угроза для индустрии: Проблема выходит за рамки одной компании и требует скоординированных действий всего ИИ-сообщества и регуляторов.

Как Anthropic планирует бороться:
* Улучшение систем обнаружения подобных атак.
* Обмен данными с другими лабораториями и облачными провайдерами.
* Ужесточение проверки аккаунтов.
* Внедрение технических контрмер, снижающих эффективность дистилляции.

Контекст:
* Это не первое обвинение в адрес DeepSeek. В январе 2025 года её уже подозревали в краже данных у OpenAI.
* Генеральный директор Anthropic Дарио Амодеи готовится к встрече с руководством Пентагона. Компания выступает против использования её ИИ для массовой слежки или создания автономного оружия, что вызвало разногласия с военными.

Другие новости Anthropic:
Компания также запустила ИИ-сканер уязвимостей Claude Code Security. Этот инструмент анализирует код на наличие уязвимостей, которые могли оставаться незамеченными годами. Анонс вызвал падение акций крупнейших компаний кибербезопасности (Palo Alto Networks, CrowdStrike и других) на 12-19% из-за опасений инвесторов перед новым ИИ-конкурентом (явление «AI Ghost Trade»).

Anthropic выпустила мощное обновление Claude Opus 4.6

1770378973028 3392657 scaled

ИИ-стартап Anthropic выпустил крупное обновление своей флагманской модели Claude Opus до версии 4.6. Нейросеть стала лучше справляться с длительными и сложными задачами, включая работу с большими базами кода.

Ключевые улучшения:
* Увеличенный контекст: Теперь модель может обрабатывать до 1 миллиона токенов, что позволяет анализировать огромные документы и вести очень длинные диалоги.
* Лучшие результаты в тестах: Opus 4.6 показала наивысшие баллы в тесте на программирование Terminal-Bench 2.0 и превзошла конкурентов, включая GPT-5.2, в сложных тестах на логику и рассуждения (Humanity’s Last Exam, GDPval-AA).
* Команды агентов: Новый режим позволяет создавать группы ИИ-ассистентов, которые автономно работают над разными частями одной задачи и координируют свои действия.
* Повышенная безопасность: Модель демонстрирует низкую склонность к нежелательному поведению, такому как обман или содействие в неправомерных действиях.
* Новые функции для разработчиков: Появились «адаптивное мышление» (модель сама решает, когда углубиться в рассуждения), настройка уровня усилий и «уплотнение контекста» для управления длинными диалогами.

Разработчики из Anthropic отметили, что создают новые версии Claude с помощью самого Claude, используя модель для написания кода и тестируя её на внутренних задачах компании. Opus 4.6 уже доступна через веб-интерфейс, API и на основных облачных платформах.

Глава Anthropic: AGI через 2-3 года, рынок труда не готов

1769097957826 870687

Генеральный директор Anthropic предупреждает о скором появлении AGI и его последствиях

Глава компании Anthropic Дарио Амодеи на Всемирном экономическом форуме в Давосе заявил, что создание общего искусственного интеллекта (AGI) — вопрос ближайших лет, а не десятилетий. По его прогнозу, это может произойти уже к 2026 или 2027 году.

Амодеи подчеркнул, что стремительное развитие ИИ, подпитываемое самообучающимися моделями, опережает способность общества адаптироваться. В его компании ИИ уже выполняет работу программистов: разработчики не пишут код, а редактируют сгенерированный нейросетью. Он считает, что вскоре большие языковые модели (LLM) смогут выполнять такую работу полностью.

Глава Google DeepMind Демис Хассабис выразил более осторожную позицию. Он отметил, что, хотя в программировании и математике прогресс очевиден, в естественных науках, где требуется творчество и генерация новых гипотез, современные ИИ-системы пока не достигли человеческого уровня. По его оценке, AGI может появиться к 2030 году с вероятностью 50%.

Оба эксперта сходятся во мнении о серьёзных экономических последствиях. Они предупреждают, что под угрозой находятся многие рабочие места «белых воротничков». Амодеи прогнозирует, что до половины начальных профессиональных должностей могут исчезнуть в течение десяти лет.

Некоторые аналитики, как, например, CEO Human Voice Media Боб Хатчинс, считают, что главная проблема — не прямая замена людей, а «ухудшение» рабочих мест. Роль профессионалов может сместиться от творчества к простой проверке результатов работы ИИ, что раздробит сложную работу на низкооплачиваемые задачи.

Напомним, что ранее британские профсоюзы уже предупреждали о риске массовых сокращений из-за внедрения искусственного интеллекта.