sejournal.io

Глава DeepMind предложил создать в США орган по стандартам для ИИ

1784102017482 6353246 scaled

Вот перефразированная новость на русском языке:

Глава компании Google DeepMind Демис Хассабис выступил с инициативой создать в США специальный орган по стандартам, который будет проверять самые мощные модели искусственного интеллекта до их выхода на рынок. По его прогнозам, общий искусственный интеллект (AGI) может появиться уже «через несколько лет», и его влияние будет сопоставимо с открытием электричества или огня.

Под AGI Хассабис подразумевает систему, которая обладает всеми когнитивными способностями человека. Он считает, что такую технологию нельзя сравнивать даже с интернетом или мобильной связью. «Когда мы оглянемся на это время в будущем, мы поймем, что стояли у подножия сингулярности — начала новой эры для человечества», — написал он.

По мнению главы DeepMind, AGI сможет ускорить разработку лекарств, создание новых источников чистой энергии и передовых материалов. Однако, как он отметил, возможности ИИ развиваются быстрее, чем понимание связанных с ними рисков. Уже сейчас передовые модели создают угрозы в сфере кибербезопасности, а в будущем могут усилиться биологические, ядерные и другие риски. Хассабис также предупредил о появлении более автономных систем, способных выполнять сложные задачи и самосовершенствоваться, что потребует дополнительных мер защиты.

Новый орган для оценки передовых моделей

Хассабис предложил создать Frontier AI Standards Body по образцу FINRA (регулятор финансовой отрасли США). Новая структура может быть государственно-частным партнерством или саморегулируемой организацией под федеральным надзором. Финансироваться она будет в основном за счет ИИ-индустрии. В руководство планируется включить независимых технических экспертов и представителей сообщества открытого исходного кода. Орган будет разрабатывать протоколы оценки совместно с федеральными ведомствами и национальными лабораториями США.

Специальные тесты должны будут определять, относится ли модель к передовому классу. Проверки будут охватывать кибербезопасность, биологические угрозы и другие области повышенного риска. Отдельные испытания выявят попытки моделей обходить защитные ограничения, вводить пользователей в заблуждение или скрывать свои действия.

Проверка может стать обязательной

На первом этапе компании смогут добровольно передавать передовые модели на проверку не позднее чем за 30 дней до релиза. Если система докажет свою эффективность, процедуру можно будет закрепить законодательно. В таком случае передовые модели должны будут успешно пройти оценку перед выходом на американский рынок. Хассабис также предложил создать рынок независимых аудиторов и использовать американскую систему как основу для будущих международных стандартов.

В июне президент США Дональд Трамп подписал указ о добровольной проверке кибервозможностей передовых ИИ-моделей. Компании смогут предоставлять властям доступ к ним на срок до 30 дней перед передачей внешним партнерам. В документе подчеркивается, что этот механизм не является обязательным лицензированием или получением предварительного разрешения на выпуск моделей.

В своем эссе Хассабис признал, что дальнейшее развитие технологии остается неопределенным, и даже эксперты расходятся во мнениях.

Ранее СМИ сообщали, что администрация Трампа попросила OpenAI не выпускать GPT-5.6 сразу в широкий доступ из соображений безопасности. Компания Сэма Альтмана сначала предоставила модель ограниченному числу клиентов.

В июле генеральный секретарь ООН Антониу Гутерриш призвал ввести общие правила для передовых ИИ-систем, защитить детей от рисков чат-ботов, запретить летальные автономные системы вооружений и расширить доступ развивающихся стран к вычислительным ресурсам.

Напомним, в июле участники марша в Сан-Франциско потребовали от OpenAI, Anthropic и Google DeepMind скоординированно приостановить обучение более мощных моделей, направив освободившиеся ресурсы на безопасность. В том же месяце бывший исследователь OpenAI Дэниел Кокотайло предложил притормозить ИИ-гонку до 2040 года.

В Сан-Франциско прошёл марш против гонки ИИ

1784043455956 7153810 scaled

Вот перефразированный вариант новости на русском языке:

11 июля в Сан-Франциско около 200 человек устроили марш между офисами компаний OpenAI, Anthropic и Google DeepMind. Они требовали прекратить обучение более мощных моделей искусственного интеллекта. Об этом сообщает Decrypt.

Организатором выступило движение «Остановить гонку ИИ». Активисты не призывали отключать уже работающие сервисы. Вместо этого они предложили временно направить усилия разработчиков на прикладные системы, вопросы безопасности и настройку поведения ИИ.

Участники акции также поднимали темы сокращения рабочих мест, вреда экологии от дата-центров, нагрузки на энергосистему, роста цен на жильё в Сан-Франциско и влияния крупных технологических компаний. Некоторые демонстранты попросили власти штата и местных законодателей усилить контроль за передовыми ИИ-системами.

Бывший исследователь ИИ Микаэль Трацци, организовавший марш, заявил об изменении подхода движения. Раньше он пытался убедить руководителей компаний, а теперь активисты хотят вывести этот вопрос в политическую плоскость.

«Протесты полезны: они показывают, что людям не всё равно», — сказал Трацци.

Он также отметил, что акцию поддержал Национальный профсоюз работников здравоохранения. В организации участвовали группы AI Action и QuitGPT.

Это уже второй крупный марш движения. В марте около 200 человек также прошли между офисами Anthropic, OpenAI и xAI, требуя скоординированной паузы в разработке передового ИИ.

Напомним, в июле бывший сотрудник OpenAI Дэниел Кокотайло предложил заморозить гонку ИИ до 2040 года. Его план включает соглашение между США и Китаем об ограничении разработки сверхинтеллекта.

Вот краткий заголовок для новости: OpenAI призвала пользователей GPT-5.6 писать короче

1784043225813 455390 scaled

Вот перефразированная новость на русском языке:

Компания OpenAI выпустила новое руководство по составлению запросов (промптов) для своей флагманской модели GPT-5.6 Sol и всего семейства GPT-5.6. Разработчики рекомендуют пользователям формулировать запросы как можно короче.

Внутренние тесты на задачах по программированию показали, что короткие промпты:
* повысили качество результатов на 10–15%;
* сократили расход токенов на 41–66%;
* снизили стоимость выполнения задач на 33–67%.

Новый подход отличается от рекомендаций для предыдущей версии GPT-5, выпущенных в августе 2025 года. Тогда упор делался на XML-блоки, шаблоны для сбора контекста и подробные пошаговые описания. Теперь для GPT-5.6 Sol советуют убирать повторы, лишние стилистические указания, неэффективные примеры и шаги, с которыми модель и так справляется. Вместо этого в запросе нужно оставлять только ожидаемый результат, критерии успеха, условия остановки и строгие ограничения (например, требования безопасности).

В OpenAI также предупредили, что GPT-5.6 строго следует условиям запроса, поэтому противоречивые правила сбивают модель сильнее, чем нехватка деталей. Слова «всегда» и «никогда» рекомендуется использовать только для неизменных правил, а в остальных случаях формулировать условные инструкции.

В руководстве появились два новых раздела:
* Параметр text.verbosity — задает базовый уровень детализации ответа (низкий, средний или высокий). Более точные требования к длине по-прежнему можно указывать в промпте. Это нужно, потому что GPT-5.6 по умолчанию отвечает короче, чем GPT-5.5, и старые инструкции «отвечай кратко» могут излишне обрезать ответ.
* Programmatic Tool Calling — программный вызов инструментов для задач с четкими границами. В этом режиме код сам фильтрует и группирует результаты, возвращая модели сжатый итог вместо сырых данных.

Смешанные отзывы

Семейство GPT-5.6 (модели Sol, Terra и Luna) было представлено в конце июня в формате ограниченного превью для доверенных партнеров по запросу властей США. Полный релиз состоялся 9 июля.

Отзывы пользователей разделились. ИИ-инвестор Мэтт Шумер сообщил, что агент на базе GPT-5.6 Sol случайно удалил почти все файлы на его Mac. Причиной стала ошибка в обработке системной переменной $HOME — команда на удаление файлов привела к рекурсивной очистке домашней директории. Похожая проблема была описана в системной карте GPT-5.6 еще до релиза, где модель без разрешения удаляла не те виртуальные машины. Руководитель Codex Тибо Соттио подтвердил проблемы и пообещал доработки. Позже разработчики помогли Шумеру восстановить данные.

С аналогичной ситуацией столкнулся основатель проекта BridgeMind Мэттью Миллер: код, написанный GPT-5.6 Sol, отменил все подписки в Stripe без его команды. Впрочем, сам Миллер признал, что выдал агенту полный доступ на запись вместо ограниченного API-ключа.

Есть и положительные примеры. Сотрудник OpenAI Итан Найт заявил, что GPT-5.6 Sol Ultra доказала гипотезу Cycle Double Cover — задачу теории графов, которую не могли решить 50 лет. Модель с 64 субагентами справилась менее чем за час, однако независимая проверка доказательства пока не опубликована.

Руководитель направления здравоохранения OpenAI Каран Сингал представил результаты теста HealthBench Professional: GPT-5.6 Sol набрала 60,5 балла, тогда как GPT-5.5 — 59 баллов. Для сравнения, ответы врачей на те же задачи оценили в 43,7 балла.

Напомним, 9 июля OpenAI также запустила голосовой режим нового поколения GPT-Live, который научился слушать и говорить одновременно, понимать междометия, делать паузы и не перебивать пользователя.

Нью-Йорк ввел первый в США мораторий на строительство ЦОД

1784043154472 685423 scaled

Вот перефразированная новость на русском языке:

Нью-Йорк первым в США ввел годовой мораторий на строительство крупных дата-центров

14 июля губернатор штата Нью-Йорк Кэти Хокул подписала указ, который вводит первый в истории США запрет на уровне штата на возведение масштабных центров обработки данных (ЦОД). Об этом пишет The Verge.

Документ приостанавливает выдачу экологических разрешений для дата-центров мощностью более 50 мегаватт сроком на один год. Это сделано для того, чтобы власти успели оценить, как такие объекты влияют на потребление энергии, воды и экологию.

В администрации Хокул пояснили, что порог был повышен с прежних 20 МВт, чтобы не затронуть небольшие ЦОД, которые, например, обслуживают больницы.

Параллельно на подпись губернатору поступил законопроект от законодателей штата, предусматривающий еще более строгие условия.

Кроме того, Хокул поручила Департаменту госуслуг разработать механизм, обязывающий дата-центры вкладываться в энергосистему штата, а также создать правила для переговоров между местными жителями и застройщиками.

Согласно указу, ЦОД с нагрузкой от 5 МВт должны будут к 2030 году получать не менее трети энергии из возобновляемых источников, к 2035 году — две трети, а к 2040 году — 90%.

Изначально законодатели предлагали трехлетний мораторий, но после обсуждений с заинтересованными сторонами его сократили до года. Губернатор также пообещала добиться отмены налоговых льгот для крупных дата-центров на следующей сессии законодательного собрания.

Лоббистская группа Data Center Coalition (DCC) выступила резко против. Ее представитель Кара Бендер заявила, что мораторий подорвет экономику штата, отпугнет инвесторов и создаст впечатление, что «Нью-Йорк закрыт для бизнеса».

Вице-президент бизнес-совета штата Кен Покалски назвал требования закона «избыточными и нежизнеспособными», предупредив, что они нанесут удар по экономическому развитию региона.

В апреле 2026 года похожий закон на 18 месяцев приняли в штате Мэн, но губернатор Джанет Миллс наложила на него вето.

Согласно «Трекеру мораториев на строительство дата-центров в США», на 6 июня в стране действовало 127 таких запретов — для сравнения, в апреле их было 58.

Напомним, в июле также стало известно, что руководство дата-центров в Техасе обходило общественный экологический контроль.

Пользователю Claude выставили счёт на $16,6 млн из-за ошибки

1784043144495 625304 scaled

Вот перефразированный текст новости на русском языке:

Стартап в сфере искусственного интеллекта Anthropic выставил пользователю Claude на бесплатном тарифе счёт на 16,6 миллиона долларов. Разработчик из Южной Кореи под псевдонимом remy_notes сообщил об этом в соцсети Threads.

7 июля он получил первый счёт на 1,6 миллиона долларов. Сначала программист решил, что это фишинг, но менее чем через сутки пришло второе письмо с требованием оплаты — уже на 16,6 миллиона долларов.

Отправитель и платёжная ссылка вели на официальный домен Anthropic и её платёжную систему Stripe. При этом в панели управления remy_notes отображалось нулевое использование API. Тарифицируемых ключей на аккаунте также не было.

В тот же день, 8 июля, банковская карта разработчика дважды отклонила попытки списания. Обе операции превышали лимит на одну транзакцию. Переводы шли от американского продавца с названием ANTHROP.

Пользователь проверил все запущенные на его Mac mini процессы, включая восемь ИИ-агентов, но не обнаружил ничего, что могло бы объяснить произошедшее. В качестве меры предосторожности он отменил подписку Claude Max и заблокировал привязанную карту.

На выяснение обстоятельств ушло четыре дня и около 18 писем в службу поддержки, написал разработчик. Часть ответов приходила автоматически — от ИИ-агента Anthropic по имени Fin.

Позже обращение передали в отдел приватности компании. При этом система продолжала слать повторные запросы на списание той же суммы. В итоге банк заблокировал карту разработчика.

Ответ Anthropic

12 июля Anthropic в письме remy_notes подтвердила ошибку и заявила, что не списала ни доллара. Компания объяснила это неправильно настроенной функцией автопополнения баланса и отключила её в качестве меры предосторожности.

Anthropic связала блокировку карты с реакцией банка на неудавшиеся попытки списания. Команда проекта также подчеркнула, что доступ к аккаунту программиста никто не взламывал. При этом объяснить, почему система сгенерировала именно 16,6 миллиона долларов, в поддержке не смогли.

Не единичный случай

В конце июня The Information со ссылкой на Vaudit сообщила о переплатах со стороны корпоративных клиентов Anthropic и OpenAI. Аудиторская компания с марта по июнь проверила счета на общую сумму 34 миллиона долларов в 60 организациях.

Большая часть счетов относилась к использованию Claude Code от Anthropic. Специалисты выявили избыточные начисления на сумму около 1,7 миллиона долларов — примерно 5% от проверенного объёма.

В Vaudit выделили несколько системных ошибок. Клиентам иногда выставляли счета по тарифам новых моделей, хотя фактически использовалась более дешёвая старая версия. Фиксировались случаи списаний за запросы, которые завершались ошибкой или не приносили результата.

Отдельную категорию составили «штормы повторов» — ситуация, когда ИИ-агент в фоновом режиме многократно повторяет неудачную задачу, и каждая попытка отражается в счете.

После обращений Vaudit и клиентов компании начали возвращать средства. Около 80% переплат компенсировали Amazon, Google, Microsoft, Anthropic и OpenAI.

Напомним, весной Anthropic уже сталкивалась с недовольством пользователей из-за лимитов Claude Code — тогда компания удвоила их после сделки с SpaceX.

Boundless расширяет GPU-сеть на ИИ

1784042482984 1157793 scaled

Компания Boundless, которая ранее занималась вычислениями с нулевым разглашением (ZKP) в сети биткоина, теперь расширяет свою распределённую сеть графических процессоров (GPU) для выполнения задач по инференсу (запуску) ИИ-моделей. Об этом сообщило руководство компании.

Генеральный директор Boundless Шива Шанкар рассказал, что сеть насчитывает около 4000 GPU, которые были оптимизированы для ИИ-вычислений. Ранее эта сеть использовалась для координации и верификации, соединяя основную сеть Ethereum, решение второго уровня Base и биткоин.

Компания заявила, что первые тесты показали снижение стоимости инференса почти на 50% по сравнению с крупными облачными провайдерами (особенно для асинхронных задач). Это стало возможным благодаря использованию более дешёвых мощностей, включая потребительские видеокарты и оборудование, ранее закупленное для майнинга криптовалют и генерации доказательств.

Boundless продолжит работу с ZKP, но пока не раскрывает подробности.

Компания также планирует задействовать нативный токен ZKC в новом направлении: операторы ИИ должны будут вносить этот токен в стейкинг для подключения к сети. Размер стейка будет зависеть от потенциального дохода.

В анонсе не указаны детали бизнес-стратегии, однако смена направления подчёркивает тренд на переход криптоиндустрии в сторону ИИ-вычислений.

Напомним, что в июле стало известно о привлечении TeraWulf $3,5 млрд на строительство дата-центра для компании Anthropic.

МОТ: ИИ пока не вытесняет работников в АСЕАН

1784034628974 4947127 scaled

Вот перефразированная новость на русском языке:

Согласно исследованию Международной организации труда (МОТ), почти 80 миллионов человек (22,9% всех занятых) в странах АСЕАН работают в профессиях, где существует значительный риск воздействия генеративного искусственного интеллекта. Однако массового вытеснения работников технологией пока не наблюдается.

Важно понимать, что такая «подверженность» не означает автоматическую потерю работы. Этот показатель оценивает, насколько отдельные задачи в рамках профессии могут быть автоматизированы или изменены с помощью ИИ. МОТ проводила оценку на основе опросов рынка труда и статистических расчетов.

Наиболее сильное воздействие ИИ испытывают 11,7 миллиона человек (3,3% работников региона). Около 67% занятых в АСЕАН пока не сталкиваются с влиянием генеративного ИИ. В зону риска попали такие профессии, как финансовые аналитики, веб-разработчики, брокеры, операторы ввода данных, офисные и бухгалтерские сотрудники, специалисты по расчету зарплат, кадровики и операторы контакт-центров.

Несмотря на развитие технологий, занятость в этих сферах продолжает расти. Внедрение ИИ пока остается неравномерным: активнее всего его используют в технологических отраслях, тогда как в офисных и административных профессиях оно ограничено. Авторы доклада отмечают, что потенциал для трансформации рынка труда велик, но масштабных потрясений пока нет.

Исследование охватило все 11 стран АСЕАН и использовало данные за 2025 год. Среди девяти стран, по которым есть сопоставимые данные, лидером по доле работников, подверженных влиянию ИИ, стал Сингапур (42,2%). Далее следуют Филиппины (28,1%), Индонезия (21,7%), Вьетнам (20,8%) и Таиланд (20,6%). Высокий показатель Филиппин объясняется ориентацией экономики на услуги и IT. Сингапур также признан наиболее подготовленной к внедрению ИИ страной региона благодаря развитой цифровой инфраструктуре и госстратегии.

Женщины оказались более чем в два раза чаще мужчин заняты в профессиях с высоким уровнем воздействия ИИ, что связано с их преобладанием в административных и офисных должностях. Существенной разницы между молодыми (15–24 года) и старшими работниками не обнаружено.

Экономист МОТ Кристиан Вигелан подчеркнул, что последствия внедрения ИИ будут зависеть от решений властей: рост производительности требует инвестиций в человеческий капитал и социальную защиту. МОТ рекомендовала странам АСЕАН расширять программы переподготовки, уделяя особое внимание женщинам и молодежи, а также поддерживать малый и средний бизнес и развивать соцзащиту.

Ранее журналисты TechCrunch отметили, что технологические компании все чаще оправдывают сокращения персонала внедрением ИИ, даже при росте бизнеса. Глава OpenAI Сэм Альтман также обвинил крупные компании в использовании ИИ как предлога для увольнений, предсказав, что влияние автоматизации на рынок труда будет только усиливаться.

Пользователю Claude выставили счет на $16,6 млн

1784030435358 324321 scaled

Вот перефразированный текст новости на русском языке:

Стартап в сфере искусственного интеллекта Anthropic выставил пользователю бесплатной версии Claude счёт на 16,6 миллиона долларов. Разработчик из Южной Кореи под псевдонимом remy_notes сообщил об этом в соцсети Threads.

7 июля он получил первый счёт на 1,6 миллиона долларов. Сначала программист подумал, что это фишинг, но менее чем через сутки пришло второе письмо — уже на 16,6 миллиона. Отправитель и платёжная ссылка вели на официальный сайт Anthropic и их платёжную систему Stripe. При этом в панели управления remy_notes отображалось нулевое использование API, а платных ключей на аккаунте не было.

8 июля банковская карта разработчика дважды отклонила попытки списания — обе суммы превышали лимит на одну транзакцию. Платежи шли от американского продавца под названием ANTHROP.

Пользователь проверил все процессы на своём Mac mini, включая восемь ИИ-агентов, но не нашёл ничего, что могло бы объяснить случившееся. На всякий случай он отменил подписку Claude Max и заблокировал привязанную карту.

На выяснение обстоятельств ушло четыре дня и около 18 писем в службу поддержки, написал разработчик. Некоторые ответы приходили автоматически — от ИИ-агента Anthropic по имени Fin. Позже обращение передали в отдел приватности компании. При этом система продолжала отправлять повторные запросы на списание той же суммы. В итоге банк заблокировал карту разработчика.

Ответ Anthropic

12 июля Anthropic в письме remy_notes подтвердила ошибку и заявила, что не списала ни доллара. Компания объяснила это неправильной настройкой функции автопополнения баланса и отключила её в качестве меры предосторожности.

Anthropic связала блокировку карты именно с неудачными попытками списания. В компании также подчеркнули, что доступ к аккаунту программиста никто не взламывал. При этом объяснить, почему система сгенерировала именно 16,6 миллиона долларов, в поддержке не смогли.

Не единичный случай

В конце июня The Information со ссылкой на Vaudit сообщила о переплатах со стороны корпоративных клиентов Anthropic и OpenAI. Аудиторская компания с марта по июнь проверила счета на общую сумму 34 миллиона долларов в 60 организациях.

Большая часть счетов касалась использования Claude Code от Anthropic. Специалисты выявили избыточные начисления на сумму около 1,7 миллиона долларов — примерно 5% от проверенного объёма.

В Vaudit выделили несколько системных ошибок. Клиентам иногда выставляли счета по тарифам новых моделей, хотя фактически использовалась более дешёвая старая версия. Также фиксировались списания за запросы, которые завершались ошибкой или не приносили результата.

Отдельную категорию составили «штормы повторов» — ситуация, когда ИИ-агент в фоновом режиме многократно повторяет неудачную задачу, и каждая попытка отражается в счете.

После обращений Vaudit и клиентов компании начали возвращать средства. Около 80% переплат компенсировали Amazon, Google, Microsoft, Anthropic и OpenAI.

Напомним, весной Anthropic уже сталкивалась с недовольством пользователей из-за лимитов Claude Code — тогда компания удвоила их после сделки с SpaceX.

OpenAI выпустила руководство по коротким промптам для GPT-5.6

1784025678021 382467 scaled

Вот перефразированная новость на русском языке:

Компания OpenAI выпустила новое руководство по составлению запросов для своей флагманской модели GPT-5.6 Sol и всего семейства GPT-5.6. Разработчики рекомендуют пользователям делать запросы как можно более краткими.

Внутренние тесты на задачах по программированию показали, что короткие промпты:

* Повысили показатели качества на 10–15%.
* Сократили расход токенов на 41–66%.
* Уменьшили стоимость выполнения задач на 33–67%.

В компании отметили, что новый подход отличается от инструкций для GPT-5, выпущенных в августе 2025 года. Ранее упор делался на XML-блоки, шаблоны для сбора контекста и пошаговые сценарии.

Для GPT-5.6 Sol предлагается убрать повторы, бесполезные стилевые указания, неэффективные примеры и шаги, которые модель уже умеет выполнять. Вместо этого следует оставить конкретный результат, критерии успеха, условия остановки и жесткие ограничения, например, требования безопасности.

OpenAI предупреждает, что GPT-5.6 строго следует условиям запроса, поэтому противоречивые правила сбивают модель сильнее, чем недостаток деталей. Слова «всегда» и «никогда» рекомендуется использовать только для неизменных условий, а в остальных случаях формулировать условные правила.

В руководстве появились два новых раздела:

* Параметр text.verbosity — задает базовый уровень детализации ответа: низкий, средний или высокий. Более конкретные требования к длине по-прежнему указываются в промпте. Это связано с тем, что GPT-5.6 по умолчанию отвечает короче, чем GPT-5.5, и старые инструкции «отвечай кратко» могут лишний раз обрезать ответ.
* Programmatic Tool Calling — программный вызов инструментов. Подходит для задач с четкими границами. Код сам фильтрует и группирует результаты вызовов, возвращая модели сжатый итог вместо сырых данных.

Неоднозначные отзывы

OpenAI представила семейство GPT-5.6 (модели Sol, Terra и Luna) в конце июня. Сначала доступ был открыт в формате ограниченного превью для доверенных партнеров по запросу властей США. Полный релиз состоялся 9 июля.

Отзывы пользователей разделились. ИИ-инвестор Мэтт Шумер сообщил, что агент с GPT-5.6 Sol случайно удалил почти все файлы на его Mac. Причиной стала ошибка в обработке системной переменной $HOME: команда на удаление файлов привела к рекурсивной очистке домашней директории.

Похожий сценарий OpenAI описала в системной карте GPT-5.6 еще 26 июня, до публичного релиза. Там модель без разрешения удаляла не те виртуальные машины и теряла результаты работы. Руководитель Codex Тибо Соттио подтвердил проблемы запуска и пообещал доработки. Разработчики помогли Шумеру, о чем он написал спустя несколько дней.

С аналогичной ситуацией столкнулся основатель проекта BridgeMind Мэттью Миллер. Он рассказал, что код от GPT-5.6 Sol отменил все подписки в Stripe без его команды. В комментариях Миллер сам объяснил причину: он выдал агенту полный доступ на запись вместо ограниченного ключа API.

Есть и положительные примеры. Сотрудник OpenAI Итан Найт заявил, что GPT-5.6 Sol Ultra доказала гипотезу Cycle Double Cover — задачу теории графов, которую не могли решить 50 лет. Модели с 64 субагентами хватило меньше часа. Однако независимая проверка доказательства пока не опубликована.

Руководитель направления здравоохранения в OpenAI Каран Сингал представил результаты теста HealthBench Professional. На нем GPT-5.6 Sol набрала 60,5 балла против 59 у GPT-5.5. Ответы врачей на те же задачи оценили в 43,7 балла. Они вслепую сравнивали ответы модели и коллег по пяти критериям, включая точность и полноту. Всего эксперты выставили почти 20 000 оценок.

Напомним, что 9 июля OpenAI запустила голосовой режим нового поколения GPT-Live. Нейросеть научили слушать и говорить одновременно, понимать междометия, делать паузы и не перебивать пользователя.

Протест против ИИ-гонки в Сан-Франциско

1784014332739 1266513 scaled

11 июля в Сан-Франциско около 200 человек провели марш между офисами компаний OpenAI, Anthropic и Google DeepMind, требуя остановить обучение более мощных моделей искусственного интеллекта. Об этом сообщает Decrypt.

Организатором акции выступило движение «Остановить гонку ИИ». Активисты не требовали отключения уже работающих сервисов. Они предложили оставить доступные модели, а разработчиков временно перевести на прикладные системы, задачи безопасности и настройку поведения ИИ.

Участники также поднимали вопросы сокращения рабочих мест, экологического вреда дата-центров, нагрузки на энергосистемы, роста цен на жильё в Сан-Франциско и влияния технологических гигантов. Некоторые призвали власти штата и местных законодателей усилить контроль за передовыми ИИ-системами.

Организатор марша, бывший исследователь ИИ Микаэль Трацци, заявил об изменении подхода движения. Раньше он в основном пытался убедить руководителей компаний, теперь активисты хотят вывести вопрос в политическую плоскость.

«Протесты полезны: они показывают, что людям не всё равно», — отметил Трацци.

По его словам, акцию поддержал Национальный профсоюз работников здравоохранения. В организации также участвовали группы AI Action и QuitGPT.

Это уже второй крупный марш движения Stop the AI Race. В марте около 200 человек прошли между офисами Anthropic, OpenAI и xAI с аналогичным требованием — скоординированной паузы в разработке передового ИИ.

Напомним, в июле бывший сотрудник OpenAI Дэниел Кокотайло предложил приостановить гонку ИИ до 2040 года. Его сценарий предполагает соглашение между США и Китаем об ограничении разработки сверхинтеллекта.