sejournal.io

Цукерберг выступил против блокировки китайских ИИ-моделей

1785319316055 5664366 scaled

Вот перефразированный текст новости на русском языке:

Глава Meta Марк Цукерберг выступил против запрета китайских ИИ-моделей в США, заявив, что такой шаг не даст американским компаниям преимущества в технологической гонке. Об этом сообщает Financial Times.

По его мнению, блокировка передовых разработок из КНР «не станет эффективным решением». Вместо этого американским компаниям следует системно выявлять собственные слабые места и барьеры, чтобы успешнее конкурировать с китайскими специалистами.

Спор обострился из-за Kimi K3

Заявление прозвучало на фоне обсуждения в Вашингтоне возможных ограничений для китайских моделей с открытыми весами. Как отмечает Reuters, новый виток дискуссий начался после выхода модели Kimi K3 от пекинской компании Moonshot AI.

Разработчики представили её как первую в мире открытую модель класса 3T с 2,8 триллиона параметров, встроенным зрением и контекстом на 1 миллион токенов. По их оценкам, в общем рейтинге она уступила только проприетарным моделям Claude Fable 5 и GPT 5.6 Sol.

Часть американских чиновников и компаний подозревают, что китайские лаборатории могли использовать дистилляцию — метод, при котором одна модель обучается на ответах другой. В июле директор Управления Белого дома по научно-технической политике Майкл Крациос обвинил в этом Moonshot AI. Тогда же глава Минфина США Скотт Бессент заявил, что власти проверят китайские открытые модели на предмет кражи интеллектуальной собственности. Позднее он уточнил, что при «скрытых промышленных атаках дистилляции» возможны санкции и включение компаний в списки экспортных ограничений.

Индустрия защищает открытые веса

Позиция Цукерберга совпала с более широкой кампанией в защиту моделей с открытыми весами. Linux Foundation сообщила, что присоединилась к письму вместе с Cisco, Dell Technologies, IBM, Meta, Microsoft, Nvidia и другими компаниями.

«По мере того как ИИ интегрируется в глобальную экономику, как мы можем обеспечить его безопасность, прозрачность и надежность? В Linux Foundation мы считаем, что ответ — в открытости. Модели с открытыми весами дают исследователям и предприятиям необходимую видимость для проверки, аудита и устранения уязвимостей до того, как они будут использованы злоумышленниками», — говорится в посте организации.

Глава Nvidia Дженсен Хуанг также выступил против запретов. В интервью Axios он заявил, что качественные китайские открытые модели следует использовать, а кампания по их блокировке может навредить самим США.

При этом Белый дом параллельно разрабатывает механизм предварительной проверки самых мощных ИИ-систем. В июньском указе власти поручили создать добровольную рамку, в рамках которой разработчики смогут предоставлять правительству доступ к передовым моделям за 30 дней до релиза.

Напомним, в июле участники марша в Сан-Франциско потребовали от OpenAI, Anthropic и Google DeepMind скоординированно приостановить обучение более мощных моделей. Освободившиеся ресурсы они предложили направить на безопасность. В том же месяце бывший исследователь OpenAI Дэниел Кокотайло предложил притормозить ИИ-гонку до 2040 года.

Китайский DUV-прорыв: угроза ASML или информационный шум?

1785246894495 757278 scaled

Вот перефразированная новость на русском языке:

Аналитики поставили под сомнение значимость сообщений о начале выпуска в Китае иммерсионных DUV-литографов и не увидели в первых машинах прямой угрозы доминированию нидерландской компании ASML. Об этом пишет SCMP.

Информационная бомба

Материал, опубликованный в понедельник изданием The Information со ссылкой на анонимные источники, спровоцировал распродажу акций ASML на торгах в США: бумаги внутри дня проседали более чем на 8% и закрылись падением на 5,8%.

The Information утверждает, что Китай начал производство отечественных иммерсионных DUV-литографов через государственную компанию в Шанхае. По информации издания, в 2026 году страна может выпустить около 5 DUV-установок, а в 2027 — еще около 20. Первыми получателями систем, как утверждается, станут SMIC, Hua Hong Semiconductor и ChangXin Memory Technologies.

Reuters, также ссылаясь на осведомленный источник, подтвердило, что КНР начала массовое производство DUV-литографов. Возглавляет проект госкомпания Shanghai Aishengna Electronic Technology Group, которая привлекла к работе команды ведущих китайских стартапов в сфере технологии.

Сейчас китайские производители чипов используют оборудование от ASML, а процесс DUV является для них самым передовым из доступных: машины для более современной EUV-литографии запрещены для экспорта в страну. В результате компании из КНР имеют возможность создавать полупроводниковые элементы по 28-нм техпроцессу за один цикл экспозиции и достигать 7 нм за счет многократного нанесения рисунка.

Насколько реален прорыв

SCMP со ссылкой на аналитиков отмечает: даже сам факт поставки первых машин не означает готовности к непрерывной коммерческой эксплуатации. Пока речь не идет о прямой угрозе доминированию нидерландской компании.

Партнер и руководитель направления технологической политики DGA-Albright Stonebridge Group Пол Триоло призвал не переоценивать эти сообщения. Главный барьер, по его словам, — добиться стабильной работы иммерсионных DUV-систем 24/7 в течение года.

Аналитик Jefferies Уильям Бивингтон отметил, что предыдущие сообщения о прогрессе Китая в литографии оказались фейками. Поэтому еще предстоит выяснить, насколько обоснованы нынешние заявления. По оценке эксперта, возможности Китая в производстве подобного оборудования могли развиваться быстрее, если бы ставка делалась на частный бизнес, а не на госкомпании вроде SMIC и CXMT. На данный момент они полностью полагаются на импортные установки, поэтому крайне заинтересованы в сотрудничестве с нидерландским поставщиком и присутствии его инженеров для обслуживания машин.

«Китай, несомненно, продолжит закупать оборудование ASML до тех пор, пока это будет возможно, благодаря его значительно превосходящему качеству», — заявил Бивингтон.

По мнению экспертов, более серьезным риском для доминирования ASML являются потенциальные экспортные ограничения США. Законопроект Match Act, одобренный Комитетом по иностранным делам Палаты представителей США в апреле, но еще не вынесенный на голосование в полном составе, запрещает продажу иммерсионных систем DUV странам, «вызывающим опасения». Документ предполагает более жесткие ограничения на обслуживание и техподдержку для «ключевых предприятий по производству полупроводников».

«Если бы закон Match Act, например, заставил ASML отозвать своих инженеров, это дало бы огромный импульс развитию китайской иммерсионной технологии DUV», — считает Триоло.

По его оценке, усилия Пекина в любом случае не приведут к созданию единой компании, напоминающей «китайскую ASML».

Напомним, в июне на фоне экспортных ограничений США Huawei анонсировала намерение выпускать новое поколение ИИ-чипов Ascend каждый год и вдвое наращивать их производительность. Стартап DeepSeek раскрыл планы по созданию собственного процессора для своих моделей.

Китайский ИИ обвинили в краже технологий США

1784797100924 7257461 scaled

Вот перефразированный текст новости на русском языке:

Китайский ИИ-стартап Moonshot AI, по заявлению главы Управления Белого дома по научно-технической политике Майкла Крациоса, использовал модель Fable от компании Anthropic при создании своей системы Kimi K3. Крациос утверждает, что компания разработала сложную внутреннюю платформу для масштабной дистилляции (метода обучения, при котором менее мощная модель учится на ответах более крупной) американских моделей, что позволяло быстро переключаться между разными способами доступа, чтобы оставаться незамеченными. Также, по его словам, Moonshot AI приобрела серверы с чипами GB300 и получила доступ к аналогичным мощностям в Таиланде, вероятно, для обучения своих алгоритмов.

Крациос не назвал источник информации и не предоставил технических доказательств. При этом он провел грань между обычной дистилляцией, которая важна для инноваций, и предполагаемым промышленным извлечением технологий США, назвав скрытую масштабную дистилляцию недопустимой.

21 июля министр финансов США Скотт Бессент допустил введение санкций против иностранных разработчиков, уличенных в краже американской интеллектуальной собственности. После заявления Крациоса он уточнил, что рассматриваются санкции и включение компаний в список экспортных ограничений.

Представитель посольства КНР в Вашингтоне Лю Чан назвал обвинения «чистой клеветой», подчеркнув, что Китай выступает за защиту интеллектуальной собственности, и призвал США прекратить дискредитировать достижения китайской ИИ-индустрии.

Anthropic выпустила Claude Fable 5 9 июня. 12 июня правительство США ввело экспортные ограничения, после чего компания приостановила доступ к модели для всех пользователей, так как не могла оперативно проверять их гражданство. Ограничения отменили 30 июня, а с 1 июля Anthropic восстановила глобальный доступ к Fable 5.

Moonshot AI представила Kimi K3 16 июля. Таким образом, между повторным запуском Fable 5 и релизом китайской модели прошло 15 дней. При этом продукт от Anthropic также был доступен три дня после первоначального релиза в июне.

Исследователь стартапа Prime Intellect Эли Бакуш отметил, что столь коротким временным окном сложно объяснить производительность Kimi K3, даже если Moonshot AI действительно применяла дистилляцию. Глава направления Strategic Futures в OpenAI Дин Болл также заявил, что качество Kimi K3 нельзя объяснить одной лишь дистилляцией.

В соцсетях распространился скриншот диалога, в котором китайская модель якобы представилась как Claude. Однако подлинность и условия получения ответа независимо не подтверждены, а также неизвестны системные инструкции и настройки модели.

Сооснователь и CEO платформы Hugging Face Клеман Делангю связал успех Kimi K3 с открытой моделью разработки, считая, что обмен результатами ускоряет прогресс.

В феврале Anthropic уже обвиняла DeepSeek, Moonshot AI и MiniMax в извлечении возможностей Claude через фиктивные аккаунты. Тогда разработчики утверждали, что связали кампании с конкретными лабораториями по IP-адресам, метаданным запросов и другим данным. Так, DeepSeek сгенерировала более 150 000 взаимодействий, Moonshot AI — свыше 3,4 млн, а MiniMax — около 13 млн.

В июне СМИ сообщили о возобновлении в администрации Дональда Трампа обсуждения ограничений против китайских ИИ-моделей с открытыми весами. В том же месяце Anthropic выдвинула отдельные претензии к операторам, связанным с Alibaba и лабораторией Qwen.

Также в июле глава политики национальной безопасности Anthropic Тарун Чхабра обвинил одну из ведущих китайских ИИ-компаний Zhipu в обучении модели GLM-5.2 на ответах Claude и GPT.

В Белом доме возобновили обсуждение ограничений для китайских ИИ-моделей

1784631396438 7121208 scaled

В администрации президента США Дональда Трампа вновь активизировались обсуждения возможных мер, которые могут затруднить использование китайских ИИ-моделей с открытым весом. Об этом пишет Axios со ссылкой на осведомленные источники.

Официальных решений пока не принято. Белый дом и Министерство торговли США не ответили на запросы журналистов. По данным издания, новый толчок дискуссиям дал выпуск модели Kimi K3 от китайской компании Moonshot AI.

В 2025 году Министерство торговли рассматривало возможность включения ряда китайских ИИ-компаний в список экспортных ограничений. Для взаимодействия с такими организациями американским структурам обычно требуется разрешение ведомства.

Агентство национальной безопасности и Офис национального директора по кибербезопасности Белого дома также изучали возможность публикации предупреждения о потенциальных угрозах со стороны китайских разработчиков ИИ.

Белый дом прорабатывал указ, который мог бы возложить на американские компании ответственность за нарушения безопасности при использовании таких моделей. Однако от этих инициатив отказались из-за опасений замедлить развитие отрасли.

Сейчас среди возможных инструментов обсуждаются ограничения в сфере госзакупок, включение разработчиков в санкционные списки и публичные предупреждения о рисках.

Дин Болл, ранее занимавший пост старшего советника по политике в области ИИ и новых технологий в Управлении научно-технической политики Белого дома, участвовал в подготовке плана действий администрации Трампа по искусственному интеллекту. После ухода из Белого дома он работал в Фонде американских инноваций (FAI), а 6 июля присоединился к OpenAI, возглавив направление Strategic Futures, которое занимается долгосрочной политикой в отношении передовых ИИ-систем. Болл сохранил статус внештатного старшего научного сотрудника FAI.

После выхода Kimi K3 он назвал ее качественной моделью и отметил, что ее результаты нельзя объяснить лишь обучением на ответах других систем. Болл предположил, что администрация Трампа в какой-то момент осознает, что лучшей стратегией было бы создание значительного регуляторного риска для использования китайских моделей с открытым исходным кодом. Среди возможных инструментов он упомянул предупреждения ведомств о скрытых уязвимостях, позже уточнив, что прогнозировал такой сценарий, а не рекомендовал его.

Советник Белого дома по ИИ Дэвид Сакс назвал использование регуляторной неопределенности в качестве конкурентного инструмента неприемлемым. По его мнению, ведущие разработчики закрытых систем — OpenAI и Anthropic — уже образуют дуополию по выручке от ИИ-моделей и могут быть заинтересованы в том, чтобы государство ограничило конкуренцию со стороны открытых решений.

Moonshot AI выпустила Kimi K3 16 июля. Сейчас модель доступна через приложения и программный интерфейс разработчика. Компания пообещала опубликовать полный набор параметров к 27 июля под модифицированной лицензией MIT. До выхода файлов модель нельзя самостоятельно развернуть на собственной инфраструктуре.

Американские ведомства не представили доказательств наличия скрытых функций или уязвимостей непосредственно в Kimi K3. Moonshot AI также не включена в перечень экспортных ограничений из-за этой модели.

Одновременно Китай рассматривает собственные запреты на передачу передовых ИИ-технологий за рубеж. По данным Reuters, Министерство коммерции КНР обсуждало с Alibaba, ByteDance и Zhipu возможный контроль за экспортом обучающих данных и скачиванием весов моделей иностранными пользователями.

С 10 июля Alibaba запретила сотрудникам использовать продукты Anthropic в рабочих средах и предложила перейти на собственную платформу Qoder. Причиной стали проблемы, связанные с безопасностью.

Напомним, в феврале Anthropic обвинила три китайских ИИ-стартапа — DeepSeek, Moonshot и MiniMax — в масштабной кампании по использованию Claude для улучшения собственных моделей. В июне Anthropic повторила свои претензии к Alibaba и ее ИИ-подразделению Qwen в письме председателю банковского комитета Сената США Тиму Скотту и старшему демократу Элизабет Уоррен. По мнению разработчиков, это крупнейшая известная атака такого рода, связанная с попыткой ускорить развитие китайских моделей.

Пептиды за биткоины: рынок США взлетел на 700%

1784564060533 555034 scaled

Вот переписанная новость на русском языке:

Американцы всё чаще расплачиваются криптовалютой за пептиды. В первом квартале 2026 года продавцы таких препаратов получили $32 млн — за год сумма выросла на 700%, сообщает Bloomberg со ссылкой на данные Chainalysis.

Пептиды рекламируют как средства для похудения, наращивания мышц и омоложения. Одобренные лекарства проходят клинические испытания и продаются в аптеках вроде Walgreens и CVS. Однако значительная часть онлайн-продаж идёт в обход этой системы.

Дешёвые препараты привозят из зарубежных лабораторий без рецепта и страховки. На некоторых упаковках указано, что они не предназначены для людей.

Почему выбирают криптовалюту

Банки и платёжные системы отказываются работать с такими продавцами из-за рисков нарушения правил. Поэтому часть поставщиков принимает оплату только в биткоинах. В Chainalysis отметили, что для некоторых покупателей это первый опыт использования криптовалют.

Bloomberg приводит пример Зака, 49-летнего директора по маркетингу с северо-запада США. В поисках ретатрутида (препарат Eli Lilly) он нашёл китайского поставщика, который согласился отправить 20 флаконов за $240. На американском рынке такая покупка обошлась бы ему примерно в $300 в месяц. Продавец принимал только цифровые активы, поэтому Заку пришлось впервые в жизни купить биткоин.

Как рос рынок

В Chainalysis выделили три этапа роста. До 2025 года это был нишевый «подпольный» рынок с оборотом около $200 000 в месяц. Затем тема попала в поле зрения движения Make America Healthy Again. Рост совпал с назначением Роберта Кеннеди-младшего главой Минздрава США. Однако прямую причинно-следственную связь по данным блокчейна установить нельзя, подчеркнули в компании.

Резкий скачок произошёл в конце 2025 года — после того как тема стала популярной в TikTok-субкультуре looksmaxxing. Её последователи стремятся улучшить внешность и физическую форму. Среднемесячный приток вырос примерно в четыре раза — до $9,9 млн. В пиковые месяцы он превышал $10 млн.

В то же время бывшая сотрудница Coinbase Global Сара Грэм оценивала годовой оборот рынка пептидов примерно в $100 млн в 2023 году. По данным TRM Labs, в 2025 году поступления цифровых активов в этот сектор достигли $41,4 млн — рост на 20% за год. Глобальный директор по политике аналитической платформы Эри Редбонд сравнил динамику с ранними этапами теневых онлайн-рынков вроде Silk Road.

Крупные продавцы переходят на стейблкоины

Рынок устроен неравномерно, отметили специалисты. Основной объём приходится на узкую группу крупных продавцов с широкой клиентской базой. Чем крупнее поставщик, тем профессиональнее его расчёты.

Мелкие игроки перебирают разные монеты, крупные — используют почти только биткоин и стейблкоины. У продавцов со средним депозитом от $1000 преобладают «стабильные монеты». Так они страхуются от скачков курса при крупных и трансграничных закупках.

Сырьё и поставщики из Китая

Основное сырьё для пептидов производят в Китае. В TRM Labs отметили, что китайские производители химической продукции активно наращивают присутствие в этой нише. По данным Forbes, за три квартала прошлого года импорт из Китая в США вырос примерно вдвое — до более чем $300 млн.

Часть поставщиков перешла на пептиды из наркобизнеса. Китайская Bigreat Technology поставляла прекурсоры фентанила и амфетаминов на рынки России и Казахстана. Для продажи косметических пептидов она зарегистрировала отдельное юрлицо — Zhengzhou DEPU Technology.

Напомним, в марте 2026 года аналитики Chainalysis сообщили о возвращении даркнет-платформ к биткоину.

Вот краткий заголовок для этой новости: Релиз ИИ-модели Kimi K3 обвалил рынок полупроводников

1784361243772 880351 scaled

Вот перефразированная новость на русском языке:

16 июля китайская компания Moonshot AI представила модель Kimi K3, содержащую 2,8 триллиона параметров. Этот запуск вызвал массовую распродажу на рынке полупроводников.

В пятницу акции производителей чипов и компаний, занимающихся искусственным интеллектом, упали по всему миру. Наиболее значительное снижение наблюдалось в Азии: тайваньский индекс потерял более 6%, а японский закрылся падением на 4%. В США распродажа продолжилась — Nasdaq снизился на 1,5%, что стало худшим результатом за неделю.

Акции китайского разработчика нейросетей Z.ai в Гонконге обвалились почти на 30%. Nvidia временно уступила Apple звание самой дорогой компании мира.

Инвесторы проводят параллели с «эффектом DeepSeek». В январе 2025 года этот ИИ-стартап выпустил модель R1, после чего капитализация Nvidia за одну торговую сессию сократилась примерно на 590 миллиардов долларов.

Kimi K3 стала самой крупной открытой моделью на момент своего появления. В независимом рейтинге Artificial Analysis Intelligence Index она набрала 57 баллов, что выше показателей Claude Opus 4.8 и GPT-5.5. Этот результат почти сравним с Claude Fable 5 и GPT-5.6 Sol. В отдельных тестах Kimi K3 превзошла конкурентов при значительно более низкой цене.

Модель поддерживает контекст объемом до 1 миллиона токенов, а также работу с текстом и изображениями. Полные веса станут доступны 27 июля по лицензии Modified MIT, после чего небольшие лаборатории смогут использовать модель бесплатно.

Аналитики с Уолл-стрит в основном ожидали таких последствий от запуска. В Morgan Stanley назвали K3 результатом планомерного прогресса, а не неожиданностью. По оценке аналитика Гэри Юя, китайские большие языковые модели (LLM) постепенно догоняют американских лидеров по масштабу, производительности и стоимости.

В Bernstein запуск назвали «подтверждающим»: ИИ быстро развивается, а Китай сохраняет темп. Специалист Робин Чжу прогнозирует, что страна продолжит увеличивать свою долю рынка.

Некоторые эксперты считают распродажу чрезмерной. По их данным, цена K3 близка к стоимости GPT-5.6, а не радикально ниже.

Падение затронуло и криптовалюты. Биткоин опустился ниже отметки в 64 000 долларов.

Moonshot AI поддерживается компанией Alibaba. В 2024 году корпорация вложила 1 миллиард долларов, оценив стартап в 2,5 миллиарда. Сейчас проект оценивается примерно в 31,5 миллиарда долларов.

Более широкая распродажа на рынке производителей чипов продолжается уже несколько недель на фоне опасений по поводу завышенных оценок компаний, связанных с инфраструктурой искусственного интеллекта.

Отраслевой индекс Philadelphia Semiconductor более чем на 20% ниже рекорда конца июня, что формально означает «медвежий рынок». Фонд VanEck Semiconductor, являющийся барометром всего сектора, еще в начале июля впервые с апреля пробил ключевую скользящую среднюю. Запуск Kimi K3 лишь ускорил падение.

Напомним, что в июле около 200 человек прошли между офисами OpenAI, Anthropic и Google DeepMind, требуя приостановить обучение более мощных ИИ-моделей.

Китайский стартап представил самую мощную открытую ИИ-модель

Китайский стартап в сфере искусственного интеллекта Moonshot AI анонсировал модель Kimi K3. Она позиционируется как первая в мире открытая модель класса 3T, имеющая 2,8 триллиона параметров, нативное зрение и контекстное окно на 1 миллион токенов. По внутренним оценкам разработчиков, по совокупным показателям модель уступает только проприетарным системам Claude Fable 5 и GPT 5.6 Sol.

Архитектура Kimi K3 основана на новых технологиях Kimi Delta Attention (KDA) и Attention Residuals (AttnRes). KDA повышает эффективность обработки длинных последовательностей данных, а AttnRes позволяет извлекать нужную информацию выборочно, а не со всех слоев одинаково. Это дает модели более глубокое понимание контекста и сохранение смысла при работе со сложными текстами.

За разреженность вычислений отвечает фреймворк Stable LatentMoE: из 896 экспертов одновременно задействованы только 16. В сочетании с новыми данными и настройками обучения это обеспечило рост эффективности в 2,5 раза по сравнению с предыдущей версией K2.

Разработчики отмечают, что модели семейства Kimi удерживали рекорд по размеру среди открытых моделей на протяжении девяти из последних двенадцати месяцев.

Новая модель уже доступна на сайте, в продуктах Kimi Work, Kimi Code и через API. По умолчанию активирован максимальный режим размышления, другие режимы появятся позднее. Полные веса и отчет будут опубликованы 27 июля.

Результаты тестирования

На некоторых тестах K3 показала результаты выше, чем Fable 5 и GPT-5.6 Sol, но на других заметно отстала. Модель лидирует в тестах SWE Marathon (42 балла против 35 и 39), BrowseComp (91,2 против 88 и 90,4) и Program Bench (77,8 против 76,8 и 77,6). В тесте Terminal Bench 2.1 K3 набрала 88,3 балла, что выше показателя Fable 5 (84,6) и лишь на 0,5 балла меньше, чем у Sol (88,8).

При этом в тесте FrontierSWE K3 получила 81,2 балла против 86,6 у Fable 5, а в HLE-Full — 43,5 против 53,3. Стоит учесть, что методики тестирования различались: часть моделей оценивалась через Claude Code, другие — через Codex или собственный инструмент KimiCode.

Программирование и агентные задачи

K3 способна вести длительные инженерные сессии с минимальным участием человека, ориентироваться в больших репозиториях и управлять терминальными инструментами.

В тесте оптимизации GPU-ядер модели работали до 24 часов над четырьмя задачами, включая ядра AttnRes, KDA и MLA. K3 показала результат на уровне Fable 5 и значительно превзошла Opus 4.8, GPT-5.6 Sol и GPT-5.5. На поздних этапах разработки ранняя версия K3 самостоятельно выполняла большую часть такой оптимизации внутри команды Moonshot.

Кроме того, модель с нуля написала MiniTriton — компактный компилятор для GPU-ядер с собственным промежуточным представлением (IR) на базе MLIR и генерацией PTX-кода.

Проектирование чипов и разработка игр

В демонстрационных целях K3 самостоятельно спроектировала чип для нейросети на собственной архитектуре. Автономный процесс занял 48 часов с использованием открытых EDA-инструментов и библиотеки Nangate 45 нм. Чип площадью 4 мм² работает на частоте 100 МГц и выдает более 8700 токенов в секунду в симуляции. Он содержит 1,46 млн стандартных ячеек, 0,277 МБ SRAM и INT4 MAC-массив со встроенной деквантизацией.

K3 также умеет комбинировать 3D-рассуждение, код и зрение для создания игровых и интерактивных прототипов на основе концептов, изображений и видео.

Работа со знаниями и видео

В одном из примеров K3 воспроизвела универсальные соотношения I-Love-Q из вычислительной астрофизики за два часа вместо одной-двух недель работы опытного исследователя. Модель проанализировала более 20 научных статей, оценила свыше 300 уравнений состояния, выявила несогласованности в опубликованных формулах и написала более 3000 строк кода на Python, оформив результат в интерактивный HTML-дашборд.

В другом случае K3 подготовила интерактивный отчет о 42-летней истории индустрии ASIC-чипов за 120 циклов рекурсивного самоулучшения, обработав более 11 000 страниц из 87 квартальных отчетов и 99 оригинальных PDF-файлов.

Благодаря нативной работе с видео модель умеет монтировать ролики. В одном примере K3 создала объясняющую анимацию собственной архитектуры в стиле 3Blue1Brown, в другом — самостоятельно смонтировала тизер о своем запуске из 56 исходных клипов, включая подбор кадров, синхронизацию с музыкой и обработку звука. По оценке Moonshot, такая работа заняла бы у опытного монтажера один-два дня, а у новичка — три-пять.

Ограничения

Разработчики отмечают, что K3 чувствительна к потере истории размышлений при переключении агентной среды в середине сессии и может проявлять чрезмерную инициативу в неоднозначных ситуациях. По удобству использования модель пока заметно уступает Fable 5 и GPT-5.6 Sol.

Напомним, в июле 2025 года Moonshot AI выпустила Kimi K2 — первую модель линейки с 1 триллионом параметров, которая быстро стала одной из ведущих открытых систем для агентных задач.

Китайский ИИ-стартап представил модель с 2,8 трлн параметров

Вот перефразированная новость на русском языке:

Китайский стартап в сфере ИИ Moonshot AI анонсировал модель Kimi K3, которая стала первой открытой моделью класса 3T. Она насчитывает 2,8 триллиона параметров, поддерживает нативное распознавание изображений и работу с контекстом до 1 миллиона токенов. Разработчики утверждают, что по общим показателям модель уступает только закрытым системам Claude Fable 5 и GPT 5.6 Sol.

Kimi K3 создана на основе новой архитектуры Kimi Delta Attention (KDA) и механизма Attention Residuals (AttnRes). KDA улучшает обработку длинных цепочек данных, а AttnRes позволяет извлекать нужную информацию выборочно, а не со всех уровней одинаково. Благодаря этому модель глубже понимает контекст и сохраняет смысл даже при анализе сложных текстов.

Разреженность вычислений обеспечивает фреймворк Stable LatentMoE: из 896 специализированных модулей одновременно задействуются только 16. В сочетании с новыми данными и методами обучения это дало рост эффективности в 2,5 раза по сравнению с предыдущей версией K2.

По словам разработчиков, модели Kimi в течение девяти из последних 12 месяцев удерживали рекорд по размеру среди открытых ИИ-систем.

Новая модель уже доступна на сайте, в сервисах Kimi Work, Code и через API. По умолчанию включен максимальный режим рассуждений, другие варианты появятся позже. Полные веса и отчет будут опубликованы 27 июля.

Результаты на тестах

На некоторых бенчмарках K3 показала результаты выше, чем у Fable 5 и GPT-5.6 Sol, однако на других заметно отстала. Она лидирует в тестах SWE Marathon (42 балла против 35 и 39), BrowseComp (91,2 против 88 и 90,4) и Program Bench (77,8 против 76,8 и 77,6). В тесте Terminal Bench 2.1 у K3 — 88,3 балла, что выше показателя Fable 5 (84,6) и лишь на 0,5 балла меньше, чем у Sol (88,8).

При этом на тесте FrontierSWE K3 набрала 81,2 балла против 86,6 у Fable 5, а на HLE-Full — 43,5 против 53,3. Однако методики тестирования различались: одни модели оценивались через Claude Code, другие — через Codex или собственный инструмент KimiCode.

Кодинг и выполнение агентных задач

K3 способна вести длительные инженерные сессии с минимальным участием человека, ориентироваться в крупных репозиториях и управлять терминальными инструментами.

В тесте на оптимизацию GPU-ядер модели работали до 24 часов над четырьмя задачами, включая ядра AttnRes, KDA и MLA, на оборудовании NVIDIA H200 и GPU другого производителя. K3 показала результат на уровне Fable 5 и значительно превзошла Opus 4.8, GPT-5.6 Sol и GPT-5.5. На поздних этапах разработки ранняя версия K3 самостоятельно выполняла большую часть такой оптимизации внутри команды Moonshot.

Отдельно модель с нуля написала MiniTriton — компактный компилятор для GPU-ядер с собственным промежуточным представлением кода и генерацией PTX-кода.

Проектирование микросхем и создание игр

Для демонстрации возможностей K3 самостоятельно спроектировала чип для нейросети на собственной архитектуре. Автономный процесс занял 48 часов: модель использовала открытые инструменты для анализа данных и библиотеку Nangate 45 нм. Чип площадью 4 мм² работает на частоте 100 МГц и выдает более 8700 токенов в секунду в симуляции. Он содержит 1,46 миллиона стандартных ячеек, 0,277 МБ SRAM и массив INT4 MAC со встроенной деквантизацией.

Кроме того, K3 сочетает 3D-рассуждение, код и распознавание изображений для создания игровых и интерактивных прототипов на основе концептов, картинок и видео.

Работа со знаниями и видео

В одном из примеров K3 воспроизвела универсальные соотношения I-Love-Q из вычислительной астрофизики. На это ушло около двух часов вместо одной-двух недель работы опытного исследователя. Модель проанализировала более 20 научных статей, оценила свыше 300 уравнений состояния, выявила несостыковки в опубликованных формулах и написала более 3000 строк кода на Python, оформив результат в интерактивный HTML-дашборд.

В другом случае K3 подготовила интерактивный отчет о 42 годах истории индустрии ASIC-чипов за 120 циклов рекурсивного самоулучшения, обработав более 11 000 страниц из 87 квартальных отчетов и 99 оригинальных PDF-файлов.

Благодаря нативной работе с видео K3 умеет монтировать ролики: в одном примере модель создала объясняющую анимацию собственной архитектуры в стиле 3Blue1Brown, в другом — самостоятельно смонтировала тизер о своем запуске из 56 исходных клипов, включая подбор кадров, синхронизацию с музыкой и обработку звука. По оценке Moonshot, такая работа заняла бы у опытного монтажера один-два дня, а у новичка — три-пять.

Ограничения

Разработчики отметили, что K3 чувствительна к потере истории рассуждений при смене агентной среды в середине сессии и может проявлять излишнюю инициативу в неоднозначных ситуациях. По удобству использования модель пока заметно уступает Fable 5 и GPT-5.6 Sol.

Напомним, в июле 2025 года Moonshot AI выпустила Kimi K2 — первую модель линейки с 1 триллионом параметров, которая быстро стала одной из ведущих открытых систем для агентных задач.

Anthropic: Китай обучает ИИ на ответах Claude и GPT

1784224364435 967441 scaled

Вот перефразированная новость на русском языке:

Одна из ведущих китайских компаний в сфере искусственного интеллекта Zhipu обучала свою модель GLM-5.2, используя ответы от Claude и GPT. Об этом на форуме Aspen Security заявил глава отдела политики национальной безопасности компании Anthropic Тарун Чхабра, сообщает South China Morning Post.

По его словам, США опережают Китай в разработке передовых ИИ-моделей на шесть-девять месяцев. Однако если бы не несанкционированная дистилляция (метод, при котором менее мощная модель учится на ответах более крупной), этот разрыв был бы ещё больше — до полутора лет. Чхабра назвал такие действия Пекина «враждебными» и подчеркнул, что конкуренты таким образом извлекают самую ценную интеллектуальную собственность из чужих моделей.

Дистилляцией занимаются «практически все» ведущие китайские лаборатории. Они используют не только Claude, но и модели других американских разработчиков. Anthropic активно блокирует связанные с этим аккаунты — до нескольких миллионов в неделю.

Чхабра также сообщил о новых доказательствах в отношении Zhipu AI. Её последнюю модель GLM-5.2 обучали на ответах Claude и GPT. Аналогичную «враждебную кампанию» продолжает DeepSeek, добавил специалист.

Ранее похожие выводы опубликовала исследовательская компания Graphistry. Согласно коэффициенту согласия Коэна, ответы GLM-5.2 совпали с GPT-5.5 на 0,8, а с Opus 4.8 — на 0,76. Для сравнения: между GPT-5.5 и Opus 4.8 этот показатель составил 0,63. Zhipu AI не подтвердила и не опровергла эту оценку.

США ужесточают меры против Китая в сфере ИИ

В июле власти Китая назвали Claude Code от Anthropic «серьёзной угрозой» для китайских пользователей. После этого Alibaba запретила своим сотрудникам использовать этот инструмент по соображениям безопасности.

Параллельно Вашингтон ужесточает политику в области ИИ в отношении Пекина. Ранее Белый дом запустил инициативу Gold Eagle — площадку, где ведущие американские компании в сфере ИИ обмениваются данными об уязвимостях кибербезопасности. С этой платформой уже сотрудничают несколько ведомств США, включая Министерство обороны.

Глава Минфина Скотт Бессент заявил, что регулятор продолжит использовать передовые ИИ-модели, чтобы «опережать противников и защищать американцев от новых угроз».

Этому предшествовало решение администрации президента США Дональда Трампа закрыть иностранцам доступ к самым мощным моделям Anthropic — Fable 5 и Mythos 5. Из-за этого компания почти на три недели отключила обе нейросети для всех пользователей. Позднее доступ был восстановлен.

Напомним, в феврале Anthropic уже обвиняла DeepSeek, Moonshot AI и MiniMax в дистилляции Claude через тысячи фиктивных аккаунтов. Позже компания назвала связанную с Alibaba кампанию крупнейшей из известных ей атак такого рода.

Вот краткий заголовок для новости: Anthropic обвинила Zhipu в краже знаний через дистилляцию Claude и GPT

1784207036415 788380 scaled

Вот перефразированная новость на русском языке:

На форуме Aspen Security представитель компании Anthropic Тарун Чхабра заявил, что китайская фирма Zhipu использовала ответы систем Claude и GPT для обучения своей модели GLM-5.2. По его словам, США опережают Китай в разработке передовых ИИ-моделей на шесть-девять месяцев. Однако, если бы не незаконное копирование знаний (дистилляция), этот разрыв мог бы достигать полутора лет. Чхабра назвал такие действия Пекина «враждебными» и подчеркнул, что конкуренты таким образом извлекают ценную интеллектуальную собственность из чужих разработок.

Почти все ведущие китайские лаборатории занимаются дистилляцией, используя не только Claude, но и модели других американских разработчиков. Anthropic еженедельно блокирует до нескольких миллионов аккаунтов, замешанных в этом процессе.

Чхабра также сообщил о новых доказательствах в отношении Zhipu AI: их последнюю модель GLM-5.2 обучали на ответах Claude и GPT. Аналогичную деятельность продолжает компания DeepSeek.

Ранее исследовательская компания Graphistry пришла к похожим выводам. По коэффициенту согласия Коэна, ответы GLM-5.2 совпали с GPT-5.5 на 0,8, а с Opus 4.8 — на 0,76. Для сравнения: совпадение между GPT-5.5 и Opus 4.8 составило 0,63. Сама Zhipu AI не подтвердила и не опровергла эти данные.

Тем временем США усиливают меры против Китая в сфере ИИ. В июле китайские власти назвали инструмент Claude Code от Anthropic «серьезной угрозой» для местных пользователей, после чего Alibaba запретила своим сотрудникам его использование из соображений безопасности.

Вашингтон также ужесточает политику в отношении Пекина. Белый дом запустил платформу Gold Eagle, где ведущие американские ИИ-компании обмениваются данными об уязвимостях кибербезопасности. К этой инициативе уже подключились несколько ведомств, включая Министерство обороны.

Глава Минфина США Скотт Бессент заявил, что регулятор продолжит использовать передовые ИИ-модели, чтобы «опережать противников и защищать американцев от новых угроз».

Ранее администрация Дональда Трампа закрыла иностранцам доступ к самым мощным моделям Anthropic — Fable 5 и Mythos 5. Из-за этого компания почти на три недели отключила обе нейросети для всех пользователей, но позже доступ был восстановлен.

Напомним, что в феврале Anthropic уже обвиняла DeepSeek, Moonshot AI и MiniMax в дистилляции Claude с помощью тысяч фиктивных аккаунтов. Позже компания назвала кампанию, связанную с Alibaba, крупнейшей из известных ей атак такого рода.