Больше не нужно искать — необходимые
обучающие материалы и подсказки всегда под рукой

Вот перефразированный текст новости на русском языке:
Компания SpaceXAI выпустила Grok 4.5 — новую модель, ориентированную на программирование, работу с агентами и интеллектуальные задачи. Разработчик называет её своей самой мощной системой.
Модель уже доступна через API, в Grok Build и в Cursor на всех тарифных планах. В странах Евросоюза она пока недоступна — запуск ожидается в середине июля.
Ключевые преимущества новинки — цена и скорость. Стоимость Grok 4.5 составляет $2 за миллион входных токенов и $6 за миллион выходных. Для сравнения: Claude Opus 4.8 от Anthropic обойдётся в $5 и $25 соответственно, Claude Fable 5 — в $10 и $50, а GPT-5.6 Sol от OpenAI — в $5 и $30.
При этом GPT-5.6 пока доступен в ограниченном режиме: OpenAI открыла доступ к линейке лишь небольшой группе проверенных партнёров и планирует выпустить Sol, Terra и Luna в открытый доступ в ближайшие недели. Внутри этой же серии у Luna цена ниже — $1 за миллион входных токенов и $6 за миллион выходных.
По словам Илона Маска, Grok 4.5 — это модель «уровня Opus, но быстрее, дешевле и эффективнее по токенам». Позже он уточнил, что, по внутренним оценкам SpaceXAI, система «примерно сопоставима с Opus 4.7, но значительно быстрее».
Что показали тесты
Опубликованные SpaceXAI результаты неоднозначны: модель не стала абсолютным лидером во всех тестах, но и не оказалась безнадёжно позади конкурентов.
На тесте DeepSWE 1.0 Grok 4.5 набрала 62%. Она уступила Fable (66,1%) и GPT-5.5 (64,31%), но обошла Claude Opus 4.8 (55,75%) и Opus 4.7 (40,12%).
На DeepSWE 1.1 результат ниже: 53% против 59% у Opus 4.8, 67% у GPT-5.5 и 70% у Fable. На SWE Bench Pro модель показала 64,7% — это выше, чем у GPT-5.5 (58,6%), примерно на уровне Opus 4.7 (64,3%), но ниже Opus 4.8 (69,2%) и Fable (80,4%).
На Terminal Bench 2.1 Grok 4.5 набрала 83,3% — почти как GPT-5.5 (83,4%), но ниже Fable (84,3%). На SWE Marathon она заняла первое место с 29% против 26% у Opus 4.8 и 24% у Fable. Компания также заявила о лидерстве Grok 4.5 на тесте Harvey’s Legal Agent Benchmark.
Где кроется главное преимущество SpaceXAI
Более весомый аргумент в пользу релиза связан не с максимальными показателями в тестах, а с экономической эффективностью. По данным SpaceXAI, на задачах SWE Bench Pro Grok 4.5 использовала в среднем 15 954 выходных токена на задачу. У Claude Opus 4.8 этот показатель составил 67 020 токенов — в 4,2 раза больше.
Для команд, которые эксплуатируют ИИ на большом объёме задач, это напрямую влияет на итоговую стоимость. Благодаря более низкой цене за выходные токены Grok 4.5 может быть выгоднее в сценариях с большим количеством итераций: исправление ошибок, генерация правок, проверка кода и агентные циклы.
SpaceXAI также заявила о скорости генерации около 80 токенов в секунду и контекстном окне на 500 000 токенов. Компания позиционирует модель как компромисс между качеством, скоростью и стоимостью.
Связь с Cursor
В релизе SpaceXAI указано, что Grok 4.5 обучали совместно с ИИ-сервисом Cursor. Компания не раскрыла полный состав данных, но отметила, что модель создавалась для задач программирования, агентной работы с инструментами, науки, инженерии и математики.
По данным Decrypt, при обучении использовались данные сессий разработчиков Cursor, включая трассировки отладки и реальные правки кода, а не только статические репозитории.
В июне SpaceX заключила соглашение о покупке ИИ-сервиса с оценкой $60 млрд. Сделка пройдёт в акциях класса A SpaceX, закрытие ожидается в III квартале 2026 года после получения регуляторных одобрений.
Grok 4.5 стала одной из первых крупных моделей после объединения ИИ-направления Маска со SpaceX. Для её обучения компания использовала десятки тысяч графических процессоров Nvidia GB300.
Напомним, в феврале СМИ сообщали о планах тогда ещё отдельных SpaceX и xAI создать ПО для автономного оружия Пентагона.
Популярные лонгриды: