Илон Маск установил цель на начало августа для Grok 4.6 и раскрыл планы по более крупной модели Grok 4.7, поскольку SpaceXAI усиливает конкуренцию с OpenAI, Anthropic и китайской Moonshot AI.
Краткое содержание
- Grok 4.6 запланирован примерно на 7 августа, по словам Маска.
- Будущая модель будет иметь 1,5 триллиона параметров и улучшенную пост-тренировку.
- Grok 4.7 может выйти через несколько недель с 2,1 триллиона параметров.
- Grok 4.5 занял первое место по соотношению цена-производительность в области кибербезопасности в оценке Vercel.
Grok 4.6 нацелен на выпуск 7 августа
Маск раскрыл сроки в посте на X от 28 июля, заявив, что Grok 4.6 будет выпущен «примерно 7 августа». Он описал его как модель с 1,5 триллиона параметров, с более сильным контролируемым дообучением и обучением с подкреплением.
Контролируемое дообучение обучает модель на выбранных примерах для улучшения качества ее ответов. Обучение с подкреплением использует обратную связь и сигналы вознаграждения для уточнения того, как модель обрабатывает задачи и следует инструкциям.
Маск также сказал, что Grok 4.7 последует «через несколько недель» как модель с 2,1 триллиона параметров. Однако он не указал точную дату запуска и не раскрыл информацию о ценообразовании и доступности для обоих выпусков.
«Это будет лучше, чем 4.6 во всех отношениях, за исключением немного более медленного обслуживания, хотя и с еще лучшей эффективностью токенов», — сказал Маск о Grok 4.7.
Обе даты остаются целями, а не подтвержденными датами выпуска. Графики разработки моделей могут меняться в процессе обучения, тестирования и развертывания.
Grok 4.5 задает базовый уровень для обновлений
SpaceXAI представила Grok 4.5 в начале июля как модель, предназначенную для кодирования, задач на основе агентов и интеллектуальной работы. Компания в настоящее время взимает $2 за миллион входных токенов и $6 за миллион выходных токенов.
Маск объявил о следующих двух моделях в ответ на оценку генерального директора Vercel Гильермо Рауха, который описал Grok 4.5 как самую производительную модель кибербезопасности относительно ее цены в последних тестах Vercel.
Согласно посту Рауха, Grok 4.5 был в 10 раз дешевле, чем GPT-5.6 Sol от OpenAI, в 5,7 раза дешевле, чем Opus 5 от Anthropic, и в 2,2 раза дешевле, чем Kimi K3 от Moonshot, при этом обеспечивая производительность, близкую к Kimi.
Раух все же поставил Sol на первое место среди передовых моделей, опередив Opus 5. Его выводы отражают методы тестирования Vercel и не устанавливают универсальный рейтинг для всех рабочих нагрузок ИИ.
SpaceXAI не сообщила, сохранят ли Grok 4.6 и Grok 4.7 ценообразование Grok 4.5. Скорость обслуживания, использование токенов и стоимость API будут определять, сохранят ли новые модели то же преимущество по соотношению цена-производительность.
Американские компании ИИ сталкиваются с давлением со стороны китайского Kimi K3
Запланированные обновления Grok происходят в то время, как китайские разработчики сокращают разрыв с ведущими американскими компаниями ИИ. Moonshot AI выпустила полные веса для Kimi K3 27 июля, что позволяет разработчикам загружать, модифицировать и запускать модель на собственной инфраструктуре.
Kimi K3 имеет 2,8 триллиона параметров, нативные визуальные возможности и контекстное окно в один миллион токенов. Его масштаб и открытая структура весов усилили давление на американские компании, которые в основном распространяют свои самые передовые модели через закрытые платформы и платные API.
SpaceXAI, OpenAI и Anthropic также конкурируют в области кодирования, кибербезопасности, рассуждений и стоимости выполнения каждой задачи. Более крупная архитектура Grok 4.7 может улучшить его возможности, но Маск признал, что он будет медленнее в обслуживании, чем Grok 4.6.
Только количество параметров не определяет качество модели. Обучающие данные, архитектура, методы пост-обучения, системы вывода и эффективность токенов могут влиять на производительность.
Американские ИИ-компании расходятся во мнениях по поводу федерального надзора
OpenAI и Anthropic уже согласились предоставлять американским чиновникам ранний доступ к невыпущенным передовым моделям для проверки безопасности. Эти соглашения легли в основу более широкой добровольной федеральной системы проверки, которая теперь охватывает других крупных разработчиков, включая SpaceXAI, Google DeepMind и Microsoft.
Президент Дональд Трамп формализовал эту систему через июньский исполнительный указ. Участвующие компании могут предоставлять охваченные модели федеральному правительству на срок до 30 дней перед их выпуском доверенным партнерам. В указе говорится, что проверки не создают обязательную систему лицензирования или предварительного одобрения.
Однако отрасль остается разделенной по вопросу о том, как Вашингтон должен обращаться с моделями с открытыми весами. Nvidia, Microsoft, Meta, OpenAI, Palantir и другие организации предупредили американских политиков о широких ограничениях в открытом письме от 24 июля. Они утверждали, что открытые модели поддерживают конкуренцию, снижают затраты на развертывание и позволяют разработчикам запускать и модифицировать ИИ-системы на собственной инфраструктуре.
Дебаты усилились после выпуска Moonshot AI модели Kimi K3 с 2,8 триллиона параметров. Чиновники администрации Трампа обвинили Moonshot в использовании выходных данных модели Fable от Anthropic для обучения Kimi K3 через крупномасштабную дистилляцию. Советник Белого дома по технологиям Майкл Крациос назвал предполагаемую практику попыткой получить проприетарную американскую технологию, а министр финансов Скотт Бессент заявил, что администрация рассматривает санкции и внесение Moonshot в торговый черный список.
Moonshot публично не признал эти обвинения. Тем не менее, спор поставил Kimi K3 в центр более широкой политической борьбы по вопросу о том, должен ли Вашингтон нацеливаться на конкретные риски безопасности и интеллектуальной собственности или более широко ограничивать доступ к китайским моделям с открытыми весами. Grok 4.6 и Grok 4.7 выйдут на этот рынок, поскольку американские разработчики сталкиваются с давлением, требующим улучшения производительности при соблюдении новых федеральных требований безопасности.






