Ровно через десять дней, 12 сентября, xAI представит общественности Grok 4.7. Илон Маск делает громкое заявление: новая модель не просто станет шагом вперед, а буквально «обгонит» все существующие на рынке ИИ-решения.

Этот релиз станет третьим крупным обновлением за два месяца. Для сравнения: Grok 4.6 дебютировала 12 августа, а публичный доступ к Grok 4.5 открыли только в июле. Такой темп говорит о том, что инженеры xAI перешли в режим агрессивной итеративной разработки, пытаясь захватить лидерство в гонке вооружений.

Секретное оружие: 2,1 триллиона параметров и данные SpaceX

Ключевое отличие Grok 4.7 — архитектура и уникальный обучающий корпус. Маск подтвердил, что базовое обучение завершено, и сейчас команда интегрирует в модель внутренние данные SpaceX. Это не просто маркетинговый ход, а реальное конкурентное преимущество: доступ к инженерной телеметрии, данным запусков и симуляциям физических процессов дает модели уникальную эмпирическую базу, которой нет у конкурентов.

Параметрическая емкость выросла до 2,1 триллиона, что на 40% больше, чем у предшественницы (1,5 трлн). При этом Маск отмечает, что новая версия работает несколько медленнее, но значительно экономнее расходует токены. Это осознанный компромисс: ставка делается на глубину рассуждений и качество ответа, а не на скорость генерации.

В своем заявлении Маск также упомянул Anthropic, назвав их «отличной компанией» и выразив уверенность, что они скоро покажут продвинутые решения. Однако он добавил, что был бы крайне удивлен, если бы любая другая модель превзошла Grok 4.7 в реальных инженерных задачах.

Бенчмарки: есть ли основания для амбиций?

Ситуация с тестами неоднозначна. Предыдущая версия, Grok 4.6, показала смешанные результаты. В индексе AA Intelligence она набрала 61 балл, сравнявшись с GPT-5.6 Sol Max, но уступив один балл Claude Fable 5 Max (62). В тесте GDPVal-AA v2 результат впечатляет — 1753 балла, однако на Terminal-Bench v3.0 модель провалилась, показав лишь 26% против 34,6% у конкурента от OpenAI.

Интересно, что Grok 4.5 ранее демонстрировала схожую динамику: лидерство в специализированных тестах (AutomationBench-AA — 51,4% при стоимости $0,34 за задачу) сопровождалось проблемами с соблюдением защитных ограничений (0,63 срыва на задачу против 0,55 у Claude Opus 4.8).

Теперь Маск назвал точную дату релиза. Подтвердятся ли громкие обещания на практике, зависит от того, опубликует ли xAI независимые результаты тестирования. Рынок ждет не слов, а цифр.

Мой анализ: использование проприетарных данных SpaceX — это действительно умный ход, который может дать модели уникальную компетенцию в физике и инженерии. Однако на стандартных бенчмарках общего назначения это преимущество может не сыграть. Реальная битва развернется в нишевых тестах на практическое применение, где «жизненный опыт» модели будет важнее сырой вычислительной мощности.