Ровно через десять дней, 12 сентября, xAI представит долгожданную модель Grok 4.7. Илон Маск делает смелые заявления о её превосходстве над всеми существующими ИИ-системами, подкрепляя амбиции не только архитектурными изменениями, но и эксклюзивным доступом к данным космической отрасли.

Этот анонс выглядит особенно интригующим на фоне стремительного ускорения цикла релизов. Только в августе мы увидели Grok 4.6 (12-го числа), а в июле — публичный дебют Grok 4.5. Теперь же, всего через месяц, нас ждёт следующая итерация. В то же время OpenAI не дремлет, анонсируя собственную модель Astra, что лишь подогревает конкурентную гонку.

Данные SpaceX как главный козырь

Ключевое отличие Grok 4.7 от предшественников — не только в масштабе. Маск подтвердил, что базовое обучение завершено, и сейчас идёт финальный этап дообучения на внутренних данных SpaceX. Это стратегический ход, который может дать модели уникальное преимущество в решении инженерных и научных задач, недоступное конкурентам.

Архитектура также претерпела серьёзные изменения. Grok 4.7 будет оперировать 2,1 триллиона параметров, что на 40% больше, чем у Grok 4.6 (1,5 трлн). При этом, по словам Маска, новая версия будет работать несколько медленнее, но значительно эффективнее расходовать вычислительные токены — компромисс, который говорит о фокусе на глубину анализа, а не на скорость ответа.

«Grok 4.7 превзойдёт все текущие модели. При этом Anthropic — отличная компания, они, скорее всего, скоро покажут более продвинутые решения. Благодаря уникальным данным для обучения от SpaceX я был бы удивлён, если какая-то другая модель окажется лучше Grok 4.7 для инженерных задач в реальном мире», — заявил Маск.

Ориентиры и реалии бенчмарков

Чтобы понять, насколько амбициозна цель, стоит взглянуть на результаты предшественника. Grok 4.6 набрал 61 балл в индексе AA Intelligence, сравнявшись с GPT-5.6 Sol Max, но уступив один балл лидеру — Claude Fable 5 Max (62 балла). В тесте GDPVal-AA v2 модель показала 1753 балла, однако в Terminal-Bench v3.0 результаты оказались скромнее — всего 26% против 34,6% у конкурента от OpenAI.

Интересно, что Grok 4.5 ранее демонстрировал схожую динамику: лидируя в AutomationBench-AA с 51,4% при стоимости $0,34 за задачу, он чаще нарушал защитные ограничения (0,63 срыва против 0,55 у Claude Opus 4.8). Эта тенденция показывает, что xAI делает ставку на «сырую» мощь, иногда в ущерб безопасности.

Теперь, когда дата финального релиза подтверждена, главный вопрос — сможет ли xAI подтвердить громкие обещания независимыми тестами, или мы снова увидим разрыв между маркетингом и реальными показателями.

Мой взгляд: ставка на уникальные данные SpaceX — это действительно сильный ход, который сложно скопировать конкурентам. Однако решающим фактором станет не количество параметров, а способность модели эффективно применять эти знания в реальных сценариях. Рынок уже устал от «бумажных» рекордов — нужны доказательства в боевых условиях.