Grok 4.5 возглавляет рейтинг ИИ-агентов: новый этап автономной навигации в браузере
Создание полностью автономных ИИ-помощников, способных самостоятельно перемещаться по сайтам, нажимать кнопки, заполнять формы и собирать данные, перестаёт быть фантастикой. Последние тесты показывают, что модель Grok от xAI демонстрирует наивысшую эффективность в этом сегменте, обгоняя решения от OpenAI и Anthropic.
Инструмент, построенный на базе модели Grok, показал впечатляющий результат в 76,42% успешно выполненных задач. Это ставит его на первое место среди пяти протестированных ассистентов. Следом идёт помощник от OpenAI с показателем 72,70%, а решения от Anthropic расположились на третьей и четвёртой позициях с результатами 70,75% и 67,92% соответственно. Замыкает рейтинг GPT с плагином OpenClaw, который справился лишь с 60,38% заданий.
Ключевой вывод из этого сравнения: при прочих равных условиях выбор базовой ИИ-модели имеет решающее значение. В данном тесте Grok 4.5 продемонстрировала превосходство в понимании контекста и точности выполнения действий. Стоит отметить, что даже у одного разработчика — Anthropic — разница в результатах между двумя способами подключения к браузеру составила почти три процентных пункта, что подчёркивает важность архитектуры интеграции.
Что стоит за цифрами
Каждый из этих помощников использует свою флагманскую модель: Grok работает на Grok 4.5, OpenAI — на GPT 5.5, а Anthropic — на Opus 4.8. Именно «мозг» ассистента отвечает за логику принятия решений, а интерфейс управления браузером лишь добавляет возможность физического взаимодействия с веб-страницами. Результаты однозначно указывают на то, что Grok 4.5 на текущем этапе лучше всех адаптирован для роли браузерного агента.
Рынок автономных ИИ-агентов только зарождается, и лидерство Grok — это серьёзная заявка. Если xAI сможет масштабировать этот успех и интегрировать технологию в реальные бизнес-процессы — от бронирования билетов до сбора маркетинговых данных — мы станем свидетелями смены парадигмы взаимодействия с интернетом. Конкурентам стоит задуматься: простого улучшения языковой модели уже недостаточно.