Новости криптомира

14.08.2026
08:10

Гонка скоростей: Google и OpenAI представили ИИ-решения нового поколения

битва роботов, AI battle

13 августа состоялся двойной удар по рынку искусственного интеллекта: Google анонсировала модель Gemini 3.7 Flash, а OpenAI представила революционный режим Ultrafast для GPT-5.6 Sol. Обе разработки нацелены на критически важный сегмент — высокоскоростное выполнение задач, связанных с программированием и автономными ИИ-агентами.

Gemini 3.7 Flash: ставка на эффективность и экономию

Новая модель от Google позиционируется как рабочая лошадка для корпоративного сектора и разработчиков. Ключевые улучшения касаются многоэтапного планирования, точного следования инструкциям и генерации кода. Однако самым интригующим аспектом стало радикальное снижение цены: стоимость использования упала вдвое относительно прайса предыдущей версии.

Линейка Flash традиционно закрывает сценарии, где латентность критична: это кодинг, агентные пайплайны и задачи с множественными последовательными вызовами модели. Напомню, что в июле вышла Gemini 3.6 Flash с ценником $1,5 за миллион входных токенов и $7,5 за миллион выходных. Тогда же компания отчиталась о 17-процентном сокращении потребления выходных токенов по сравнению с 3.5 Flash.

Показательно, что флагманская Gemini 3.5 Pro до сих пор находится в стадии закрытого тестирования с партнерами, и сроки её публичного релиза остаются туманными. Это создаёт любопытный дисбаланс: Google явно делает ставку на массовый сегмент, а не на премиальные модели.

OpenAI Ultrafast: 750 токенов в секунду на базе Cerebras

OpenAI ответила собственным козырем — режимом Ultrafast для GPT-5.6 Sol. Заявленные показатели впечатляют: до 14-кратного ускорения относительно стандартной версии и генерация до 750 выходных токенов в секунду. Технологической основой стала инфраструктура Cerebras, специализирующейся на гигантских кремниевых пластинах.

На старте доступ к Ultrafast через API получит лишь ограниченный пул клиентов. Это осознанный шаг: OpenAI будет поэтапно наращивать вычислительные мощности, постепенно подключая новых пользователей. Примечательно, что цифра в 750 токенов в секунду фигурировала ещё в июньском анонсе GPT-5.6, однако тогда компания предупреждала о неравномерном доступе к ускоренной версии.

Контекст гонки усиливает августовский релиз Grok 4.6 от SpaceXAI, сфокусированного на долгосрочных агентских сценариях и интерактивных приложениях.

Мой анализ: Мы наблюдаем тектонический сдвиг в конкурентной борьбе — от качества ответов к скорости их получения. Удешевление Flash-моделей Google и агрессивный ультрабыстрый режим OpenAI — это прямое следствие давления со стороны открытых моделей. Однако 750 токенов в секунду — это не просто маркетинг: такие показатели открывают дорогу для real-time агентов, которые смогут взаимодействовать с пользователем без ощутимой задержки. Вопрос лишь в том, сможет ли Cerebras масштабироваться достаточно быстро, чтобы демократизировать эту технологию, или ультраскорость останется привилегией избранных корпоративных клиентов.