Новости криптомира

14.08.2026
08:30

Гонка скоростей в ИИ: Google и OpenAI представили новые решения для разработчиков

битва роботов, AI battle

13 августа состоялся двойной анонс, который задал новый вектор в развитии генеративного ИИ. Google представила модель Gemini 3.7 Flash, а OpenAI анонсировала режим Ultrafast для своей GPT-5.6 Sol. Обе компании явно делают ставку на скорость и эффективность, что критически важно для задач с кодом и автономными ИИ-агентами.

Что нового в Gemini 3.7 Flash

Google позиционирует Gemini 3.7 Flash как рабочую лошадку для программирования и автоматизации бизнес-процессов. Разработчики заявляют о существенных улучшениях в многоэтапном планировании, точности следования инструкциям и качестве генерации кода. При этом компания пошла на радикальный шаг: стоимость использования снижена вдвое по сравнению со стартовой ценой предыдущей версии. Это делает модель крайне привлекательной для масштабных продакшн-нагрузок.

Снимок экрана — 2026-08-14 в 08.50.29
Данные из презентации Google DeepMind.

Линейка Flash изначально задумывалась как решение для сценариев, где скорость получения ответа не менее важна, чем его качество. Это кодинг, работа ИИ-агентов и любые задачи, предполагающие множество последовательных обращений к модели. Напомню, что в июле вышла Gemini 3.6 Flash с ценой $1,5 за 1 млн входных токенов и $7,5 за 1 млн выходных. Тогда же компания отчиталась, что новая модель потребляет на 17% меньше выходных токенов, чем её предшественница.

Однако в тени этих анонсов остаётся вопрос о флагманской Gemini 3.5 Pro. Модель до сих пор не выпущена публично, и разработчики лишь тестируют её с избранными партнёрами. Конкретные сроки релиза остаются туманными, что создаёт интригу на рынке.

Как OpenAI ускорила GPT-5.6 Sol

OpenAI, в свою очередь, представила режим Ultrafast для GPT-5.6 Sol. Заявленные показатели впечатляют: скорость работы до 14 раз выше стандартной и генерация до 750 выходных токенов в секунду. Секрет такого ускорения — в использовании инфраструктуры Cerebras, специализирующейся на сверхбыстрых чипах для ИИ.

На старте Ultrafast будет доступен через API ограниченному кругу клиентов. Это логичный шаг: OpenAI необходимо протестировать нагрузку и масштабировать вычислительные мощности. По мере их роста доступ откроют для более широкой аудитории. Сам показатель в 750 токенов в секунду упоминался ещё в июне, когда анонсировали GPT-5.6. Тогда разработчики предупреждали, что ускоренная версия на Cerebras будет внедряться поэтапно.

В этом контексте стоит вспомнить и августовский релиз Grok 4.6 от SpaceXAI, который сделал акцент на долгосрочных агентских задачах и программировании. Конкуренция в сегменте "быстрых" моделей накаляется, и это отличная новость для рынка.

Мой анализ: Оба анонса подтверждают ключевой тренд 2026 года — смещение фокуса с "умных" моделей на "быстрые и дешёвые". Для Web3-разработчиков и DeFi-протоколов это означает снижение операционных издержек и возможность создавать более сложных агентов, работающих в реальном времени. Снижение цены Gemini 3.7 Flash вдвое — это не просто маркетинг, а прямая попытка захватить долю рынка enterprise-разработки, где цена за токен часто является решающим фактором.