Гонка за скоростью: Google и OpenAI представили ИИ-решения нового поколения

Рынок искусственного интеллекта продолжает лихорадить: 13 августа сразу два технологических гиганта выкатили свои обновления, нацеленные на одну и ту же нишу — сверхбыструю обработку задач для разработчиков и ИИ-агентов. Google представила Gemini 3.7 Flash, а OpenAI анонсировала режим Ultrafast для своей флагманской модели GPT-5.6 Sol. Это не просто эволюция, а четкий сигнал о том, куда движется индустрия: в сторону скорости и эффективности, а не только сырой мощности.
Что нового в Gemini 3.7 Flash
Google позиционирует Gemini 3.7 Flash как рабочую лошадку для программирования и автоматизации бизнес-процессов. Ключевые улучшения касаются многоэтапного планирования, точного следования инструкциям и генерации кода. Однако самое интересное — это цена: компания заявила о снижении стоимости использования вдвое по сравнению со стартовой ценой предыдущей версии. Это агрессивный ход, учитывая, что линейка Flash и так была ориентирована на сценарии, где критична скорость ответа: кодинг, работа агентов и задачи с множеством последовательных обращений к модели.
Напомню, что в июле вышла Gemini 3.6 Flash с прайсом $1,5 за 1 млн входных токенов и $7,5 за 1 млн выходных. Тогда же компания отчиталась, что новая модель потребляет на 17% меньше выходных токенов, чем 3.5 Flash. При этом флагманская Gemini 3.5 Pro, которую многие ждали, так и не вышла в открытый доступ — разработчики всё еще тестируют её с партнерами, и сроки релиза остаются туманными.
Как OpenAI ускорила GPT-5.6 Sol
OpenAI ответила симметрично, но с другим акцентом. Режим Ultrafast для GPT-5.6 Sol, по заявлению компании, разгоняет генерацию до 750 выходных токенов в секунду — это до 14 раз быстрее стандартного режима. Секрет в использовании инфраструктуры Cerebras, специализирующейся на сверхскоростных вычислениях. Однако на старте доступ к Ultrafast получат лишь ограниченное число клиентов через API, и OpenAI обещает расширять доступ по мере наращивания вычислительных мощностей.
Показатель в 750 токенов в секунду не нов — о нем говорили еще в июне при анонсе GPT-5.6. Тогда же было ясно, что Sol запустят на Cerebras, но с оговоркой о поэтапном подключении пользователей. Сейчас этот план начинает материализовываться. На этом фоне стоит вспомнить и августовский релиз Grok 4.6 от SpaceXAI — модель, сфокусированная на долгосрочных агентских задачах и программировании. Конкуренция накаляется до предела.
Мой анализ: Оба анонса подтверждают тренд на «малые и быстрые» модели, которые могут работать в реальном времени. Снижение цены у Google и экстремальная скорость у OpenAI — это два разных подхода к одной проблеме: сделать ИИ доступным для массовой автоматизации. В краткосрочной перспективе выигрывает тот, кто сможет предложить лучший баланс цены и задержки ответа, особенно в сегменте агентных решений, где каждый лишний миллисекунд — это потерянные деньги.