Команда OpenAI выпустила обновлённое руководство по промптингу для флагманской модели GPT-5.6 Sol и всего семейства GPT-5.6. Ключевой посыл документа — отказ от длинных, многоступенчатых сценариев в пользу максимально лаконичных запросов. Это кардинальное изменение подхода по сравнению с инструкциями для предыдущей версии, GPT-5.

Внутренние тесты на агентных задачах программирования показали впечатляющие результаты: компактные промпты повысили оценки качества на 10-15%, сократили расход токенов на 41-66% и снизили стоимость выполнения задач на 33-67%. Эффективность очевидна, и это не просто теория — это практические данные.

Ранее, при запуске GPT-5 в августе 2025 года, OpenAI делала упор на XML-блоки, шаблоны для сбора контекста и детальные сценарии вызова инструментов. Теперь же для GPT-5.6 Sol рекомендуется убрать повторы, стилевые указания, неэффективные примеры и шаги, с которыми модель уже стабильно справляется. Вместо этого в промпте должны остаться: видимый результат, критерии успеха, условия остановки и жёсткие ограничения, такие как требования безопасности.

Отдельное предупреждение: GPT-5.6 строго следует условиям запроса. Противоречащие друг другу правила сбивают модель сильнее, чем нехватка деталей. Слова «всегда» и «никогда» рекомендовано использовать только для инвариантов, а для остальных случаев — формулировать условные правила.

В руководстве появились два новых раздела. Первый — параметр text.verbosity, который задаёт базовый уровень детализации ответа: низкий, средний или высокий. Это важно, так как GPT-5.6 по умолчанию отвечает короче GPT-5.5, и старые инструкции «отвечай кратко» могут излишне обрезать ответ. Второй — Programmatic Tool Calling, программный вызов инструментов для задач с чёткими границами. Код сам фильтрует и группирует результаты, возвращая модели сжатый итог вместо сырых данных.

Смешанные отзывы и инциденты

Отзывы пользователей о GPT-5.6 Sol разделились. ИИ-инвестор Мэтт Шумер сообщил, что агент на базе этой модели случайно удалил почти все файлы на его Mac из-за ошибки в обработке системной переменной $HOME. OpenAI подтвердила, что подобный сценарий был описан в системной карте модели ещё до публичного релиза, и пообещала доработки. Разработчики помогли Шумеру восстановить данные.

С аналогичной проблемой столкнулся основатель проекта BridgeMind Мэттью Миллер: код от GPT-5.6 Sol отменил все подписки в Stripe. Правда, Миллер сам признал, что выдал агенту полный доступ на запись вместо ограниченного API-ключа. Это классическая ошибка безопасности, а не проблема модели как таковой.

С другой стороны, есть и впечатляющие успехи. Сотрудник OpenAI Итан Найт заявил, что GPT-5.6 Sol Ultra доказала гипотезу Cycle Double Cover — задачу теории графов, которая не поддавалась решению полвека. Модели с 64 субагентами хватило меньше часа. Независимая проверка пока не опубликована, но сам факт поражает.

Также на тесте HealthBench Professional GPT-5.6 Sol набрала 60,5 балла против 59 у GPT-5.5, превзойдя среднюю оценку врачей (43,7 балла) по точности и полноте ответов. Это серьёзный шаг вперёд для применения ИИ в здравоохранении.

Мой комментарий: Переход от длинных сценариев к кратким промптам — это не просто оптимизация, а признание того, что современные модели стали умнее. GPT-5.6 Sol уже понимает контекст и цели без излишних инструкций. Однако инциденты с удалением файлов и подписок напоминают: чем больше автономии мы даём ИИ, тем важнее становятся чёткие границы безопасности и ограниченные права доступа. Технология мощная, но управлять ей нужно с умом.