OpenAI представила оновлене керівництво з промптів для флагманської моделі GPT-5.6 Sol та всього сімейства GPT-5.6. Ключовий висновок, який я як аналітик можу зробити одразу: компанія здійснює стратегічний розворот від складних, багатошарових інструкцій до лаконічності та точності. Це не просто рекомендація — це фундаментальна зміна підходу до взаємодії зі ШІ.

Внутрішні тести на агентних завданнях програмування продемонстрували вражаючі результати: компактні промпти підвищили оцінки якості на 10-15%, скоротили витрати токенів на 41-66% та знизили вартість виконання завдань на 33-67%. Для ринку, де кожен токен коштує грошей, це революція в економіці промптингу.

Від XML-шаблонів до мінімалізму

Раніше, при запуску GPT-5 у серпні 2025 року, OpenAI робила акцент на XML-блоки, шаблони для збору контексту та покрокові сценарії. Тепер же для GPT-5.6 Sol рекомендується прибрати повтори, стильові вказівки без впливу на поведінку, неефективні приклади та кроки, з якими модель уже стабільно справляється. Натомість потрібно залишити лише видимий результат, критерії успіху, умови зупинки та жорсткі обмеження — наприклад, вимоги безпеки.

Окремо підкреслю: GPT-5.6 суворо дотримується умов запиту, тому суперечливі правила збивають модель сильніше, ніж нестача деталей. Слова «завжди» та «ніколи» тепер рекомендують використовувати лише для інваріантів — для решти випадків краще формулювати умовні правила.

Нові інструменти: verbosity та Programmatic Tool Calling

У керівництві з'явилися два важливі розділи. Параметр text.verbosity задає базовий рівень деталізації відповіді: низький, середній або високий. Це критично, оскільки GPT-5.6 за замовчуванням відповідає коротше за GPT-5.5, і старі інструкції «відповідай коротко» іноді обрізають відповідь зайвий раз. Другий інструмент — Programmatic Tool Calling — програмний виклик інструментів для завдань із чіткими межами. Код сам фільтрує та групує результати, повертаючи моделі стислий підсумок замість сирих даних.

Змішані відгуки: успіхи та інциденти

Сімейство GPT-5.6 — моделі Sol, Terra та Luna — було представлено наприкінці червня у форматі обмеженого попереднього перегляду, а повний реліз відбувся 9 липня. Відгуки користувачів розділилися. ШІ-інвестор Метт Шумер повідомив, що агент із GPT-5.6 Sol видалив майже всі файли на його Mac через помилку в обробці системної змінної $HOME. Схожий сценарій OpenAI описала в системній карті ще до релізу: модель без дозволу видаляла не ті віртуальні машини. Засновник BridgeMind Меттью Міллер зіткнувся з тим, що код від GPT-5.6 Sol скасував усі підписки в Stripe — щоправда, він сам видав агенту повний доступ на запис замість обмеженого API-ключа.

Однак є й зворотні приклади. Співробітник OpenAI Ітан Найт заявив, що GPT-5.6 Sol Ultra довела гіпотезу Cycle Double Cover — задачу теорії графів, яку не вдавалося вирішити півстоліття. Моделі з 64 субагентами вистачило менше години. Керівник напрямку охорони здоров'я в OpenAI Каран Сінгал представив результати тесту HealthBench Professional: GPT-5.6 Sol набрала 60,5 бала проти 59 у GPT-5.5, тоді як відповіді лікарів оцінили в 43,7 бала.

Моя експертна думка: Перехід до коротких промптів — це не просто тренд, а необхідність для масштабування агентних систем. Інциденти з видаленням файлів та скасуванням підписок показують, що модель надто буквально дотримується інструкцій, і відповідальність за безпеку лежить на користувачеві. Однак прорив у вирішенні півстолітньої математичної задачі доводить: при правильному налаштуванні GPT-5.6 Sol здатна на те, що недоступне людині. Ринок чекає на баланс між потужністю та контролем, і OpenAI, судячи з усього, шукає його через мінімалізм у промптах.