Команда OpenAI випустила оновлене керівництво з промптингу для флагманської моделі GPT-5.6 Sol та всього сімейства GPT-5.6. Ключовий посил документа — відмова від довгих, багатоступеневих сценаріїв на користь максимально лаконічних запитів. Це кардинальна зміна підходу порівняно з інструкціями для попередньої версії, GPT-5.

Внутрішні тести на агентних задачах програмування показали вражаючі результати: компактні промпти підвищили оцінки якості на 10-15%, скоротили витрати токенів на 41-66% та знизили вартість виконання завдань на 33-67%. Ефективність очевидна, і це не просто теорія — це практичні дані.

Раніше, при запуску GPT-5 у серпні 2025 року, OpenAI робила акцент на XML-блоках, шаблонах для збору контексту та детальних сценаріях виклику інструментів. Тепер же для GPT-5.6 Sol рекомендується прибрати повтори, стильові вказівки, неефективні приклади та кроки, з якими модель уже стабільно справляється. Натомість у промпті мають залишитися: видимий результат, критерії успіху, умови зупинки та жорсткі обмеження, такі як вимоги безпеки.

Окреме попередження: GPT-5.6 суворо дотримується умов запиту. Суперечливі правила збивають модель сильніше, ніж нестача деталей. Слова «завжди» та «ніколи» рекомендовано використовувати лише для інваріантів, а для решти випадків — формулювати умовні правила.

У керівництві з'явилися два нові розділи. Перший — параметр text.verbosity, який задає базовий рівень деталізації відповіді: низький, середній або високий. Це важливо, оскільки GPT-5.6 за замовчуванням відповідає коротше за GPT-5.5, і старі інструкції «відповідай коротко» можуть надмірно обрізати відповідь. Другий — Programmatic Tool Calling, програмний виклик інструментів для задач із чіткими межами. Код сам фільтрує та групує результати, повертаючи моделі стислий підсумок замість сирих даних.

Змішані відгуки та інциденти

Відгуки користувачів про GPT-5.6 Sol розділилися. ІІ-інвестор Метт Шумер повідомив, що агент на базі цієї моделі випадково видалив майже всі файли на його Mac через помилку в обробці системної змінної $HOME. OpenAI підтвердила, що подібний сценарій був описаний у системній карті моделі ще до публічного релізу, і пообіцяла доопрацювання. Розробники допомогли Шумеру відновити дані.

З аналогічною проблемою зіткнувся засновник проекту BridgeMind Метью Міллер: код від GPT-5.6 Sol скасував усі підписки в Stripe. Щоправда, Міллер сам визнав, що видав агенту повний доступ на запис замість обмеженого API-ключа. Це класична помилка безпеки, а не проблема моделі як такої.

З іншого боку, є й вражаючі успіхи. Співробітник OpenAI Ітан Найт заявив, що GPT-5.6 Sol Ultra довела гіпотезу Cycle Double Cover — задачу теорії графів, яка не піддавалася розв'язанню півстоліття. Моделі з 64 субагентами вистачило менше години. Незалежна перевірка поки не опублікована, але сам факт вражає.

Також на тесті HealthBench Professional GPT-5.6 Sol набрала 60,5 бала проти 59 у GPT-5.5, перевершивши середню оцінку лікарів (43,7 бала) за точністю та повнотою відповідей. Це серйозний крок уперед для застосування ІІ в охороні здоров'я.

Мій коментар: Перехід від довгих сценаріїв до коротких промптів — це не просто оптимізація, а визнання того, що сучасні моделі стали розумнішими. GPT-5.6 Sol уже розуміє контекст і цілі без зайвих інструкцій. Однак інциденти з видаленням файлів і підписок нагадують: чим більше автономії ми даємо ІІ, тим важливішими стають чіткі межі безпеки та обмежені права доступу. Технологія потужна, але керувати нею потрібно з розумом.