OpenAI рекомендує стислі запити для GPT-5.6: покращення якості на 15% та економія токенів на 66%

OpenAI оптимізує взаємодію з GPT-5.6: нове керівництво щодо ефективності запитів
Компанія OpenAI представила розширені рекомендації щодо формулювання запитів (промптів) для своєї новітньої флагманської моделі GPT-5.6 Sol та всієї лінійки GPT-5.6. Команда розробників наголошує на важливості максимальної лаконічності відповідей користувачів.
Внутрішнє тестування, зосереджене на агентних завданнях програмування, виявило суттєві переваги стислих запитів:
- Підвищення показників якості на 10-15%.
- Зменшення споживання токенів на 41-66%.
- Скорочення витрат на виконання завдань на 33-67%.
Розробники інтелектуального чат-бота порівняли цей новий підхід з методологією, що була опублікована для GPT-5 під час запуску моделі у серпні 2025 року. Тоді OpenAI акцентувала увагу на використанні XML-блоків, шаблонів для агрегації контексту та сценаріїв виклику інструментів із покроковим описом процесу.
Для GPT-5.6 Sol компанія рекомендує відмовлятися від повторень, стилістичних вказівок, які не впливають на функціонування моделі, неефективних прикладів та кроків, з якими модель вже впевнено справляється. Натомість, слід зосередитись на чіткому визначенні видимого результату, критеріїв успіху, умов завершення роботи та суворих обмежень, таких як вимоги безпеки.
Окремо в OpenAI застерігають, що GPT-5.6 неухильно дотримується умов запиту. Тому суперечливі правила можуть збити модель з пантелику значно сильніше, ніж брак деталей.
У компанії радять використовувати слова «завжди» та «ніколи» виключно для інваріантів (незмінних умов). Для решти випадків рекомендується формулювати умовні правила.
Керівництво також доповнено двома новими розділами:
- Рівень деталізації відповіді – визначає базовий рівень деталізації відповіді: низький, середній або високий. Більш специфічні вимоги до довжини, як і раніше, вказуються безпосередньо в промпті. Це нововведення зумовлене тим, що GPT-5.6 за замовчуванням надає коротші відповіді, ніж GPT-5.5. Тому старі інструкції на кшталт «відповідай коротко» іноді можуть надмірно обрізати результат.
- Інструментальний виклик (Tool Call) – програмний виклик інструментів, що ідеально підходить для завдань з чітко визначеними межами. Ця функція дозволяє коду самостійно фільтрувати та групувати результати викликів інструментів, надаючи моделі стислий підсумок замість необроблених даних.
OpenAI презентувала сімейство GPT-5.6 – моделі Sol, Terra та Luna – наприкінці червня. Доступ до них був наданий у форматі обмеженого попереднього перегляду для довірених партнерів, що було зумовлено запитами від урядів США. Повноцінний реліз відбувся 9 липня.
Відгуки користувачів щодо нового продукту виявилися неоднозначними. AI-інвестор Метт Шумер повідомив, що агент з GPT-5.6 Sol видалив майже всі файли на його Mac.
GPT-5.6-Sol just accidentally deleted almost ALL of my Mac’s files.
And this is why I trust Fable 1000x more. pic.twitter.com/442LjuClW2— Matt Shumer (@mattshumer_) July 10, 2026
Причиною стала помилка в обробці системної змінної $HOME. Команда на видалення файлів призвела до рекурсивного очищення домашньої директорії.
Схожий сценарій OpenAI описала в системній карті GPT-5.6 ще 26 червня, до початку публічного релізу. Тоді модель без дозволу користувача видаляла не ті віртуальні машини та втрачала результати роботи. Тібо Соттіо, керівник напрямку Codex, підтвердив проблеми запуску та пообіцяв подальші вдосконалення.
Розробники проєкту допомогли Шумеру, про що він написав через кілька днів після інциденту.
З аналогічною проблемою зіткнувся засновник проєкту BridgeMind Меттью Міллер. Він повідомив, що код від GPT-5.6 Sol скасував усі підписки в Stripe без його команди.
GPT 5.6 SOL CANNOT BE TRUSTED.
I woke up this morning and my MRR was down THOUSANDS of dollars.
My customers did not cancel. Code written by GPT 5.6 Sol canceled EVERY active Stripe subscription my business had. In 7 seconds. While I slept.
Fable 5 has never done this to me.… https://t.co/NznNxdGJIi pic.twitter.com/1FAhZ7JoJc— BridgeMind (@bridgemindai) July 13, 2026
У коментарях під своїм дописом Міллер сам пояснив причину: він надав агенту повний доступ на запис замість обмеженого API-ключа.
Є й позитивні приклади. Ітан Найт, співробітник OpenAI, заявив, що GPT-5.6 Sol Ultra довела гіпотезу Cycle Double Cover – задачу з теорії графів, яку не вдавалося розв’язати протягом півстоліття. Моделі з 64 субагентами знадобилося менше години. Однак незалежна перевірка доведення ще не опублікована.
Yesterday, we made GPT-5.6 Sol Ultra generally available. Today, we’re sharing that it produced a proof of the 50-year-old Cycle Double Cover Conjecture using 64 subagents in just under one hour. We’re sharing the prompt and proof below. We’re excited to see what you all do with…— Ethan Knight (@__eknight__) July 10, 2026
Каран Сингал, керівник напрямку охорони здоров’я в OpenAI, також представив результати тестування HealthBench Professional. На цьому тесті GPT-5.6 Sol отримала 60,5 бала, тоді як GPT-5.5 – 59 балів.
♥️ GPT-5.6 is a major step forward for health, both at the frontier and at cost.
These models push the frontier of performance per dollar, bringing the best health intelligence to all. The smallest variant, GPT-5.6 Luna, evaluated at the lowest reasoning effort, outperforms… https://t.co/jVXVXJOVAg pic.twitter.com/OhkRe2nVlT— Karan Singhal (@thekaransinghal) July 10, 2026
Відповіді лікарів на ті ж завдання були оцінені в 43,7 бала. Вони порівнювали відповіді моделі та колег наосліп за п’ятьма критеріями, включно з точністю та повнотою. Загалом експерти виставили майже 20 000 оцінок.
Нагадаємо, 9 липня OpenAI запустила голосовий режим нового покоління GPT-Live. Нейромережу навчили слухати та говорити одночасно, розуміти міжслівники, робити паузи та не перебивати співрозмовника.
Порада від Business News:
Ця інформація є надзвичайно корисною для всіх, хто використовує передові моделі штучного інтелекту від OpenAI. Нове керівництво щодо промптів допоможе оптимізувати ваші запити, зробити їх більш ефективними та зменшити витрати. А розбір реальних випадків використання, як позитивних, так і негативних, надасть цінний досвід та допоможе уникнути потенційних проблем під час роботи з GPT-5.6.
Подробиці можна знайти на сайті: cryptocurrency.tech
