OpenAI оголосила 30 липня 2026 року, що використання API GPT-5.6 коштуватиме значно дешевше, ніж попередньої версії, представивши три рівневі моделі — Sol, Terra та Luna — а також суттєві знижки на кешоване читання.

Чому нове ціноутворення має значення

З моменту запуску GPT-5 витрати на API були важливою статтею витрат для всіх, хто розробляє розмовних агентів, конвеєри генерації з доповненим пошуком (RAG) або інструменти для масштабного вилучення даних. Зменшивши вартість вхідних токенів до $5, $2 та $0,20 за мільйон токенів для Sol, Terra та Luna відповідно, OpenAI надає розробникам дешевшу можливість обирати необхідний рівень міркування без переробки всього технологічного стека. Найбільша економія відчувається для Terra, яка тепер коштує лише 40% від попередньої флагманської ціни, та Luna, ціна якої становить лише 4% від цього показника.

Огляд трьох моделей

Модель Ціна входу (за 1 млн токенів) Ціна виходу (за 1 млн токенів) Типове використання
Sol $5 $30 Глибоке міркування, завдання з ланцюжком думок
Terra $2 $12 Робочі навантаження (production), збалансована продуктивність
Luna $0.20 $1.20 Великі обсяги, просте вилучення або класифікація

Sol залишається найдорожчою моделлю, але пропонує найглибший рівень міркування. Terra позиціонується як стандартна модель для більшості застосунків, тоді як Luna є варіантом для «високих масштабів», де глибиною можна пожертвувати заради економії.

Кешування ще більше знижує витрати

OpenAI представила шар кешування, який знижує вартість операцій читання на 90%. Тарифи для кешованого входу становлять:

  • Sol: $0,50 / млн токенів
  • Terra: $0,20 / млн токенів
  • Luna: $0,02 / млн токенів

Запис у кеш коштує в 1,25 раза дорожче за відповідний тариф на вхідні дані, а запис у кеші має зберігатися щонайменше 30 хвилин, перш ніж його можна буде видалити.

Доплата за довжину контексту: фактор контролю витрат

Тепер API стягує додаткову плату, якщо запит перевищує 272 тисячі вхідних токенів. Базова ціна входу подвоюється, а ціна виходу зростає в 1,5 раза. Тарифи Sol за перевищення ліміту становлять $10 за вхід та $45 за вихід за мільйон токенів, що дозволяє легко розрахувати штраф за незвично довгі контексти.

Що втрачають розробники

Зниження цін супроводжується двома важливими зауваженнями. По-перше, немає постійного безкоштовного рівня, а це означає, що кожен запит платний, незалежно від його розміру. По-друге, OpenAI ще не впровадила знижки для пакетних запитів (batch-endpoints) для GPT-5.6 — функцію, яка допомагала великим користувачам знижувати вартість кожного виклику в попередніх версіях.

Як знизити витрати

  • Обирайте правильну модель: використовуйте Sol лише для завдань, які справді потребують глибокого міркування; використовуйте Terra як основну для більшості робочих завдань; залиште Luna для високонавантажених завдань низької складності.
  • Використовуйте кешування: зберігайте промпти та проміжні результати, які повторно використовуються в різних викликах; знижка 90% на читання може значно перекрити базове зниження ціни.
  • Слідкуйте за довжиною контексту: розбивайте дуже довгі вхідні дані на менші частини або обрізайте несуттєві фрагменти, щоб уникнути подвійної плати за вхід.
  • Слідкуйте за часом життя кешу: мінімальна тривалість зберігання в кеші становить 30 хвилин.

Що далі

Розробникам варто стежити за офіційною сторінкою з цінами на випадок будь-яких змін, особливо щодо вартості запису в кеш або порогів довжини контексту.

Підсумок: Багаторівневе ціноутворення та агресивні знижки на кешування роблять GPT-5.6 доступною моделлю OpenAI, проте відсутність безкоштовного рівня та пакетних знижок означає, що грамотне управління витратами все одно залишатиметься необхідним для будь-якого масштабного впровадження.