OpenAI ਨੇ 30 ਜੁਲਾਈ, 2026 ਨੂੰ ਐਲਾਨ ਕੀਤਾ ਕਿ GPT-5.6 API ਦੀ ਕੀਮਤ ਇਸਦੇ ਪਿਛਲੇ ਮਾਡਲ ਨਾਲੋਂ ਬਹੁਤ ਘੱਟ ਹੋਵੇਗੀ, ਜਿਸ ਵਿੱਚ ਤਿੰਨ ਪੱਧਰੀ ਮਾਡਲ—Sol, Terra ਅਤੇ Luna—ਲਾਂਚ ਕੀਤੇ ਜਾ ਰਹੇ ਹਨ—ਅਤੇ ਨਾਲ ਹੀ ਕੈਸ਼ਡ ਰੀਡਸ (cached reads) ਲਈ ਭਾਰੀ ਛੋਟ ਵੀ ਦਿੱਤੀ ਗਈ ਹੈ।

ਨਵੀਂ ਕੀਮਤ ਕਿਉਂ ਮਹੱਤਵਪੂਰਨ ਹੈ

GPT-5 ਦੀ ਸ਼ੁਰੂਆਤ ਤੋਂ ਬਾਅਦ, API ਦੀਆਂ ਲਾਗਤਾਂ ਕਨਵਰਸੇਸ਼ਨਲ ਏਜੰਟਸ, ਰੀਟ੍ਰੀਵਲ-ਔਗਮੈਂਟਡ ਜਨਰੇਸ਼ਨ (RAG) ਪਾਈਪਲਾਈਨਾਂ ਜਾਂ ਵੱਡੇ ਪੱਧਰ ਦੇ ਡੇਟਾ-ਐਕਸਟ੍ਰੈਕਸ਼ਨ ਟੂਲ ਬਣਾਉਣ ਵਾਲਿਆਂ ਲਈ ਇੱਕ ਵੱਡਾ ਖਰਚਾ ਰਹੀਆਂ ਹਨ। Sol, Terra ਅਤੇ Luna ਲਈ ਇਨਪੁਟ ਫੀਸਾਂ ਨੂੰ ਕ੍ਰਮਵਾਰ $5, $2 ਅਤੇ $0.20 ਪ੍ਰਤੀ ਮਿਲੀਅਨ ਟੋਕਨਾਂ ਤੱਕ ਘਟਾ ਕੇ, OpenAI ਡਿਵੈਲਪਰਾਂ ਨੂੰ ਉਹਨਾਂ ਦੀ ਪੂਰੀ ਸਟੈਕ ਨੂੰ ਮੁੜ ਡਿਜ਼ਾਈਨ ਕੀਤੇ ਬਿਨਾਂ ਲੋੜੀਂਦੇ ਰੀਜ਼ਨਿੰਗ ਪੱਧਰ ਨੂੰ ਚੁਣਨ ਲਈ ਇੱਕ ਸਸਤਾ ਤਰੀਕਾ ਪ੍ਰਦਾਨ ਕਰਦਾ ਹੈ। ਸਭ ਤੋਂ ਵੱਧ ਬਚਤ Terra ਲਈ ਹੋਈ ਹੈ, ਜੋ ਹੁਣ ਪੁਰਾਣੀ ਫਲੈਗਸ਼ਿਪ ਕੀਮਤ ਦੇ 40% 'ਤੇ ਚੱਲਦੀ ਹੈ, ਅਤੇ Luna ਲਈ, ਜੋ ਉਸ ਬੈਂਚਮਾਰਕ ਦੇ ਸਿਰਫ 4% 'ਤੇ ਹੈ।

ਤਿੰਨ ਮਾਡਲਾਂ ਦਾ ਵੇਰਵਾ

ਮਾਡਲ ਇਨਪੁਟ ਕੀਮਤ (ਪ੍ਰਤੀ 1 ਮਿਲੀਅਨ ਟੋਕਨ) ਆਉਟਪੁੱਟ ਕੀਮਤ (ਪ੍ਰਤੀ 1 ਮਿਲੀਅਨ ਟੋਕਨ) ਆਮ ਵਰਤੋਂ
Sol $5 $30 ਡੂੰਘੀ ਰੀਜ਼ਨਿੰਗ, chain-of-thought ਟਾਸਕ
Terra $2 $12 Production workloads, ਸੰਤੁਲਿਤ ਪ੍ਰਦਰਸ਼ਨ
Luna $0.20 $1.20 ਉੱਚ-ਵਾਲੀਅਮ, ਸਧਾਰਨ ਐਕਸਟ੍ਰੈਕਸ਼ਨ ਜਾਂ ਕਲਾਸੀਫਿਕੇਸ਼ਨ

Sol ਸਭ ਤੋਂ ਮਹਿੰਗਾ ਬਣਿਆ ਹੋਇਆ ਹੈ ਪਰ ਸਭ ਤੋਂ ਵਧੀਆ ਰੀਜ਼ਨਿੰਗ ਡੂੰਘਾਈ ਪ੍ਰਦਾਨ ਕਰਦਾ ਹੈ। Terra ਨੂੰ ਜ਼ਿਆਦਾਤਰ ਐਪਲੀਕੇਸ਼ਨਾਂ ਲਈ ਡਿਫੌਲਟ ਵਜੋਂ ਰੱਖਿਆ ਗਿਆ ਹੈ, ਜਦੋਂ ਕਿ Luna ਇੱਕ "high-scale" ਵਿਕਲਪ ਹੈ ਜਿੱਥੇ ਲਾਗਤ ਲਈ ਡੂੰਘਾਈ ਨਾਲ ਸਮਝੌਤਾ ਕੀਤਾ ਜਾ ਸਕਦਾ ਹੈ।

ਕੈਸ਼ਿੰਗ ਬਿੱਲ ਨੂੰ ਹੋਰ ਵੀ ਘਟਾਉਂਦੀ ਹੈ

OpenAI ਨੇ ਇੱਕ ਕੈਸ਼ਿੰਗ ਲੇਅਰ ਪੇਸ਼ ਕੀਤੀ ਹੈ ਜੋ ਰੀਡ ਆਪਰੇਸ਼ਨਾਂ 'ਤੇ 90% ਦੀ ਛੋਟ ਦਿੰਦੀ ਹੈ। ਕੈਸ਼ਡ ਇਨਪੁਟ ਦੀਆਂ ਦਰਾਂ ਹਨ:

  • Sol: $0.50 / M tokens
  • Terra: $0.20 / M tokens
  • Luna: $0.02 / M tokens

ਕੈਸ਼ ਵਿੱਚ ਲਿਖਣ (Writes) ਦੀ ਲਾਗਤ ਸੰਬੰਧਿਤ ਇਨਪੁਟ ਦਰ ਦਾ 1.25 × ਹੈ, ਅਤੇ ਇੱਕ ਕੈਸ਼ ਐਂਟਰੀ ਨੂੰ ਹਟਾਏ ਜਾਣ ਤੋਂ ਪਹਿਲਾਂ ਘੱਟੋ-ਘੱਟ 30 ਮਿੰਟ ਤੱਕ ਰਹਿਣਾ ਚਾਹੀਦਾ ਹੈ।

ਕੰਟੈਕਸਟ-ਲੈਂਥ ਸਰਚਾਰਜਾਂ ਬਾਰੇ ਜਾਣਕਾਰੀ

ਜਦੋਂ ਕੋਈ ਰਿਕਵੈਸਟ 272 K ਟੋਕਨਾਂ ਤੋਂ ਵੱਧ ਇਨਪੁਟ ਹੁੰਦੀ ਹੈ, ਤਾਂ API ਹੁਣ ਸਰਚਾਰਜ ਲਗਾਉਂਦਾ ਹੈ। ਇਨਪੁਟ ਲਈ ਮੂਲ ਕੀਮਤ ਦੁੱਗਣੀ ਹੋ ਜਾਂਦੀ ਹੈ ਅਤੇ ਆਉਟਪੁੱਟ ਲਈ 1.5 × ਵਧ ਜਾਂਦੀ ਹੈ। Sol ਦੀ ਓਵਰੇਜ ਦਰਾਂ $10 ਇਨਪੁਟ ਅਤੇ $45 ਆਉਟਪੁੱਟ ਪ੍ਰਤੀ ਮਿਲੀਅਨ ਟੋਕਨਾਂ ਵਜੋਂ ਸੂਚੀਬੱਧ ਹਨ, ਜਿਸ ਨਾਲ ਅਸਾਧਾਰਣ ਤੌਰ 'ਤੇ ਲੰਬੇ ਕੰਟੈਕਸਟ ਲਈ ਜੁਰਮਾਨੇ ਦੀ ਗਣਨਾ ਕਰਨਾ ਆਸਾਨ ਹੋ ਜਾਂਦਾ ਹੈ।

ਡਿਵੈਲਪਰਾਂ ਨੂੰ ਕੀ ਨੁਕਸਾਨ ਹੋ ਸਕਦਾ ਹੈ

ਕੀਮਤਾਂ ਵਿੱਚ ਕਟੌਤੀ ਦੋ ਪ੍ਰਮੁੱਖ ਕਮੀਆਂ ਦੇ ਨਾਲ ਆਉਂਦੀ ਹੈ। ਪਹਿਲਾ, ਕੋਈ ਸਥਾਈ ਮੁਫਤ ਟਾਇਰ (free tier) ਨਹੀਂ ਹੈ, ਜਿਸਦਾ ਮਤਲਬ ਹੈ ਕਿ ਹਰ ਰਿਕਵੈਸਟ 'ਤੇ ਚਾਹੇ ਉਹ ਕਿੰਨੀ ਵੀ ਛੋਟੀ ਕਿਉਂ ਨਾ ਹੋਵੇ, ਚਾਰਜ ਲੱਗੇਗਾ। ਦੂਜਾ, OpenAI ਨੇ ਅਜੇ ਤੱਕ GPT-5.6 ਲਈ batch-endpoint ਛੋਟਾਂ ਪੇਸ਼ ਨਹੀਂ ਕੀਤੀਆਂ ਹਨ, ਜੋ ਕਿ ਇੱਕ ਅਜਿਹੀ ਵਿਸ਼ੇਸ਼ਤਾ ਸੀ ਜਿਸ ਨੇ ਪਿਛਲੇ ਵਰਜ਼ਨਾਂ ਵਿੱਚ ਵੱਡੇ ਪੱਧਰ ਦੇ ਉਪਭੋਗਤਾਵਾਂ ਨੂੰ ਪ੍ਰਤੀ-ਕਾਲ ਲਾਗਤ ਘਟਾਉਣ ਵਿੱਚ ਮਦਦ ਕੀਤੀ ਸੀ।

ਲਾਗਤਾਂ ਨੂੰ ਘੱਟ ਕਿਵੇਂ ਰੱਖਣਾ ਹੈ

  • ਸਹੀ ਮਾਡਲ ਚੁਣੋ: Sol ਦੀ ਵਰਤੋਂ ਸਿਰਫ ਉਹਨਾਂ ਕੰਮਾਂ ਲਈ ਕਰੋ ਜਿਨ੍ਹਾਂ ਨੂੰ ਸੱਚਮੁੱਚ ਡੂੰਘੀ ਰੀਜ਼ਨਿੰਗ ਦੀ ਲੋੜ ਹੈ; ਜ਼ਿਆਦਾਤਰ production ਕੰਮਾਂ ਲਈ Terra ਨੂੰ ਡਿਫੌਲਟ ਵਜੋਂ ਵਰਤੋ; high-throughput, ਘੱਟ-ਜਟਿਲਤਾ ਵਾਲੇ ਕੰਮਾਂ ਲਈ Luna ਨੂੰ ਰੱਖੋ।
  • ਕੈਸ਼ਿੰਗ ਦੀ ਵਰਤੋਂ ਕਰੋ: ਉਹ ਪ੍ਰੋਂਪਟਸ ਅਤੇ ਵਿਚਕਾਰਲੇ ਨਤੀਜੇ ਸਟੋਰ ਕਰੋ ਜੋ ਕਾਲਾਂ ਵਿੱਚ ਦੁਬਾਰਾ ਵਰਤੇ ਜਾਂਦੇ ਹਨ; 90% ਰੀਡ ਛੋਟ ਮੂਲ ਕੀਮਤ ਵਿੱਚ ਕਟੌਤੀ ਨਾਲੋਂ ਕਿਤੇ ਵੱਧ ਫਾਇਦਾ ਦੇ ਸਕਦੀ ਹੈ।
  • ਕੰਟੈਕਸਟ ਲੈਂਥ ਦਾ ਧਿਆਨ ਰੱਖੋ: 2× ਇਨਪੁਟ ਸਰਚਾਰਜ ਤੋਂ ਬਚਣ ਲਈ ਬਹੁਤ ਲੰਬੇ ਇਨਪੁਟਸ ਨੂੰ ਛੋਟੇ ਹਿੱਸਿਆਂ ਵਿੱਚ ਵੰਡੋ ਜਾਂ ਗੈਰ-ਜ਼ਰੂਰੀ ਹਿੱਸਿਆਂ ਨੂੰ ਕੱਟ ਦਿਓ।
  • ਕੈਸ਼ ਦੀ ਮਿਆਦ 'ਤੇ ਨਜ਼ਰ ਰੱਖੋ: ਘੱਟੋ-ਘੱਟ ਕੈਸ਼ ਮਿਆਦ 30 ਮਿੰਟ ਹੈ।

ਅੱਗੇ ਕੀ ਹੈ

ਡਿਵੈਲਪਰਾਂ ਨੂੰ ਕਿਸੇ ਵੀ ਤਬਦੀਲੀ ਲਈ ਅਧਿਕਾਰਤ ਕੀਮਤ ਪੰਨੇ 'ਤੇ ਨਜ਼ਰ ਰੱਖਣੀ ਚਾਹੀਦੀ ਹੈ, ਖਾਸ ਕਰਕੇ cache-write ਫੀਸ ਜਾਂ context-length ਸੀਮਾਵਾਂ ਦੇ ਆਲੇ-ਦੁਆਲੇ।

ਸਿੱਟਾ: GPT-5.6 ਦੀ ਪੱਧਰੀ ਕੀਮਤ ਅਤੇ ਹਮਲਾਵਰ ਕੈਸ਼ਿੰਗ ਛੋਟਾਂ ਇਸਨੂੰ ਇੱਕ ਕਿਫਾਇਤੀ OpenAI ਮਾਡਲ ਬਣਾਉਂਦੀਆਂ ਹਨ, ਪਰ ਮੁਫਤ ਟਾਇਰ ਅਤੇ batch ਛੋਟਾਂ ਦੀ ਘਾਟ ਦਾ ਮਤਲਬ ਹੈ ਕਿ ਕਿਸੇ ਵੀ ਵੱਡੇ ਪੱਧਰ ਦੇ ਤੈਨਾਤੀ (deployment) ਲਈ ਸਮਝਦਾਰੀ ਨਾਲ ਲਾਗਤ ਪ੍ਰਬੰਧਨ ਅਜੇ ਵੀ ਜ਼ਰੂਰੀ ਹੋਵੇਗਾ।