Qwen 3.6 ਇੱਕ RTX 4070 'ਤੇ Qwen 3.5 ਦੇ ਬਰਾਬਰ ਹੀ ਟੋਕਨ ਥਰੂਪੁੱਟ (token throughput) ਪ੍ਰਾਪਤ ਕਰਦਾ ਹੈ—38.76 ਟੋਕਨ ਪ੍ਰਤੀ ਸੈਕਿੰਡ ਬਨਾਮ 36.7 t/s—ਪਰ ਇਹ ਆਟੋਨੋਮਸ ਏਜੰਟਾਂ ਅਤੇ ਕੋਡਿੰਗ ਸਹਾਇਤਾ ਨੂੰ ਕਾਫ਼ੀ ਬਿਹਤਰ ਤਰੀਕੇ ਨਾਲ ਸੰਭਾਲਦਾ ਹੈ। ਇਹ ਉਨ੍ਹਾਂ ਸਾਰਿਆਂ ਲਈ ਮਹੱਤਵਪੂਰਨ ਹੈ ਜੋ ਕੰਜ਼ਿਊਮਰ-ਗ੍ਰੇਡ ਹਾਰਡਵੇਅਰ 'ਤੇ AI-ਡਰਾਈਵਨ ਟੂਲ ਬਣਾ ਰਹੇ ਹਨ।

ਇਹ ਅੰਕੜੇ ਕਿਉਂ ਮਹੱਤਵਪੂਰਨ ਹਨ

ਦੋਵੇਂ ਮਾਡਲਾਂ ਵਿੱਚ ਐਕਟਿਵ-ਪੈਰਾਮੀਟਰਾਂ ਦੀ ਗਿਣਤੀ ਇੱਕੋ ਜਿਹੀ ਹੈ, ਇਸ ਲਈ ਕੱਚੀ ਰਫ਼ਤਾਰ (raw speed) ਵੀ ਇੱਕੋ ਜਿਹੀ ਹੋਣੀ ਚਾਹੀਦੀ ਹੈ। ਇੱਕ ਸ਼ੁਰੂਆਤੀ ਟੈਸਟ ਵਿੱਚ 3.6 ਲਈ ਬਹੁਤ ਜ਼ਿਆਦਾ ਸੁਸਤੀ ਦਿਖਾਈ ਦਿੱਤੀ ਸੀ, ਪਰ ਇੱਕ ਵਾਧੂ ਪ੍ਰੋਸੈਸ 11 GB VRAM ਦੀ ਵਰਤੋਂ ਕਰ ਰਿਹਾ ਸੀ ਅਤੇ ਮਾਡਲ ਨੂੰ ਸਿਸਟਮ RAM 'ਤੇ ਚਲਾਉਣ ਲਈ ਮਜਬੂਰ ਕਰ ਰਿਹਾ ਸੀ। ਉਸ ਪ੍ਰੋਸੈਸ ਨੂੰ ਰੋਕਣ ਤੋਂ ਬਾਅਦ, ਥਰੂਪੁੱਟ ਉਮੀਦ ਕੀਤੇ ਰੇਂਜ ਵਿੱਚ ਵਾਪਸ ਆ ਗਿਆ, ਜਿਸ ਨਾਲ ਇਹ ਪੁਸ਼ਟੀ ਹੋਈ ਕਿ ਦੋਵੇਂ ਵਰਜ਼ਨ 12 GB VRAM ਬਜਟ 'ਤੇ ਲਗਭਗ ਇੱਕੋ ਹੀ ਰਫ਼ਤਾਰ ਨਾਲ ਚੱਲਦੇ ਹਨ।

ਅਸਲ ਵਿੱਚ ਕੀ ਵੱਖਰਾ ਹੈ

ਅੱਪਗ੍ਰੇਡ ਸਮਰੱਥਾ (capability) ਵਿੱਚ ਹੈ, ਨਾ ਕਿ ਟੋਕਨ ਜਨਰੇਸ਼ਨ ਵਿੱਚ। ਡਿਵੈਲਪਰਾਂ ਦੇ ਬੈਂਚਮਾਰਕ ਰਿਪੋਰਟ ਕਰਦੇ ਹਨ:

  • ਫਰੰਟ-ਐਂਡ ਜਨਰੇਸ਼ਨ ਕੰਮਾਂ ਵਿੱਚ 43% ਸੁਧਾਰ ਹੁੰਦਾ ਹੈ
  • ਟਰਮੀਨਲ-ਆਪਰੇਸ਼ਨ ਕੰਮਾਂ ਵਿੱਚ 27% ਸੁਧਾਰ ਹੁੰਦਾ ਹੈ
  • ਕੋਡਿੰਗ ਨਾਲ ਸਬੰਧਤ ਕੰਮਾਂ ਵਿੱਚ 11% ਸੁਧਾਰ ਹੁੰਦਾ ਹੈ

ਇਹ ਤਿੰਨੋਂ ਮਾਡਲ ਦੇ ਟੂਲਸ ਨੂੰ ਕਾਲ ਕਰਨ, ਲੰਬੇ ਕੰਟੈਕਸ ਵਿੰਡੋਜ਼ (context windows) ਨੂੰ ਬਣਾਈ ਰੱਖਣ ਅਤੇ ਕਈ ਤਰਕ ਕਦਮਾਂ (reasoning steps) ਨੂੰ ਜੋੜਨ ਦੀ ਯੋਗਤਾ 'ਤੇ ਨਿਰਭਰ ਕਰਦੇ ਹਨ। ਅਸਲ ਵਿੱਚ, 3.6 ਗਲਤੀਆਂ ਨੂੰ ਵਧੇਰੇ ਭਰੋਸੇਮੰਦ ਤਰੀਕੇ ਨਾਲ ਸੁਧਾਰਦਾ ਹੈ, ਗੁੰਝਲਦਾਰ ਹਦਾਇਤਾਂ ਦੀ ਪਾਲਣਾ ਕਰਦਾ ਹੈ, ਅਤੇ ਉਹ ਮਲਟੀ-ਸਟੈਪ ਵਰਕਫਲੋ ਸੰਭਾਲਦਾ ਹੈ ਜਿਸ ਵਿੱਚ ਸ਼ੈੱਲ (shell) ਜਾਂ IDE ਸ਼ਾਮਲ ਹੁੰਦਾ ਹੈ।

ਕਿਸ ਨੂੰ ਫਾਇਦਾ ਹੋਵੇਗਾ

  • ਏਜੰਟ ਬਣਾਉਣ ਵਾਲੇ ਡਿਵੈਲਪਰ – ਜਦੋਂ AI ਕਮਾਂਡਾਂ ਚਲਾਉਂਦਾ ਹੈ, ਫਾਈਲਾਂ ਨੂੰ ਐਡਿਟ ਕਰਦਾ ਹੈ, ਜਾਂ ਸੇਵਾਵਾਂ ਦਾ ਪ੍ਰਬੰਧਨ ਕਰਦਾ ਹੈ, ਤਾਂ ਨਵਾਂ ਮਾਡਲ ਅਸਫਲ ਕੋਸ਼ਿਸ਼ਾਂ ਨੂੰ ਘਟਾਉਂਦਾ ਹੈ ਅਤੇ ਮੈਨੂਅਲ ਸੁਧਾਰ ਦੀ ਲੋੜ ਨੂੰ ਘਟਾਉਂਦਾ ਹੈ।
  • ਕੋਡਿੰਗ ਸਹਾਇਕ (Coding assistants) – ਕੋਡਿੰਗ ਕੰਮਾਂ ਵਿੱਚ ਮਾਮੂਲੀ ਸੁਧਾਰ ਦਾ ਮਤਲਬ ਹੈ ਘੱਟ ਗਲਤ (hallucinated) ਕੋਡ ਸਨਿਪੇਟਸ ਅਤੇ ਵਧੇਰੇ ਸੁਚਾਰੂ ਰੀਫੈਕਟਰੀੰਗ ਸੁਝਾਅ।
  • ਸੀਮਤ ਬਜਟ ਵਾਲੇ ਖੋਜਕਰਤਾ – ਇੱਕ ਸਿੰਗਲ RTX 4070 'ਤੇ ਨਵੇਂ ਮਾਡਲ ਨੂੰ ਉਹੀ ਰਫ਼ਤਾਰ ਨਾਲ ਚਲਾਉਣ ਨਾਲ ਟੀਮਾਂ ਵਾਧੂ GPU ਖਰੀਦੇ ਬਿਨਾਂ ਅੱਪਗ੍ਰੇਡ ਕਰ ਸਕਦੀਆਂ ਹਨ।

ਕਿਸ ਨੂੰ ਚਿੰਤਾ ਕਰਨ ਦੀ ਲੋੜ ਨਹੀਂ

ਜੇਕਰ ਤੁਹਾਡਾ ਕੰਮ ਜ਼ਿਆਦਾਤਰ ਸਿੱਧੇ ਸਵਾਲ-ਜਵਾਬ ਜਾਂ ਛੋਟੇ ਰੂਪ ਵਿੱਚ ਟੈਕਸਟ ਜਨਰੇਸ਼ਨ ਦਾ ਹੈ, ਤਾਂ ਪ੍ਰਦਰਸ਼ਨ ਦਾ ਅੰਤਰ ਖਤਮ ਹੋ ਜਾਂਦਾ ਹੈ। ਟੋਕਨ-ਪ੍ਰਤੀ-ਸੈਕਿੰਡ ਦਾ ਅੰਕੜਾ ਉਹੀ ਰਹਿੰਦਾ ਹੈ, ਅਤੇ VRAM ਦੀ ਵਰਤੋਂ ਨਹੀਂ ਵਧਦੀ, ਇਸ ਲਈ ਬਦਲਣ ਵਿੱਚ ਕੋਈ ਖਰਚਾ ਨਹੀਂ ਆਉਂਦਾ।

ਸਾਰੰਸ਼: Qwen 3.6 ਕੋਈ ਸਪੀਡ ਅੱਪਗ੍ਰੇਡ ਨਹੀਂ ਹੈ; ਇਹ ਸਮਰੱਥਾ (capability) ਦਾ ਅੱਪਗ੍ਰੇਡ ਹੈ। ਉਹੀ ਕੰਜ਼ਿਊਮਰ GPU 'ਤੇ, ਇਹ ਹਾਰਡਵੇਅਰ ਦੀ ਲਾਗਤ ਨੂੰ ਬਰਕਰਾਰ ਰੱਖਦੇ ਹੋਏ ਡਿਵੈਲਪਰਾਂ ਨੂੰ ਇੱਕ ਵਧੇਰੇ ਭਰੋਸੇਮੰਦ ਅਤੇ ਸਵੈ-ਨਿਰਭਰ AI ਸਾਥੀ ਪ੍ਰਦਾਨ ਕਰਦਾ ਹੈ।