Qwen 3.6 ಮಾಡೆಲ್ RTX 4070 ಮೇಲೆ Qwen 3.5 ನಷ್ಟೇ ಟೋಕನ್ ಥ್ರೂಪುಟ್ ಅನ್ನು ತಲುಪುತ್ತದೆ—36.7 t/s ಗೆ ಹೋಲಿಸಿದರೆ 38.76 ಟೋಕನ್ಗಳು ಪ್ರತಿ ಸೆಕೆಂಡಿಗೆ—ಆದರೆ ಇದು ಸ್ವಾಯತ್ತ ಏಜೆಂಟ್ಗಳು (autonomous agents) ಮತ್ತು ಕೋಡಿಂಗ್ ನೆರವನ್ನು ಗಮನಾರ್ಹವಾಗಿ ಉತ್ತಮವಾಗಿ ನಿರ್ವಹಿಸುತ್ತದೆ. ಗ್ರಾಹಕ-ಶ್ರೇಣಿಯ ಹಾರ್ಡ್ವೇರ್ನಲ್ಲಿ (consumer-grade hardware) AI-ಚಾಲಿತ ಪರಿಕರಗಳನ್ನು ನಿರ್ಮಿಸುವವರಿಗೆ ಇದು ಬಹಳ ಮುಖ್ಯವಾಗಿದೆ.
ಈ ಅಂಕಿಅಂಶಗಳು ಏಕೆ ಮುಖ್ಯ
ಎರಡೂ ಮಾಡೆಲ್ಗಳು ಒಂದೇ ರೀತಿಯ ಆಕ್ಟಿವ್-ಪ್ಯಾರಾಮೀಟರ್ (active-parameter) ಸಂಖ್ಯೆಯನ್ನು ಹೊಂದಿವೆ, ಆದ್ದರಿಂದ ಅವುಗಳ ವೇಗವು ಒಂದೇ ರೀತಿ ಇರಬೇಕು. ಆರಂಭಿಕ ಪರೀಕ್ಷೆಯಲ್ಲಿ 3.6 ಮಾಡೆಲ್ನಲ್ಲಿ ಭಾರಿ ವೇಗ ಕುಸಿತ ಕಂಡುಬಂದಿತ್ತು, ಆದರೆ ಒಂದು ಅನಿರೀಕ್ಷಿತ ಪ್ರಕ್ರಿಯೆಯು (stray process) 11 GB VRAM ಅನ್ನು ಬಳಸಿಕೊಳ್ಳುತ್ತಿದ್ದು, ಮಾಡೆಲ್ ಅನ್ನು ಸಿಸ್ಟಮ್ RAM ಗೆ ವರ್ಗಾಯಿಸಿತ್ತು. ಆ ಪ್ರಕ್ರಿಯೆಯನ್ನು ನಿಲ್ಲಿಸಿದ ನಂತರ, ಥ್ರೂಪುಟ್ ನಿರೀಕ್ಷಿತ ಮಟ್ಟಕ್ಕೆ ಮರಳಿತು, ಇದು 12 GB VRAM ಬಜೆಟ್ನಲ್ಲಿ ಎರಡೂ ವರ್ಷನ್ಗಳು ಪ್ರಾಯೋಗಿಕವಾಗಿ ಒಂದೇ ವೇಗದಲ್ಲಿ ಕಾರ್ಯನಿರ್ವಹಿಸುತ್ತವೆ ಎಂಬುದನ್ನು ಖಚಿತಪಡಿಸುತ್ತದೆ.
ವಾಸ್ತವವಾಗಿ ವ್ಯತ್ಯಾಸವೇನು
ಈ ಅಪ್ಗ್ರೇಡ್ ಮಾಡೆಲ್ನ ಸಾಮರ್ಥ್ಯದಲ್ಲಿದೆ ಹೊರತು ಟೋಕನ್ ಜನರೇಷನ್ನಲ್ಲಿಲ್ಲ. ಡೆವಲಪರ್ಗಳ ಬೆಂಚ್ಮಾರ್ಕ್ಗಳ ವರದಿಯ ಪ್ರಕಾರ:
- ಫ್ರಂಟ್-ಎಂಡ್ ಜನರೇಷನ್ ಕಾರ್ಯಗಳು 43% ಸುಧಾರಿಸಿವೆ
- ಟರ್ಮಿನಲ್-ಆಪರೇಷನ್ ಕಾರ್ಯಗಳು 27% ಸುಧಾರಿಸಿವೆ
- ಕೋಡಿಂಗ್ಗೆ ಸಂಬಂಧಿಸಿದ ಕಾರ್ಯಗಳು 11% ಸುಧಾರಿಸಿವೆ
ಈ ಮೂರೂ ಅಂಶಗಳು ಟೂಲ್ಗಳನ್ನು ಬಳಸುವ (invoke tools), ದೀರ್ಘವಾದ ಕಾಂಟೆಕ್ಸ್ಟ್ ವಿಂಡೋಗಳನ್ನು (long context windows) ಕಾಯ್ದುಕೊಳ್ಳುವ ಮತ್ತು ಬಹು ಹಂತದ ತಾರ್ಕಿಕ ಹಂತಗಳನ್ನು (reasoning steps) ಜೋಡಿಸುವ ಮಾಡೆಲ್ನ ಸಾಮರ್ಥ್ಯದ ಮೇಲೆ ಅವಲಂಬಿತವಾಗಿವೆ. ಪ್ರಾಯೋಗಿಕವಾಗಿ, 3.6 ಮಾಡೆಲ್ ತಪ್ಪುಗಳನ್ನು ಹೆಚ್ಚು ವಿಶ್ವಾಸಾರ್ಹವಾಗಿ ಸರಿಪಡಿಸುತ್ತದೆ, ಸಂಕೀರ್ಣ ಸೂಚನೆಗಳನ್ನು ಪಾಲಿಸುತ್ತದೆ ಮತ್ತು ಶೆಲ್ (shell) ಅಥವಾ IDE ಒಳಗೊಂಡಿರುವ ಬಹು-ಹಂತದ ವರ್ಕ್ಫ್ಲೋಗಳನ್ನು ನಿರ್ವಹಿಸುತ್ತದೆ.
ಯಾರು ಪ್ರಯೋಜನ ಪಡೆಯುತ್ತಾರೆ
- ಏಜೆಂಟ್ಗಳನ್ನು ನಿರ್ಮಿಸುವ ಡೆವಲಪರ್ಗಳು – AI ಕಮಾಂಡ್ಗಳನ್ನು ಚಲಾಯಿಸಿದಾಗ, ಫೈಲ್ಗಳನ್ನು ಎಡಿಟ್ ಮಾಡಿದಾಗ ಅಥವಾ ಸೇವೆಗಳನ್ನು ಸಂಘಟಿಸಿದಾಗ (orchestrates services), ಹೊಸ ಮಾಡೆಲ್ ವಿಫಲ ಪ್ರಯತ್ನಗಳನ್ನು ಕಡಿಮೆ ಮಾಡುತ್ತದೆ ಮತ್ತು ಮ್ಯಾನುಯಲ್ ತಿದ್ದುಪಡಿಗಳ ಅಗತ್ಯವನ್ನು ತಗ್ಗಿಸುತ್ತದೆ.
- ಕೋಡಿಂಗ್ ಅಸಿಸ್ಟೆಂಟ್ಗಳು – ಕೋಡಿಂಗ್ ಕಾರ್ಯಗಳಲ್ಲಿನ ಈ ಸಣ್ಣ ಸುಧಾರಣೆಯು ಕಡಿಮೆ 'ಹ್ಯಾಲ್ಯುಸಿನೇಟೆಡ್' (hallucinated) ಸ್ನಿಪ್ಪೆಟ್ಗಳು ಮತ್ತು ಸುಗಮವಾದ ರಿಫ್ಯಾಕ್ಟರಿಂಗ್ ಸಲಹೆಗಳನ್ನು ನೀಡುತ್ತದೆ.
- ಕಡಿಮೆ ಬಜೆಟ್ನಲ್ಲಿರುವ ಸಂಶೋಧಕರು – ಒಂದೇ RTX 4070 ಮೇಲೆ ಹೊಸ ಮಾಡೆಲ್ ಅನ್ನು ಅದೇ ವೇಗದಲ್ಲಿ ಚಲಾಯಿಸುವುದರಿಂದ, ತಂಡಗಳು ಹೆಚ್ಚುವರಿ GPUಗಳನ್ನು ಖರೀದಿಸದೆ ಅಪ್ಗ್ರೇಡ್ ಮಾಡಿಕೊಳ್ಳಬಹುದು.
ಯಾರು ತಲೆಕೆಡಿಸಿಕೊಳ್ಳುವ ಅಗತ್ಯವಿಲ್ಲ
ನಿಮ್ಮ ಕೆಲಸವು ಹೆಚ್ಚಾಗಿ ಸರಳವಾದ ಪ್ರಶ್ನೋತ್ತರಗಳು ಅಥವಾ ಸಣ್ಣ ರೂಪದ ಪಠ್ಯ ಜನರೇಷನ್ ಆಗಿದ್ದರೆ, ಕಾರ್ಯಕ್ಷಮತೆಯ ವ್ಯತ್ಯಾಸವು ಕಂಡುಬರುವುದಿಲ್ಲ. ಪ್ರತಿ ಸೆಕೆಂಡಿಗೆ ಟೋಕನ್ ಸಂಖ್ಯೆಯು ಒಂದೇ ಆಗಿರುತ್ತದೆ ಮತ್ತು VRAM ಬಳಕೆ ಹೆಚ್ಚಾಗುವುದಿಲ್ಲ, ಆದ್ದರಿಂದ ಬದಲಾಯಿಸುವುದರಿಂದ ಯಾವುದೇ ಹೆಚ್ಚಿನ ವೆಚ್ಚವಾಗುವುದಿಲ್ಲ.
ಸಾರಾಂಶ: Qwen 3.6 ಎಂಬುದು ಕೇವಲ ವೇಗದ ಅಪ್ಗ್ರೇಡ್ ಅಲ್ಲ; ಇದು ಸಾಮರ್ಥ್ಯದ ಅಪ್ಗ್ರೇಡ್. ಅದೇ ಗ್ರಾಹಕ GPU ಮೇಲೆ, ಇದು ಹಾರ್ಡ್ವೇರ್ ವೆಚ್ಚವನ್ನು ಹೆಚ್ಚಿಸದೆ ಡೆವಲಪರ್ಗಳಿಗೆ ಹೆಚ್ಚು ವಿಶ್ವಾಸಾರ್ಹ ಮತ್ತು ಸ್ವಾವಲಂಬಿ AI ಪಾಲುದಾರನನ್ನು ನೀಡುತ್ತದೆ.
